~/GENERATIVE A/yue2-3b-open-weights-music-generation-model-released

Phát hành mô hình tạo nhạc mã nguồn mở YuE2-3B

Nhóm Multimodal Art Projection đã phát hành YuE2-3B, một mô hình mở với 3 tỷ tham số được thiết kế để tạo toàn bộ bài hát từ lời nhạc. Bản phát hành đi kèm với một bản demo tương tác trên web để trình diễn khả năng tạo nhạc của mô hình. Các mô hình tạo âm thanh chất lượng cao với trọng số mở vẫn còn hiếm so với các mô hình văn bản và hình ảnh. YuE2-3B cung cấp cho các nhà phát triển và nghiên cứu một lựa chọn mạnh mẽ để chạy cục bộ nhằm tạo nhạc AI trọn vẹn mà không cần phụ thuộc vào dịch vụ đám mây thương mại đóng. YuE2-3B phát triển dựa trên kiến trúc YuE, vốn tận dụng các khung mô hình ngôn ngữ lớn để xử lý việc tổng hợp bài hát dài từ lời nhạc. Kích thước 3 tỷ tham số của mô hình được thiết kế để cân bằng giữa chất lượng và độ nhất quán của bài hát với yêu cầu tính toán vừa phải khi triển khai cục bộ.

## KIẾN THỨC NỀN

Được phát triển bởi nhóm Multimodal Art Projection (m-a-p), YuE là dòng mô hình nền tảng mở được tạo ra đặc biệt cho việc tạo bài hát thời lượng dài. Khác với các công cụ chỉ tạo đoạn âm thanh ngắn, YuE tùy biến kiến trúc LLM như LLaMA để tạo ra các bản nhạc trọn vẹn có cấu trúc kèm giọng hát và nhạc nền từ lời bài hát bằng văn bản.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#Generative AI#Audio Generation#Open Source#Machine Learning#LocalLLaMA

$ subscribe --daily

Phát hành mô hình tạo nhạc mã nguồn mở YuE2-3B | Daily News