~/GOOGLE/google-integrates-lyria-3-5-music-ai-model-into-gemini-and-developer

Google tích hợp mô hình AI tạo nhạc Lyria 3.5 vào Gemini và API

Google đã chính thức triển khai mô hình tạo âm nhạc Lyria 3.5 lên ứng dụng Gemini và Gemini API, đưa công nghệ này từ phòng thí nghiệm ra hệ sinh thái người dùng phổ thông. Bản cập nhật cho phép người dùng và nhà phát triển tạo ra các bài hát hoàn chỉnh kéo dài nhiều phút với đầy đủ đoạn lời, cầu nối (bridge) và điệp khúc từ gợi ý văn bản hoặc hình ảnh. Đợt phát hành này củng cố đáng kể vị thế AI tạo sinh của Google trong lĩnh vực sản xuất âm thanh bằng cách cung cấp cho nhà phát triển quyền truy cập API trực tiếp qua Google AI Studio và Vertex AI. Bằng việc hỗ trợ đầu vào hình ảnh và tích hợp hình mờ âm thanh mạnh mẽ, Google hướng tới đơn giản hóa quy trình sáng tạo đồng thời giải quyết các lo ngại về bản quyền và truy xuất nguồn gốc. Bản phát hành bao gồm hai mô hình: Lyria 3.5 dành cho các bài hát đầy đủ kéo dài nhiều phút (hỗ trợ định dạng MP3 và WAV) và Lyria 3 Clip dành cho các đoạn nhạc lặp 30 giây. Nhà phát triển có thể cung cấp tối đa 10 hình ảnh cùng với văn bản để định hình bản nhạc, đồng thời tất cả sản phẩm đầu ra đều tự động nhúng hình mờ chìm SynthID có khả năng chống nén và nén lại dữ liệu.

## KIẾN THỨC NỀN

Lyria là họ mô hình tạo âm nhạc do Google DeepMind phát triển nhằm tạo ra giọng hát, nhạc cụ và các bản nhạc hoàn chỉnh chất lượng cao. Để bảo vệ nội dung do AI tạo ra, Google đã phát triển SynthID, một công nghệ nhúng hình mờ kỹ thuật số không thể nhận biết bằng tai thường trực tiếp vào dạng sóng âm thanh để xác minh nguồn gốc mà không làm giảm chất lượng âm thanh.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#Google#Gemini#Audio AI#Generative AI#AI API

$ subscribe --daily