~/MULTIMODAL A/black-forest-labs-launches-flux-3-multimodal-ai-model

Black Forest Labs ra mắt mô hình AI đa phương thức FLUX 3

Black Forest Labs đã ra mắt thử nghiệm sớm FLUX 3, một mô hình nền tảng đa phương thức hợp nhất có khả năng tạo video dài tối đa 20 giây kèm âm thanh gốc chỉ trong một lần chạy. Mô hình này được huấn luyện đồng thời trên dữ liệu video, hình ảnh và âm thanh, mở rộng khả năng từ các dòng FLUX.1 và FLUX.2 trước đó. Bằng cách kết hợp tự nhiên khả năng tạo hình ảnh, video và âm thanh vào một kiến trúc duy nhất, FLUX 3 thúc đẩy sự phát triển của AI đa phương thức hợp nhất và mở ra các khả năng mới, bao gồm cả việc dự đoán hành vi robot thông qua hợp tác với Mimic Robotics. Mô hình được xây dựng trên khung học máy Self-Flow và hỗ trợ nhiều tác vụ đa dạng như chuyển văn bản thành video, chuyển hình ảnh thành video và hội thoại đa ngôn ngữ. Trong các đánh giá thực tế với video 720p dài 10 giây kèm âm thanh, FLUX 3 đạt tỷ lệ thắng 69% so với Grok Imagine Video và 52% so với Gemini Omni Flash.

## KIẾN THỨC NỀN

Black Forest Labs là một phòng nghiên cứu AI nổi tiếng với các mô hình tạo ảnh FLUX tiên tiến. Các hệ thống AI tạo sinh truyền thống thường sử dụng các mô hình riêng biệt để tạo video và âm thanh, điều này có thể dẫn đến các vấn đề về đồng bộ hóa, trong khi các mô hình đa phương thức hợp nhất hướng tới việc tạo ra cả hai cùng lúc để đạt được sự mạch lạc tốt hơn.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#Multimodal AI#Generative Video#Black Forest Labs#Artificial Intelligence

$ subscribe --daily

Black Forest Labs ra mắt mô hình AI đa phương thức FLUX 3 | Daily News