~/ARTIFICIAL I/minimax-releases-h3-multimodal-video-model-with-upcoming-open-weights

MiniMax Ra Mắt Mô Hình Video Đa Phương Thức H3 Và Sắp Mở Trọng Số

MiniMax đã ra mắt MiniMax-H3, một mô hình đa phương thức có khả năng tạo video dài tối đa 15 giây ở độ phân giải 2K kèm âm thanh nổi tích hợp sẵn (native stereo sound). Công ty cũng thông báo kế hoạch phát hành mở trọng số (open weights) cho cộng đồng trong vài ngày tới. Sự kiện này thách thức sự thống trị của các mô hình tạo video mã nguồn đóng bằng cách cung cấp một giải pháp thay thế mở có hiệu suất cao và chi phí tối ưu. Nó cho phép các nhà phát triển tùy chỉnh mô hình và chạy trên nhiều loại phần cứng AI khác nhau. Mô hình được vận hành bởi các công nghệ như H3-VAE và H3-Omni Transformer, vượt trội trong việc tuân thủ hướng dẫn, hiển thị thương hiệu và chuyển đổi chuyển động từ video sang video (V2V). Hiện tại, người dùng đã có thể trải nghiệm mô hình này trên Video Arena cho các tác vụ chuyển văn bản thành video và hình ảnh thành video.

## KIẾN THỨC NỀN

Chuyển đổi chuyển động từ video sang video (V2V motion transfer) là một kỹ thuật AI giúp trích xuất chuyển động từ một video tham chiếu và áp dụng nó vào một nhân vật hoặc hình ảnh mục tiêu. Tính năng đa phương thức tích hợp sẵn (native multimodality), từng được áp dụng trong các mô hình như MiniMax M3, cho phép một mạng thần kinh duy nhất xử lý và tạo ra nhiều loại dữ liệu như văn bản, âm thanh và video cùng một lúc.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#Artificial Intelligence#Video Generation#Multimodal AI#Open Source AI

$ subscribe --daily

MiniMax Ra Mắt Mô Hình Video Đa Phương Thức H3 Và Sắp Mở Trọng Số | Daily News