~/QWEN/qwen-developers-reveal-upcoming-27b-model-and-video-understanding-architecture-in-ama

Nhà phát triển Qwen hé lộ mô hình 27B sắp ra mắt và kiến trúc hiểu video trong AMA

Trong buổi AMA trên Twitter/X, các nhà phát triển Qwen tiết lộ sẽ sớm ra mắt mô hình 27B (Qwen 3.8 27B) với hiệu năng vượt trội nhằm đáp ứng phản hồi từ cộng đồng. Họ cũng chia sẻ chi tiết về khả năng hiểu video dài 100 giờ, sử dụng hệ thống bộ nhớ video phân cấp để mã hóa các phân đoạn thành các đồ thị văn bản có cấu trúc. Việc phát hành mô hình 27B mới lấp đầy khoảng trống được mong đợi trong hệ sinh thái AI mã nguồn mở, mang lại sự cân bằng giữa kích thước và hiệu năng. Ngoài ra, phương pháp bộ nhớ phân cấp để hiểu video ngữ cảnh dài có thể thiết lập một tiêu chuẩn mới cho việc xử lý các tập dữ liệu đa phương thức khổng lồ mà không cần phụ thuộc vào các hệ thống agent swarm phức tạp. Mô hình Qwen 3.8 sắp tới sở hữu tổng cộng 2,4 nghìn tỷ tham số với 95 tỷ tham số hoạt động, và kiến trúc của nó tương tự như Qwen 3.5 nhưng được mở rộng quy mô. Các nhà phát triển cũng lưu ý rằng họ đã sử dụng một lượng tài nguyên tính toán cực lớn cho học tăng cường (RL) trong giai đoạn hậu đào tạo (post-training), mặc dù họ sẽ chưa phát hành báo cáo kỹ thuật ngay lập tức để duy trì tiến độ ra mắt hàng tháng.

## KIẾN THỨC NỀN

Qwen là một chuỗi các mô hình ngôn ngữ lớn mã nguồn mở được phát triển bởi đội ngũ của Alibaba, nổi tiếng với hiệu năng cạnh tranh trên nhiều bài kiểm tra đánh giá (benchmark). Trong lĩnh vực AI, việc hiểu video thường đòi hỏi xử lý các khung hình tuần tự, điều mà các nhà nghiên cứu thường giải quyết bằng cách sử dụng các hệ thống agent swarm (nhiều tác nhân AI cộng tác) hoặc đồ thị ngữ nghĩa để thiết lập mối quan hệ giữa các thực thể và sự kiện theo thời gian.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#Qwen#LLMs#Open Source AI#Model Architecture

$ subscribe --daily

Nhà phát triển Qwen hé lộ mô hình 27B sắp ra mắt và kiến trúc hiểu video trong AMA | Daily News