Xôn xao tin đồn khi nhà phát triển Qwen khuyên không nên chờ đợi mô hình 35B-A3B
Một nhà phát triển Qwen được cho là đã khuyên cộng đồng không nên chờ đợi sự ra mắt của mô hình 35B-A3B, làm dấy lên những đồn đoán về lộ trình phát triển mô hình tiếp theo của Alibaba. Điều này khiến người dùng tự hỏi liệu một mô hình khác, chẳng hạn như phiên bản 122B lớn hơn, có đang được chuẩn bị để thay thế hay không. Mô hình 35B-A3B rất được mong đợi nhờ kiến trúc Mixture-of-Experts (MoE) giúp mang lại hiệu năng cao với số lượng tham số kích hoạt thấp, lý tưởng cho việc chạy cục bộ. Nếu mô hình này bị trì hoãn hoặc hủy bỏ, nó có thể ảnh hưởng đến cách các nhà phát triển lựa chọn phần cứng và triển khai ứng dụng AI. Mô hình Qwen 3.6-35B-A3B sở hữu tổng cộng 35 tỷ tham số nhưng chỉ kích hoạt 3 tỷ tham số cho mỗi token, giúp tăng tốc độ xử lý trên các GPU phổ thông. Các suy đoán cho rằng bình luận của nhà phát triển có thể ám chỉ việc phát hành một mô hình lớn hơn hoặc chuyển hướng sang các phiên bản mới hơn như Qwen 3.8.
## KIẾN THỨC NỀN
Qwen là một dòng mô hình ngôn ngữ lớn mã nguồn mở được phát triển bởi Alibaba Cloud. Ký hiệu "35B-A3B" đề cập đến kiến trúc Mixture of Experts (MoE), trong đó mô hình có tổng cộng 35 tỷ tham số nhưng chỉ kích hoạt 3 tỷ tham số cho mỗi token trong quá trình suy luận, giúp giảm đáng kể tài nguyên tính toán cần thiết.