Công Bố Dòng Mô Hình Qwen 3 Với Qwen3.8-Max Và Trọng Số Mở
Dòng mô hình Qwen 3 sắp tới, bao gồm Qwen3.8-Max với 2,4T tham số và Qwen3.8-27B, đã được công bố với các trọng số mở sẽ được phát hành vào tuần tới. Qwen3.8-Max đạt hiệu suất ngang ngửa với Kimi K3 và DeepSeek V4 Flash, đồng thời thể hiện khả năng vượt trội trong các tác vụ lập trình và phần mềm. Việc phát hành trọng số mở cho các mô hình khổng lồ như Qwen3.8-Max (2.4T) cung cấp cho cộng đồng AI mã nguồn mở những khả năng tiên tiến nhất, cạnh tranh trực tiếp với các mô hình thương mại và mô hình mở hàng đầu. Điều này làm gia tăng sự cạnh tranh trong bối cảnh LLM, đặc biệt là đối với các ứng dụng lập trình và kỹ nghệ phần mềm phức tạp. Giá API cho Qwen3.8-Max được đặt ở mức 2,0 USD cho mỗi triệu token đầu vào, 6,0 USD cho mỗi triệu token đầu ra và 0,25 USD cho mỗi triệu token đối với tính năng lưu nhớ đệm ẩn (implicit caching). Dòng mô hình này bao gồm cả phiên bản Max khổng lồ với 2,4T tham số và phiên bản 27B tham số nhỏ hơn.
## KIẾN THỨC NỀN
Qwen là một dòng mô hình ngôn ngữ lớn nổi bật do Alibaba phát triển, được biết đến với hiệu suất thử nghiệm mạnh mẽ. Kimi K3 là mô hình lập luận đa phương thức mã nguồn mở với 2,8T tham số từ Moonshot AI, trong khi lưu nhớ đệm ẩn (implicit caching) là kỹ thuật tự động tối ưu hóa hiệu suất và chi phí bằng cách tái sử dụng các tiền tố ngữ cảnh đã được xử lý trước đó.