Cộng Đồng Thảo Luận Về Sự Thay Đổi Trong Chiến Lược Phát Hành Mô Hình Qwen Của Alibaba
Một người dùng trong cộng đồng LocalLLaMA đã chỉ ra sự thay đổi trong chiến lược phát hành mô hình Qwen của Alibaba Cloud. Thay vì ra mắt đồng loạt nhiều kích thước tham số khác nhau như các thế hệ trước, các đợt phát hành gần đây dường như cung cấp ít lựa chọn kích thước hơn trong mỗi lần ra mắt dù tần suất phát hành nhanh hơn. Cộng đồng AI mã nguồn mở phụ thuộc rất nhiều vào các kích thước mô hình đa dạng để phù hợp với giới hạn phần cứng khác nhau, chẳng hạn như chạy mô hình cục bộ trên GPU cá nhân. Sự thay đổi trong các tùy chọn kích thước ảnh hưởng đến các nhà phát triển đang tìm kiếm các mô hình tầm trung giúp cân bằng giữa hiệu năng và dung lượng VRAM. Bài đăng lưu ý rằng các thế hệ Qwen trước đây thường ra mắt với dải kích thước rộng từ các mô hình nhỏ 0.8B, 2B, 9B đến các kiến trúc rất lớn. Ngược lại, các chu kỳ phát hành gần đây ưu tiên cập nhật nhanh hơn nhưng chỉ đi kèm một hoặc hai tùy chọn kích thước cho mỗi lần ra mắt, tạo ra khoảng trống cho những người dùng mong muốn các kích thước tầm trung cụ thể như 35B.
## KIẾN THỨC NỀN
Qwen là một họ mô hình ngôn ngữ mã nguồn mở (open weights) được phát triển bởi Alibaba Cloud. Các nhà phát triển LLM mã nguồn mở thường phát hành mô hình với nhiều kích thước tham số khác nhau để người dùng có thể chạy chúng trên các phần cứng từ điện thoại di động cho đến hệ thống máy chủ đa GPU.