Alibaba ra mắt Qwen3.8-Max-0902, chiếm ngôi đầu bảng xếp hạng lập trình frontend
Alibaba đã chính thức phát hành bản cập nhật mô hình Qwen3.8-Max-0902, tập trung tinh chỉnh hậu huấn luyện cho các tác vụ lập trình và tự động hóa công việc văn phòng. Mô hình mới tăng 22 điểm đạt 1691 điểm trên bảng xếp hạng CodeArena cho lập trình frontend, chính thức vươn lên vị trí dẫn đầu toàn cầu. Đợt phát hành này đánh dấu bước tiến lớn trong khả năng lập trình dạng agentic (tác tử), bao gồm suy luận đa bước, gọi công cụ và tạo ứng dụng đầu-cuối. Hơn nữa, mô hình giúp hạ thấp đáng kể rào cản chi phí để tiếp cận năng lực lập trình AI hàng đầu so với các đối thủ trên thị trường. Qwen3.8-Max-0902 có mức giá trung bình 5 USD cho mỗi triệu token, rẻ hơn nhiều so với 20 USD và 12 USD của các mô hình xếp thứ 2 và thứ 3 trên đường biên Pareto về hiệu quả chi phí của CodeArena. Phiên bản mới đã sẵn sàng truy cập qua API trên nền tảng Qwen AI và được tích hợp trực tiếp vào Qwen Work, Qoder cùng ứng dụng Qwen App.
## KIẾN THỨC NỀN
CodeArena là bộ kiểm thử tương tác được thiết kế để đánh giá các agent lập trình dựa trên LLM có khả năng lập kế hoạch, thực thi và sửa lỗi cho các tác vụ lập trình phức tạp. Trong đánh giá mô hình học máy, đường biên Pareto (Pareto frontier) giúp xác định các mô hình đạt mức tối ưu giữa hiệu suất và chi phí, giúp các nhà phát triển lựa chọn giải pháp kinh tế nhất.