Qwen 3.8-Max lọt top 5 bảng xếp hạng LMSYS Chatbot Arena
Trong bản cập nhật tuần thứ 31 năm 2026 của bảng xếp hạng LMSYS Chatbot Arena, mô hình Qwen 3.8-Max mới ra mắt của Alibaba đã đứng vị trí thứ năm trong bảng xếp hạng tổng hợp. Trong khi đó, Claude Fable 5 của Anthropic tiếp tục giữ vững ngôi đầu bảng, và Kimi-K3-Max của Moonshot AI lần đầu lọt vào bảng xếp hạng ở vị trí thứ 13. Bảng xếp hạng mới nhất làm nổi bật sự tiến bộ nhanh chóng của các mô hình AI Trung Quốc, thu hẹp khoảng cách hiệu suất với các mô hình hàng đầu phương Tây như dòng Claude của Anthropic. Điều này cũng chứng minh tính cạnh tranh ngày càng tăng của các mô hình Trung Quốc có chi phí tối ưu trong cả năng lực tổng quát và tác vụ lập trình. Qwen 3.8-Max đạt điểm Elo là 1496, chỉ kém mô hình dẫn đầu Claude Fable 5 khoảng 13 điểm, và có mức giá rẻ hơn đáng kể ở mức $2/$6 mỗi triệu token so với mức $10/$50 của Claude. Ngoài ra, các mô hình Trung Quốc cũng thể hiện mạnh mẽ trên bảng xếp hạng lập trình, với Kimi-K3-Max và Qwen 3.8-Max lần lượt xếp thứ 8 và thứ 10.
## KIẾN THỨC NỀN
LMSYS Chatbot Arena là một nền tảng mở thu thập ý kiến cộng đồng để đánh giá các mô hình ngôn ngữ lớn (LLM) thông qua các trận đấu đối đầu ngẫu nhiên và ẩn danh. Nền tảng này sử dụng hệ thống xếp hạng Elo, một phương pháp ban đầu được phát triển để xếp hạng kỳ thủ cờ vua, nhằm đo lường và xếp hạng động hiệu suất tương đối của các mô hình AI dựa trên sở thích của người dùng.