Qwen 3.8 27B vượt trội hơn Gemma 4 31B trên bảng xếp hạng Code Arena
Một so sánh trên bảng xếp hạng Code Arena cho thấy khoảng cách hiệu suất đáng kể giữa hai mô hình mã nguồn mở, trong đó phiên bản Qwen 3.8 27B của Alibaba xếp thứ 9 còn Gemma 4 31B của Google xếp thứ 80. Kết quả so sánh này chứng minh rằng số lượng tham số không phải là yếu tố duy nhất quyết định khả năng lập trình, khi mô hình Qwen nhỏ hơn vượt trội đáng kể so với mô hình Gemma lớn hơn. Điều này giúp các nhà phát triển lựa chọn các mô hình mã nguồn mở hiệu quả nhất cho các tác vụ hỗ trợ lập trình. So sánh này làm nổi bật hiệu quả của dòng mô hình Qwen trong các tác vụ tạo mã nguồn so với kích thước của nó. Tuy nhiên, các bài kiểm tra như Code Arena chỉ phản ánh các bộ thử nghiệm và sở thích của con người trong các tình huống cụ thể, vốn có thể khác biệt trong thực tế phát triển phần mềm.
## KIẾN THỨC NỀN
Code Arena là một bảng xếp hạng được sử dụng để đánh giá khả năng lập trình của các mô hình ngôn ngữ lớn (LLM) thông qua các so sánh đối đầu trực tiếp. Qwen là một dòng LLM mã nguồn mở được phát triển bởi Alibaba Cloud, trong khi Gemma là dòng mô hình mở được phát triển bởi Google.