Bảng xếp hạng Chatbot Arena của các mô hình GPT-5.6 Sol, Terra và Luna từ OpenAI
Các thứ hạng thử nghiệm đầu tiên của dòng mô hình GPT-5.6 từ OpenAI—bao gồm Sol, Terra và Luna—đã được chia sẻ trên bảng xếp hạng Chatbot Arena ở các danh mục Tài liệu (Document), Thị giác (Vision) và Văn bản (Text). Tuy nhiên, bài đăng thông báo chính thức đã bị cắt bớt phần cuối, khiến thứ hạng trong Text Arena của mô hình giá rẻ Luna chưa được hoàn thiện. Các thứ hạng này cung cấp đánh giá thực tế đầu tiên từ cộng đồng về dòng mô hình GPT-5.6 của OpenAI, giúp các nhà phát triển đánh giá hiệu năng của mô hình flagship Sol, mô hình cân bằng Terra và mô hình tốc độ cao Luna so với các đối thủ cạnh tranh. Điều này làm nổi bật sự đánh đổi về hiệu suất thực tế giữa các phân khúc mô hình mới nhất của OpenAI trên nhiều phương thức xử lý khác nhau. Trong Document Arena, mô hình tầm trung Terra đã bất ngờ vượt qua phiên bản flagship Sol khi xếp ở vị trí thứ 10 so với vị trí thứ 11 của Sol, trong khi Luna xếp thứ 18. Ở Vision Arena, Sol xếp thứ 14, Terra xếp thứ 25 và Luna xếp thứ 40.
## KIẾN THỨC NỀN
OpenAI đã phát hành dòng GPT-5.6 dưới dạng một bộ mô hình phân cấp tập trung vào hiệu quả sử dụng token, bao gồm Sol dành cho lập trình và suy luận phức tạp, Terra là tùy chọn trung gian tối ưu chi phí, và Luna dành cho các tác vụ nhanh với ngân sách thấp. LMSYS Chatbot Arena là một nền tảng đánh giá hiệu năng nổi tiếng, xếp hạng các mô hình AI dựa trên bình chọn ẩn danh từ cộng đồng sử dụng hệ thống tính điểm Elo.