Mô hình Saluki 27B đạt 96% hiệu suất của Qwen 3.8 dù kích thước chỉ bằng 1/7
Một bài viết trên cộng đồng Reddit r/LocalLLaMA đã thu hút sự chú ý về Saluki 27B, một mô hình ngôn ngữ trọng số mở được tuyên bố đạt 96% hiệu suất của Qwen 3.8 dù kích thước chỉ bằng khoảng 1/7. Tác giả bài viết đã yêu cầu cộng đồng chia sẻ phản hồi thực tế và kiểm chứng hiệu suất thực sự của mô hình này. Việc đạt hiệu suất tương đương các mô hình hàng đầu ở quy mô 27 tỷ tham số cho phép chạy các LLM nâng cao trên phần cứng cá nhân thay vì các cụm máy chủ doanh nghiệp. Nếu được kiểm chứng, sự giảm thiểu đáng kể về dung lượng tính toán này sẽ giúp giảm chi phí triển khai cho các nhà phát triển độc lập và cộng đồng đam mê AI cục bộ. Dù Saluki 27B tuyên bố đạt hiệu suất cao so với mô hình hàng đầu Qwen 3.8 của Alibaba Cloud, bài đăng trên Reddit chưa cung cấp phương pháp đánh giá chi tiết. Người dùng hiện đang tìm kiếm các bài kiểm tra độc lập để xác minh liệu hiệu suất của mô hình có ổn định trên các bài đánh giá thực tế về lập trình, suy luận và ngữ cảnh dài hay không.
## KIẾN THỨC NỀN
Qwen là dòng mô hình ngôn ngữ lớn trọng số mở nổi tiếng do Alibaba Cloud phát triển, với các phiên bản lớn liên tục vượt qua các mốc đánh giá về suy luận và đa ngôn ngữ. Cộng đồng r/LocalLLaMA tập trung vào việc vận hành LLM cục bộ, khiến các mô hình quy mô trung bình nhưng có hiệu suất cao trở thành tâm điểm tìm kiếm.