Bài viết trên LocalLLaMA nhìn lại tranh cãi xung quanh mô hình Reflection 70B năm 2024
Một bài viết phổ biến trên r/LocalLLaMA đã nhắc lại một cách hài hước về tranh cãi xung quanh mô hình Reflection 70B vào tháng 9 năm 2024, nhắc nhở cộng đồng luôn cảnh giác trước các chiêu trò thổi phồng AI mã nguồn mở. Reflection 70B từng được quảng cáo rầm rộ là một mô hình mã nguồn mở đột phá vượt qua cả GPT-4o, nhưng quá trình kiểm chứng độc lập của cộng đồng nhanh chóng thất bại trong việc tái lập lại các kết quả này. Sự kiện nhìn lại này phục vụ như một lời nhắc nhở cho cộng đồng AI mã nguồn mở về việc luôn thận trọng trước các tuyên bố thổi phồng và điểm số benchmark chưa qua kiểm chứng. Điều này nhấn mạnh tầm quan trọng cốt lõi của việc xác minh độc lập từ bên thứ ba và đánh giá mô hình minh bạch trong nghiên cứu AI. Reflection 70B được quảng cáo là một mô hình dựa trên Llama 3.1 sử dụng kỹ thuật tự sửa lỗi mới để đánh bại các mô hình thương mại hàng đầu. Tuy nhiên, khi cộng đồng tải các trọng số công khai về, hiệu suất thực tế thấp hơn nhiều so với kỳ vọng, dấy lên nghi vấn rằng các điểm số đánh giá đã bị can thiệp hoặc gắn với các API mô hình khác.
## KIẾN THỨC NỀN
Vào tháng 9 năm 2024, nhà phát triển Matt Shumer công bố Reflection 70B và tuyên bố đây là mô hình LLM mã nguồn mở mạnh nhất thế giới vượt qua Claude 3.5 Sonnet và GPT-4o của OpenAI. Ngay sau khi phát hành, các nhóm đánh giá benchmark độc lập và người dùng thử nghiệm trên các nền tảng như Reddit đã không thể tái lập lại kết quả như công bố, biến đợt ra mắt này thành một vụ tranh cãi lớn.