~/ARTIFICIAL I/deepseek-v4-1-flash-narrows-us-china-top-ai-model-gap-to

DeepSeek V4.1 Flash Thu Hẹp Khoảng Cách AI Đỉnh Cao Mỹ - Trung Xuống 3% Trên LiveBench

Theo báo cáo từ Bloomberg Intelligence, khoảng cách hiệu suất giữa các mô hình AI hàng đầu của Trung Quốc và Mỹ trên bảng xếp hạng LiveBench đã thu hẹp chỉ còn 3%. Sự thay đổi này phần lớn nhờ việc DeepSeek phát hành mô hình V4.1 Flash với 81,1 điểm trên LiveBench so với điểm số dẫn đầu 83,4 của Anthropic. Khoảng cách thu hẹp cho thấy các phòng thí nghiệm AI Trung Quốc đang nhanh chóng cải thiện năng lực nhờ chuyên môn kỹ thuật và tối ưu hóa cho phần cứng trong nước bất chấp các hạn chế xuất khẩu của Mỹ. Sự hội tụ liên tục này đặt ra thách thức đối với việc duy trì vị thế thống trị công nghệ AI lâu dài của Mỹ. DeepSeek V4.1 Flash xếp thứ 6 toàn cầu trên LiveBench, trở thành mô hình Trung Quốc có thứ hạng cao nhất kể từ đột phá của mô hình suy luận R1. Tuy nhiên, dù khoảng cách ở nhóm dẫn đầu được thu hẹp, các mô hình Trung Quốc vẫn chỉ chiếm 3 trong số 15 vị trí hàng đầu trên bảng xếp hạng LiveBench.

## KIẾN THỨC NỀN

LiveBench là một bộ kiểm thử (benchmark) dành cho LLM được thiết kế nhằm ngăn chặn hiện tượng nhiễm dữ liệu kiểm thử (contamination) bằng cách đánh giá mô hình AI trên các tác vụ khách quan, phức tạp và liên tục được cập nhật. Các bộ kiểm thử là công cụ quan trọng trong ngành AI giúp đo lường và so sánh năng lực mô hình một cách khách quan trên các mảng suy luận, toán học và lập trình. DeepSeek là một công ty khởi nghiệp AI của Trung Quốc từng thu hút sự chú ý toàn cầu nhờ phát triển các mô hình hiệu năng cao với chi phí huấn luyện thấp.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#Artificial Intelligence#DeepSeek#LLM Benchmarks#AI Industry

$ subscribe --daily

DeepSeek V4.1 Flash Thu Hẹp Khoảng Cách AI Đỉnh Cao Mỹ - Trung Xuống 3% Trên LiveBench | Daily News