~/DEEPSEEK/deepseek-announces-v4-1-flash-model-outperforming-v4-pro

DeepSeek công bố mô hình V4.1 Flash vượt trội hoàn toàn V4 Pro

DeepSeek đã công bố kế hoạch phát hành mô hình V4.1 Flash với kiến trúc hoàn toàn mới và khả năng hỗ trợ đa thức (multimodal) nguyên bản. Các bài kiểm tra thử nghiệm cho thấy V4.1 Flash vượt trội so với mô hình V4 Pro tiền nhiệm trên mọi chỉ số, bao gồm tốc độ, chi phí và hiệu năng tổng thể. Việc một mô hình thuộc phân cấp 'Flash' nhẹ hơn vượt qua mô hình cấp cao 'Pro' cho thấy sự tiến bộ nhanh chóng về hiệu suất kiến trúc trong các mô hình ngôn ngữ lớn, giúp giảm chi phí vận hành AI cho các doanh nghiệp. Bằng cách tự động chuyển hướng các yêu cầu V4 Pro sang V4.1 Flash với mức giá rẻ hơn, DeepSeek lập tức giúp các nhà phát triển tối ưu hóa chi phí API. Theo biểu giá mới, giá cho lượt truy cập bộ nhớ tạm (cache hit) đầu vào vào giờ thấp điểm là 0,02 nhân dân tệ/triệu token, cache miss là 1 nhân dân tệ, và đầu ra là 4 nhân dân tệ (mức giá giờ cao điểm sẽ gấp đôi). Cho đến khi V4.1 Pro chính thức ra mắt, tất cả lưu lượng API dành cho V4 Pro sẽ được tự động chuyển hướng sang V4.1 Flash và tính phí theo đơn giá thấp hơn của bản Flash.

## KIẾN THỨC NỀN

Các mô hình đa thức (multimodal) nguyên bản tích hợp văn bản, hình ảnh và các loại dữ liệu khác vào một kiến trúc nền tảng thống nhất ngay từ quá trình tiền huấn luyện, giúp suy luận đa phương thức hiệu quả hơn so với phương pháp ghép nối các bộ mã hóa hình ảnh riêng lẻ vào mô hình ngôn ngữ. Ngoài ra, các nhà cung cấp LLM hiện đại sử dụng kỹ thuật prompt caching để lưu trữ các biểu diễn bộ nhớ tạm của những đoạn nhắc lặp lại, giúp giảm đáng kể tài nguyên tính toán và chi phí sử dụng.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#DeepSeek#LLM#AI Models#Multimodal AI#Artificial Intelligence

$ subscribe --daily

DeepSeek công bố mô hình V4.1 Flash vượt trội hoàn toàn V4 Pro | Daily News