~/AI ML/deepseek-updates-v4-flash-and-teases-upcoming-v4-pro-release

DeepSeek Cập Nhật V4-Flash Và Nhá Hàng Bản Ra Mắt V4-Pro Sắp Tới

DeepSeek đã cập nhật mô hình DeepSeek-V4-Flash, được cho là vượt trội hơn GLM 5.2 của Z.ai với mức chi phí không đổi so với phiên bản trước, đồng thời thông báo phiên bản chính thức của DeepSeek-V4-Pro sẽ sớm ra mắt. Khi DeepSeek tiếp tục thúc đẩy sự đổi mới trong không gian LLM mã nguồn mở, các bản cập nhật này cung cấp cho các nhà phát triển những mô hình hiệu quả cao và tiết kiệm chi phí cho các tác vụ lập trình và quy trình tự động hóa (agentic workflows). DeepSeek-V4-Flash là mô hình Mixture-of-Experts (MoE) với tổng cộng 284 tỷ tham số (13 tỷ tham số kích hoạt) và cửa sổ ngữ cảnh 1M, trong khi bản V4-Pro sắp tới là mô hình lớn hơn với 1,6 nghìn tỷ tham số (49 tỷ tham số kích hoạt).

## KIẾN THỨC NỀN

DeepSeek nổi tiếng với việc phát hành các mô hình Mixture-of-Experts (MoE) hiệu quả cao, cạnh tranh với các giải pháp độc quyền nhưng chỉ tốn một phần nhỏ chi phí huấn luyện và suy luận. Mixture-of-Experts là một kiến trúc chỉ kích hoạt một phần nhỏ các tham số cho mỗi token, cho phép các mô hình lớn chạy nhanh hơn và rẻ hơn.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#AI/ML#Large Language Models#DeepSeek#Model Release

$ subscribe --daily