Siêu nút Zhenwu M890 chạy mô hình Qwen3.8 với 2,4 nghìn tỷ tham số
Alibaba Cloud thông báo siêu nút Lingjun Zhenwu M890 đã thích ứng thành công với mô hình Qwen3.8 có quy mô 2,4 nghìn tỷ tham số, trở thành siêu nút đầu tiên tại Trung Quốc vận hành mô hình vượt mốc 2 nghìn tỷ tham số. Mô hình này hiện đã được đưa lên nền tảng Model Studio (Bailian) của Alibaba Cloud để cung cấp dịch vụ suy luận. Thành tựu này đánh dấu một cột mốc quan trọng trong kỹ thuật hệ thống AI quy mô lớn, chứng minh khả năng vận hành các mô hình hỗn hợp chuyên gia (MoE) khổng lồ trên phần cứng nội địa của Trung Quốc. Bằng cách tối ưu hóa toàn bộ liên kết từ chip đến đám mây, giải pháp này giúp giảm chi phí suy luận và tăng hiệu suất lên tới 1,5 lần trong các kịch bản Agentic. Zhenwu M890 là chip AI thế hệ mới do T-Head phát triển, hỗ trợ gốc các độ chính xác dữ liệu từ FP32 đến FP4. Sử dụng chip kết nối ICN Switch 1.0, một phiên bản duy nhất có thể kết nối 64 chip Zhenwu M890 với băng thông 800GB/s, cung cấp 9TB bộ nhớ đồ họa để hỗ trợ song song hóa chuyên gia (expert parallelism).
## KIẾN THỨC NỀN
Hỗn hợp chuyên gia (MoE) là một kiến trúc AI chỉ kích hoạt một phần nhỏ của mạng lưới (các chuyên gia) cho mỗi đầu vào, cho phép các mô hình mở rộng lên tới hàng nghìn tỷ tham số. Song song hóa chuyên gia (expert parallelism) là kỹ thuật được sử dụng để phân phối các chuyên gia này trên nhiều GPU nhằm vượt qua giới hạn bộ nhớ. Các cụm AI thông thường thường gặp khó khăn với băng thông truyền thông cao cần thiết để giữ cho các tham số phân tán này được đồng bộ hóa.