Thiết lập cụm máy chủ AI cục bộ 16x ASUS GX10 (DGX Spark)
Một người dùng đã chia sẻ cấu hình phần cứng cho cụm máy chủ 16 GPU cục bộ sử dụng các hệ thống ASUS Ascent GX10 (DGX Spark) và bộ chuyển mạch MikroTik CRS804-4DDQ. Thiết lập này được thiết kế để chạy cục bộ các mô hình AI mã nguồn mở khổng lồ thuộc thế hệ mới nhất như DeepSeek v4 Pro và Kimi K3. Thiết lập tự chế (DIY) này chứng minh tính khả thi của việc chạy cục bộ các mô hình AI tiên tiến với hơn 2 nghìn tỷ tham số mà không cần phụ thuộc vào các nhà cung cấp API đám mây. Nó làm nổi bật xu hướng ngày càng tăng của hạ tầng AI cục bộ hiệu năng cao phục vụ cho các tác vụ nghiên cứu hoặc doanh nghiệp. Cụm máy chủ này liên kết 16 thiết bị ASUS GX10 (sử dụng GPU NVIDIA Blackwell với 128GB bộ nhớ thống nhất) thông qua bộ chuyển mạch MikroTik CRS804-4DDQ 400G với bốn cáp chia từ 400G sang 100G. Người dùng dự kiến sẽ chia cụm máy chủ để chạy hai mô hình riêng biệt trên mỗi nhóm 8 GPU, hoặc kết hợp lại để chạy các mô hình trên 2 nghìn tỷ tham số.
## KIẾN THỨC NỀN
ASUS Ascent GX10 là một siêu máy tính AI nhỏ gọn được trang bị GPU NVIDIA Blackwell và tích hợp kết nối mạng ConnectX-7 để xếp chồng nhiều hệ thống. MikroTik CRS804-4DDQ là bộ chuyển mạch 400G tốc độ cao được thiết kế để đáp ứng nhu cầu băng thông lớn của các cụm máy chủ AI và hệ thống lưu trữ. Việc xếp chồng các hệ thống này cho phép người dùng chạy các mô hình khổng lồ vượt quá dung lượng bộ nhớ của một máy đơn lẻ.