FuriosaAI Công bố Thông số Accelerator AI 2nm Thế hệ Mới với 576GB HBM4
Công ty khởi nghiệp bán dẫn AI Hàn Quốc FuriosaAI đã công bố thông số kỹ thuật chi tiết cho bộ tăng tốc AI thế hệ thứ ba hợp tác phát triển cùng Broadcom. Chip được chế tạo trên tiến trình 2nm, tích hợp hai die tính toán đạt giới hạn reticle, 576GB bộ nhớ HBM4 cho băng thông 48 TB/s và sức mạnh tính toán đạt 32 PFLOPS. Cung cấp sức mạnh tính toán và băng thông bộ nhớ gấp 32 lần so với thế hệ trước, bộ tăng tốc này cho thấy các công ty khởi nghiệp đang tận dụng thiết kế chiplet và bộ nhớ HBM4 để giải quyết các tác vụ suy luận mô hình lớn. Sự kiện này cũng khẳng định vai trò ngày càng tăng của Broadcom trong việc đồng thiết kế chip tùy chỉnh và mạng kết nối AI cấp độ tủ rack. Kiến trúc chip kết hợp hai die tính toán kích thước giới hạn reticle và một die I/O độc lập cùng 12 chồng bộ nhớ HBM4(E) 48GB. Thiết bị này cũng hỗ trợ chuẩn PCIe Gen7 và sử dụng kiến trúc mạng Scale-Up Ethernet (SUE) với kết nối toàn phần ở cấp độ tủ rack.
## KIẾN THỨC NỀN
Khi kích thước mô hình AI vượt quá khả năng xử lý của một die silicon đơn khối, các nhà sản xuất chip phải dựa vào thiết kế nhiều die (chiplet) do mỗi die đơn lẻ bị giới hạn bởi diện tích chiếu phơi của thiết bị quang khắc (gọi là giới hạn reticle). Bộ nhớ băng thông cao (HBM4) và kiến trúc mạng mở rộng như Scale-Up Ethernet (SUE) của Broadcom đóng vai trò cốt lõi giúp loại bỏ các điểm nghẽn về bộ nhớ và kết nối trong phần cứng AI mật độ cao.