~/AI HARDWARE/openai-researcher-praises-amd-and-cerebras-joint-ai-inference-solution

Nhà nghiên cứu OpenAI ca ngợi giải pháp suy luận AI chung của AMD và Cerebras

Một nhà nghiên cứu của OpenAI đã ca ngợi giải pháp suy luận AI chung mới từ AMD và Cerebras, kết hợp hệ thống tủ rack AMD Helios với Động cơ quy mô tấm bán dẫn (WSE) của Cerebras. Kiến trúc hợp tác này được thiết kế để mang lại độ trễ cực thấp và hiệu suất cao cho các tác vụ AI đòi hỏi khắt khe. Bằng cách chia nhỏ khối lượng công việc suy luận—sử dụng AMD Helios cho giai đoạn prefill thông lượng cao và Cerebras WSE để tạo token nhanh—giải pháp này tuyên bố tăng hiệu suất trên mỗi watt lên gấp 5 lần. Sự hợp tác này mang lại một giải pháp thay thế đầy cạnh tranh cho phần cứng của Nvidia trong thị trường suy luận AI đang phát triển nhanh chóng. Thiết kế dạng tủ rack AMD Helios tích hợp 72 GPU AMD Instinct MI455X, CPU EPYC và card mạng Pensando Vulcano AI NIC. Trong khi đó, Cerebras WSE hoạt động như một bộ xử lý đơn chip khổng lồ được tối ưu hóa cho việc giải mã token vốn đòi hỏi băng thông bộ nhớ lớn, giúp các tác vụ trước đây mất vài phút giờ đây hoàn thành gần như ngay lập tức.

## KIẾN THỨC NỀN

Quá trình suy luận AI gồm hai giai đoạn chính: giai đoạn prefill (nạp tiền đề) xử lý câu lệnh đầu vào và yêu cầu thông lượng tính toán cao, và giai đoạn giải mã (decoding) tạo ra các token một cách tuần tự và bị giới hạn nhiều bởi băng thông bộ nhớ. Cerebras chuyên về Wafer-Scale Engine, vốn là các bộ xử lý đơn chip khổng lồ giúp loại bỏ các nút thắt cổ chai truyền thông giữa các chip truyền thống, trong khi Helios của AMD là nền tảng AI dạng tủ rack mở được thiết kế cho các trung tâm dữ liệu quy mô lớn.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#AI Hardware#AI Inference#AMD#Cerebras#Semiconductors

$ subscribe --daily

Nhà nghiên cứu OpenAI ca ngợi giải pháp suy luận AI chung của AMD và Cerebras | Daily News