~/AI HARDWARE/amd-and-cerebras-partner-on-hybrid-ai-inference-solution

AMD và Cerebras hợp tác phát triển giải pháp suy luận AI lai

AMD và Cerebras Systems đã công bố hợp tác phát triển giải pháp suy luận AI chung, tích hợp hệ thống quy mô tủ rack Helios của AMD với các động cơ quy mô phiến bán dẫn (wafer-scale engine) của Cerebras. Sau thông báo này, giá cổ phiếu của Cerebras đã tăng 11% trong phiên giao dịch. Sự hợp tác về mặt kiến trúc này giải quyết các giai đoạn khác nhau của quá trình suy luận LLM bằng cách phân chia khối lượng công việc, có khả năng thiết lập một tiêu chuẩn mới cho xử lý AI hiệu suất cao và độ trễ thấp. Nó cũng củng cố vị thế của cả hai công ty trên thị trường phần cứng AI đầy cạnh tranh trước hệ sinh thái đang thống trị của Nvidia. Trong quy trình làm việc chung, AMD Helios sẽ xử lý các câu lệnh (prompt) thông lượng cao và cửa sổ ngữ cảnh lớn, trong khi động cơ quy mô phiến bán dẫn của Cerebras sẽ quản lý việc tạo token vốn tiêu tốn nhiều băng thông bộ nhớ. Giải pháp này dự kiến sẽ ra mắt trên Cerebras Cloud vào nửa cuối năm 2026 trước khi được triển khai rộng rãi hơn.

## KIẾN THỨC NỀN

Quá trình suy luận LLM thường gồm hai giai đoạn: giai đoạn nạp trước (prefill - xử lý câu lệnh đầu vào) và giai đoạn giải mã (decoding - tạo từng token một). Helios của AMD là một hệ thống quy mô tủ rack kết hợp GPU Instinct, CPU EPYC và mạng Pensando để hoạt động như một bộ tăng tốc khổng lồ duy nhất, trong khi Wafer-Scale Engine của Cerebras là một bộ xử lý đơn chip khổng lồ được thiết kế để vượt qua các giới hạn đóng gói chip truyền thống nhằm truy cập bộ nhớ siêu nhanh.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#AI Hardware#AMD#Cerebras Systems#AI Inference#Semiconductors

$ subscribe --daily

AMD và Cerebras hợp tác phát triển giải pháp suy luận AI lai | Daily News