~/GPGPU/loongson-releases-first-software-version-for-self-developed-gpgpu-acceleration-platform

Loongson phát hành phiên bản phần mềm đầu tiên cho nền tảng tăng tốc GPGPU tự phát triển

Loongson Zhongke đã chính thức phát hành phiên bản phần mềm đầu tiên cho Nền tảng Tính toán Tăng tốc Loongson, hỗ trợ kiến trúc GPGPU LG200 tự phát triển trên các dòng chip như 2K3000 và 9A1000. Nền tảng này mang lại khả năng tương thích với API CUDA và OpenCL 3.0 cùng với LacInfer, một động cơ suy luận AI chuyên dụng. Việc cung cấp một chồng phần mềm hoàn chỉnh từ trình điều khiển cấp thấp đến triển khai AI giúp hệ sinh thái phần cứng nội địa giảm chi phí chuyển đổi cho các ứng dụng CUDA và PyTorch hiện có. Đây là một bước tiến quan trọng hướng tới việc tự chủ chip tính toán và thúc đẩy ứng dụng trong thị giác máy tính cũng như trí tuệ nhân tạo thể hiện (embodied AI). Bản phát hành bao gồm các thư viện toán tử BLAS và DNN được tối ưu hóa ở cấp hợp ngữ, một trình biên dịch GPGPU chuyên dụng và khả năng tích hợp với ONNX Runtime dưới dạng backend thực thi để chạy các mô hình đã huấn luyện mà không cần viết lại mã. Nền tảng cũng đi kèm các công cụ gỡ lỗi cấp phần cứng giúp phát hiện lỗi truy cập bộ nhớ, bất thường tính toán và tắc nghẽn đồng bộ (deadlock).

## KIẾN THỨC NỀN

GPGPU (Tính toán tổng quát trên đơn vị xử lý đồ họa) cho phép các bộ xử lý đồ họa thực hiện các khối lượng công việc tính toán hiệu năng cao như huấn luyện và suy luận mô hình AI. Mô hình lập trình CUDA độc quyền của NVIDIA đang thống trị lĩnh vực tính toán AI, do đó khả năng tương thích CUDA là yếu tố then chốt giúp các nền tảng phần cứng khác dễ dàng tiếp cận hệ sinh thái phần mềm AI phổ biến.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#GPGPU#Loongson#CUDA Compatibility#AI Inference#Hardware Acceleration

$ subscribe --daily

Loongson phát hành phiên bản phần mềm đầu tiên cho nền tảng tăng tốc GPGPU tự phát triển | Daily News