llama.cpp phát hành phiên bản b10929 bổ sung bảng cấu hình HIP cho kiến trúc AMD GCN
Bản phát hành b10929 của llama.cpp đã được ra mắt, bổ sung bảng cấu hình HIP dành riêng cho kiến trúc GPU Graphics Core Next (GCN) của AMD trong backend ggml-cuda. Thay đổi này được tích hợp thông qua pull request #27841 đi kèm các bản biên dịch sẵn cho nhiều nền tảng. Cập nhật cấu hình này giúp cải thiện việc tối ưu hóa kernel GPU và khả năng tương thích cho người dùng chạy suy luận LLM trên các card đồ họa AMD thuộc thế hệ cũ hoặc cụ thể. Điều này giúp mở rộng khả năng hỗ trợ phần cứng mã nguồn mở trong hệ sinh thái llama.cpp. Bản phát hành tập trung vào PR #27841, bổ sung các bảng cấu hình HIP chuyên biệt cho vi kiến trúc AMD GCN trong mã nguồn ggml-cuda. Các tệp thực thi biên dịch sẵn đã được phát hành cho Windows, Linux, macOS, iOS và Android với nhiều backend như CPU, CUDA, Vulkan, ROCm, OpenVINO và SYCL.
## KIẾN THỨC NỀN
llama.cpp là một khung mã nguồn mở phổ biến bằng C/C++ giúp chạy các mô hình ngôn ngữ lớn cục bộ trên nhiều phần cứng khác nhau. AMD HIP là giao diện lập trình C++ cho phép nhà phát triển thực thi mã GPU trên các kiến trúc đồ họa của AMD như GCN (Graphics Core Next).