llama.cpp Phát Hành Phiên Bản b10865 Hoàn Tác Commit Property Integrated Cho Bản Dựng HIP
llama.cpp đã phát hành bản dựng tự động b10865, hoàn tác lại pull request #24233 vốn trước đây khôi phục việc kiểm tra thuộc tính CUDA integrated cho các bản dựng HIP trong ggml-cuda. Bản phát hành định kỳ này duy trì tính ổn định cho các bản dựng trên nền tảng GPU của AMD bằng cách hoàn tác một trình xử lý thuộc tính gây ra sự cố. Nó phản ánh chu kỳ triển khai liên tục nhanh chóng của dự án llama.cpp. Bản cập nhật cụ thể hoàn tác commit c7d8722922a2599dc4d77f8808d8e6c2fde5e7a2 thông qua PR #28604 mà không bổ sung tính năng mới nào. Các tệp thực thi biên dịch sẵn tiếp tục được cung cấp trên macOS, Linux, Windows, Android và nhiều backend bao gồm ROCm, Vulkan và CUDA.
## KIẾN THỨC NỀN
llama.cpp là một framework mã nguồn mở phổ biến được dùng để chạy các mô hình ngôn ngữ lớn (LLM) một cách hiệu quả trên phần cứng thương mại. HIP (Heterogeneous-Computing Interface for Portability) của AMD là một API runtime C++ cho phép các nhà phát triển biên dịch mã CUDA để chạy trên GPU AMD.