llama.cpp Phát Hành Bản Dựng b10948 Sửa Lỗi Kiểm Thử WebGPU
llama.cpp đã phát hành bản dựng b10948, tích hợp PR #28855 nhằm loại bỏ kiến trúc mô hình HY_V4 khỏi các bài kiểm thử WebGPU. Bản phát hành cũng cung cấp các tệp thực thi biên dịch sẵn được cập nhật cho nhiều nền tảng và backend xử lý khác nhau. Việc loại bỏ các kiến trúc không phù hợp như HY_V4 khỏi bài kiểm thử WebGPU giúp ngăn ngừa lỗi sai trong quy trình tích hợp liên tục (CI) tự động. Điều này đảm bảo các nhà phát triển sử dụng llama.cpp nhận được các bản dựng ổn định trên các backend như CUDA, Vulkan và SYCL. Pull Request #28855 do Stanisław Szymczyk đóng góp đã chỉnh sửa `test-llama-archs` để bỏ qua HY_V4 trong quá trình kiểm thử WebGPU. Các tệp thực thi biên dịch sẵn đi kèm hỗ trợ CUDA 12/13, Vulkan, SYCL, ROCm và OpenVINO trên Windows, Linux, macOS, iOS và Android.
## KIẾN THỨC NỀN
llama.cpp là một thư viện C/C++ mã nguồn mở phổ biến được thiết kế để suy luận LLM cục bộ hiệu quả trên nhiều phần cứng như CUDA, Vulkan, WebGPU và SYCL. Để duy trì khả năng hỗ trợ đa nền tảng, dự án liên tục phát hành các bản dựng tự động mỗi khi có cập nhật hoặc sửa lỗi được hợp nhất vào nhánh chính.