Phiên bản llama.cpp b10793 khắc phục lỗi biên dịch lại toàn bộ mã nguồn
Phiên bản llama.cpp b10793 giải quyết lỗi hệ thống biên dịch (PR #28278) vốn khiến toàn bộ mã nguồn bị biên dịch lại sau mỗi commit mới. Bản phát hành này khôi phục khả năng biên dịch cuốn chiếu (incremental build) và cung cấp các tệp thực thi cập nhật cho nhiều nền tảng như Windows, macOS, Linux và Android. Việc sửa lỗi biên dịch lại toàn bộ mã nguồn giúp tối ưu hóa đáng kể quy trình phát triển và rút ngắn thời gian chạy tích hợp liên tục (CI). Chu kỳ biên dịch nhanh hơn cho phép các nhà phát triển thử nghiệm và đóng góp hiệu quả hơn cho khung thực thi LLM bằng C/C++ phổ biến này. Bản sửa lỗi giải quyết vấn đề trong PR #28278, vốn vô tình làm mất hiệu lực các mục tiêu biên dịch trong quá trình thực thi. Các bản đóng gói của phát hành này hỗ trợ nhiều backend phần cứng như CPU, CUDA 12/13, Vulkan, ROCm 10.0, SYCL và OpenVINO.
## KIẾN THỨC NỀN
llama.cpp là một thư viện C/C++ mã nguồn mở phổ biến được thiết kế để thực thi các mô hình ngôn ngữ lớn (LLM) cục bộ và hiệu quả trên nhiều cấu hình phần cứng. Được phát triển song song với thư viện ma trận GGML, nó đóng vai trò là nền tảng cho các ứng dụng chạy AI cục bộ như Ollama và LM Studio.