llama.cpp phát hành bản dựng b11465 cập nhật kiểm thử Recurrent Rollback
llama.cpp đã phát hành bản dựng tự động b11465 chứa cập nhật nhỏ nhằm giữ lại các mỏ neo ngữ cảnh (anchor) trong quá trình kiểm thử lùi trạng thái lặp (recurrent rollback #29923). Bản phát hành cung cấp các gói tệp nhị phân cập nhật trên nhiều nền tảng như Linux, macOS, Windows, Android và iOS. Là một bản phát hành tự động định kỳ, cập nhật này giúp duy trì chất lượng tích hợp và sự ổn định cho các bài kiểm thử cơ chế lùi trạng thái của mô hình. Điều này đảm bảo độ tin cậy liên tục cho các nhà phát triển sử dụng llama.cpp để chạy các mô hình kiến trúc kết hợp hiện đại. Thay đổi này tập trung điều chỉnh bộ kiểm thử để giữ lại mỏ neo ngữ cảnh khi thử nghiệm quy trình lùi trạng thái lặp theo pull request #29923. Các tệp nhị phân biên dịch sẵn được tạo cho nhiều backend tính toán bao gồm CUDA 12/13, Vulkan, ROCm, SYCL, OpenVINO và kiến trúc Snapdragon.
## KIẾN THỨC NỀN
llama.cpp là một công cụ suy luận C/C++ mã nguồn mở phổ biến được thiết kế để chạy các mô hình ngôn ngữ lớn (LLM) cục bộ trên nhiều loại thiết bị phần cứng. Trong các kiến trúc LLM lặp kết hợp, cơ chế lùi trạng thái (rollback) khi giải mã suy đoán cho phép đường ống suy luận quay trở lại trạng thái ngữ cảnh mỏ neo trước đó nếu chuỗi token tạo ra bị từ chối.