llama.cpp Phát Hành Bản b11438 Sửa Lỗi Khởi Tạo Backend Động Trong Bộ Test
llama.cpp đã phát hành bản dựng tự động b11438, cập nhật bộ kiểm thử test-llama-archs để khởi tạo rõ ràng các backend trước khi tạo mô hình khi bật tính năng nạp backend động (GGML_BACKEND_DL=ON). Điều này bảo đảm các backend dạng thư viện chia sẻ động được nạp chính xác trước khi tạo mô hình trong quá trình kiểm thử kiến trúc tự động. Tuy chỉ là bản cập nhật bảo trì nhỏ, sửa lỗi này giúp ngăn ngừa thất bại trong bộ kiểm thử khi biên dịch llama.cpp với hỗ trợ backend nạp động dạng mô-đun. Điều này đảm bảo quy trình tích hợp liên tục (CI) hoạt động ổn định cho các nhà phát triển khi kiểm thử các kiến trúc LLM khác nhau trên nhiều nền tảng phần cứng. Sửa lỗi này xử lý riêng cho PR #30034, yêu cầu các backend phải được nạp một cách rõ ràng trước khi tạo các bản thể mô hình dưới cấu hình biên dịch GGML_BACKEND_DL=ON. Bản phát hành tiếp tục cung cấp các tệp thực thi biên dịch sẵn đa nền tảng bao gồm các mục tiêu CPU, CUDA, Vulkan, ROCm, OpenVINO, SYCL và Snapdragon.
## KIẾN THỨC NỀN
llama.cpp là một khung mã nguồn mở được sử dụng phổ biến để chạy các mô hình ngôn ngữ lớn một cách hiệu quả trên phần cứng người dùng. Thư viện tensor bên dưới là GGML hỗ trợ nạp backend động (GGML_BACKEND_DL), cho phép các công cụ thực thi backend như CUDA, Vulkan hoặc trình điều khiển CPU được nạp từ các thư viện chia sẻ tại thời điểm chạy thay vì mã hóa cứng trong quá trình biên dịch.