llama.cpp Bản phát hành b11488 Thêm Hỗ trợ cho Mô hình d1-omni-600M của Liquid AI
Phiên bản b11488 của llama.cpp chính thức bổ sung hỗ trợ cho kiến trúc mô hình ra quyết định d1-omni-600M của Liquid AI. Bản phát hành này cũng bao gồm các cập nhật máy chủ cho xử lý đầu vào âm thanh đa thức và sửa lỗi CUDA cho các phép toán conformer GLU sigmoid. Việc hỗ trợ mô hình ra quyết định d1-omni của Liquid AI cho phép thực hiện phân loại và ra quyết định nhanh chóng trên thiết bị cục bộ mà không cần sinh chuỗi token. Điều này mở rộng khả năng của llama.cpp vượt ra ngoài các mô hình ngôn ngữ tự hồi quy truyền thống để đáp ứng các tác vụ ra quyết định đa thức thời gian thực. Các cập nhật kỹ thuật bao gồm đổi tên kiểu ra quyết định nội bộ thành 'lfm2-d1-omni', thiết lập hình ảnh thành bí danh cho tệp tin trong API server, và giới hạn LFM2 không bộ nhớ trong cơ chế chú ý phi nhân quả (non-causal attention). Các bản dựng sẵn cũng được cập nhật trên các hệ điều hành được hỗ trợ như Linux, macOS, Windows và Android.
## KIẾN THỨC NỀN
llama.cpp là một thư viện mã nguồn mở phổ biến được thiết kế để chạy các mô hình ngôn ngữ cục bộ với hiệu năng cao bằng C/C++. Các mô hình ra quyết định d1 của Liquid AI là kiến trúc đa thức giúp đưa ra xác suất trực tiếp cho các lựa chọn cụ thể trong một lượt lan truyền tiến duy nhất thay vì sinh văn bản từng bước.