~/LLAMA CPP/llama-cpp-release-b10144-fixes-stream-routes-for-slashed-model-names

llama.cpp b10144 sửa lỗi đường dẫn luồng cho tên mô hình chứa dấu gạch chéo

Bản phát hành llama.cpp b10144 tái cấu trúc các đường dẫn luồng (stream routes) có thể khôi phục để sử dụng chuỗi truy vấn (`conv_id`) thay vì tham số đường dẫn, giải quyết lỗi khiến các tên mô hình chứa dấu gạch chéo bị lỗi. Bản cập nhật này cũng cải thiện khả năng khôi phục phiên hoạt động và hiển thị tiến trình tải mô hình trên giao diện người dùng (UI). Bản phát hành này đảm bảo xử lý ổn định các tên mô hình từ các kho lưu trữ vốn thường chứa dấu gạch chéo, ngăn ngừa lỗi máy chủ hoặc không khớp phiên khi triển khai LLM cục bộ. Nó cũng nâng cao trải nghiệm người dùng bằng cách xử lý mượt mà việc tải lại trang và hủy yêu cầu trong giai đoạn tải mô hình nặng. Bản cập nhật chuyển ID cuộc hội thoại sang chuỗi truy vấn `conv_id` nơi các dấu gạch chéo không bị ảnh hưởng bởi mã hóa URL, đồng thời giới thiệu phản hồi trạng thái 503 để cho phép máy khách thăm dò và kết nối lại sau khi tải lại trang. Ngoài ra, các yêu cầu đang chờ xử lý hiện được đăng ký trước khi quá trình tự động tải chặn (blocking autoload wait) diễn ra để cho phép hủy bỏ đúng cách.

## KIẾN THỨC NỀN

llama.cpp là một thư viện C/C++ mã nguồn mở được sử dụng rộng rãi, thiết kế để suy luận hiệu quả các mô hình ngôn ngữ lớn (LLM) như Llama trên thiết bị cục bộ. Thư viện này tích hợp sẵn một máy chủ web và giao diện người dùng (UI), cho phép các nhà phát triển chạy và tương tác với các mô hình cục bộ, thường đóng vai trò là chương trình nền (backend) cho các công cụ LLM phổ biến khác.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#llama.cpp#LLM#AI Infrastructure#Software Release

$ subscribe --daily