~/LLMS/liquid-ai-releases-lfm2-5-2-6b-model-optimized-for-mobile-and

Liquid AI Ra Mắt Mô Hình LFM2.5-2.6B Tối Ưu Hóa Cho Thiết Bị Di Động Và Edge

Liquid AI đã phát hành LFM2.5-2.6B, một mô hình có kích thước 2,69 tỷ tham số với cửa sổ ngữ cảnh lên tới 128K và hỗ trợ gọi công cụ (tool-calling) gốc. Mô hình này được tối ưu hóa để chạy cục bộ và đã tương thích với llama.cpp thông qua định dạng GGUF. Bản phát hành này chứng minh rằng các mô hình tác nhân (agentic) hiệu năng cao với cửa sổ ngữ cảnh lớn có thể chạy mượt mà trên phần cứng phổ thông, đạt tốc độ lên tới 30 token/giây trên điện thoại di động. Điều này cho phép triển khai cục bộ các tác nhân AI với chi phí thấp cho các tác vụ như trích xuất dữ liệu và thao tác tệp mà không cần phụ thuộc vào API đám mây. Mặc dù mô hình này vượt trội hơn các mô hình lớn hơn như Qwen3.5-9B trên các bài kiểm tra như ToolSandbox và IFBench, nó vẫn còn yếu trong các tác vụ lập trình và đòi hỏi nhiều kiến thức. Ngoài ra, việc chạy cửa sổ ngữ cảnh 128K trên thiết bị di động có thể gặp hạn chế về bộ nhớ do chi phí lưu trữ bộ đệm KV cache.

## KIẾN THỨC NỀN

Liquid Foundation Models (LFMs) là một nhóm các mô hình AI tạo sinh được thiết kế để có tính thích ứng và hiệu quả cao, sử dụng kiến trúc động có thể thay đổi đồ thị tính toán trong quá trình suy luận. Định dạng GGUF là một định dạng tệp nhị phân được thiết kế để tải và chạy nhanh các mô hình lượng tử hóa trên phần cứng phổ thông, chủ yếu được sử dụng với llama.cpp, một công cụ suy luận C/C++ mã nguồn mở.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#LLMs#Edge AI#Liquid AI#Local LLMs#Model Release

$ subscribe --daily

Liquid AI Ra Mắt Mô Hình LFM2.5-2.6B Tối Ưu Hóa Cho Thiết Bị Di Động Và Edge | Daily News