21llama.cpp Phát Hành Bản Build b10736 Sửa Lỗi Ghi Log Kiểm Thử Kiến TrúcGITHUB · github-actions[bot] · github.com · 13:29 01 thg 92d
22llama.cpp Cập Nhật Các Bản Sửa Lỗi và Hỗ Trợ Multi-Token Prediction Cho Họ Mô Hình QwenREDDIT · /u/jacek2023 · reddit.com · 08:28 01 thg 93d
23llama.cpp b10729 Bổ Sung Tinh Chỉnh Vector Flash-Attention Cho Metal Trên Chip M1 UltraGITHUB · github-actions[bot] · github.com · 22:22 31 thg 83d
24Bản phát hành llama.cpp b10721 sửa lỗi sập nguồn trên WebGPU backendGITHUB · github-actions[bot] · github.com · 15:54 31 thg 83d
25llama.cpp Phát Hành Phiên Bản b10711 Sửa Lỗi Cho Backend Hexagon DSPGITHUB · github-actions[bot] · github.com · 04:45 31 thg 84d
26llama.cpp Phát Hành Bản Dựng b10708 Sửa Lỗi Backend GGMLGITHUB · github-actions[bot] · github.com · 03:25 31 thg 84d
27llama.cpp b10707 tối ưu hóa quét KV-cell giúp tăng tốc suy luận ngữ cảnh dàiGITHUB · github-actions[bot] · github.com · 03:03 31 thg 84d
28Phiên bản llama.cpp b10700 đổi tên đối số CLI của chế độ Lazy ModeGITHUB · github-actions[bot] · github.com · 18:33 30 thg 84d
29llama.cpp Phát Hành Phiên Bản b10694 Sửa Lỗi RPC Trên macOS CũGITHUB · github-actions[bot] · github.com · 13:06 30 thg 84d
30llama.cpp b10693 Hỗ Trợ Phát Hiện Thiết Bị và Cấp Phát Trễ Cho Qualcomm Hexagon NPUGITHUB · github-actions[bot] · github.com · 12:43 30 thg 85d
31Bản phát hành llama.cpp b10691 khắc phục lỗi sập Metal Pipeline trên Apple SiliconGITHUB · github-actions[bot] · github.com · 11:58 30 thg 85d
32llama.cpp b10687 tối ưu hóa OpenCL cho GPU AdrenoGITHUB · github-actions[bot] · github.com · 18:23 29 thg 85d
33Bản phát hành llama.cpp b10662 giới thiệu tham số cấu hình KV Cache hợp nhấtGITHUB · github-actions[bot] · github.com · 21:07 27 thg 87d
34llama.cpp Tích Hợp Hỗ Trợ Cho Mô Hình Qwen3.8-Flash-NextREDDIT · /u/jacek2023 · reddit.com · 19:34 27 thg 87d
35Bản phát hành llama.cpp b10648 đơn giản hóa đồ thị mô hình MiniMax-01GITHUB · github-actions[bot] · github.com · 11:59 27 thg 88d
36llama.cpp b10645 hỗ trợ offload trọng số FFN sang CPUGITHUB · github-actions[bot] · github.com · 10:02 27 thg 88d
37llama.cpp b10643 Ra Mắt Hỗ Trợ Đa NPU HexagonGITHUB · github-actions[bot] · github.com · 02:14 27 thg 88d
38Phiên bản llama.cpp b10642 bổ sung tính năng theo dõi ID token vào ô KVGITHUB · github-actions[bot] · github.com · 22:00 26 thg 88d
39llama.cpp Phát Hành Bản Dựng b10639 Sửa Lỗi Kích Thước Warp Trên VulkanGITHUB · github-actions[bot] · github.com · 16:51 26 thg 88d
40Bản phát hành llama.cpp b10631 cập nhật khởi tạo tensor trong ggml-metaGITHUB · github-actions[bot] · github.com · 06:04 26 thg 89d