Bản phát hành llama.cpp b11524 loại bỏ kiến trúc mp_21 khỏi backend MUSA
Dự án mã nguồn mở llama.cpp vừa ra mắt phiên bản b11524, loại bỏ `mp_21` khỏi các kiến trúc GPU mục tiêu mặc định cho backend MUSA. Thay đổi này do Xiaodong Ye từ Moore Threads đóng góp trong pull request #30203. Việc loại bỏ các kiến trúc tính toán cũ hoặc không hỗ trợ giúp đơn giản hóa quá trình biên dịch và tránh lỗi build cho các lập trình viên sử dụng llama.cpp trên nền tảng GPU Moore Threads. Điều này thể hiện sự bảo trì liên tục nhằm đảm bảo các công cụ suy luận LLM hiện đại hỗ trợ tốt cho các bộ tăng tốc GPU chuyên dụng. Cùng với tinh chỉnh cấu hình build MUSA, bản phát hành b11524 cung cấp các bản biên dịch cập nhật cho Linux, Windows, macOS, Android và các thiết bị Snapdragon. Ngoài ra, hỗ trợ KleidiAI cho bản build macOS Apple Silicon vẫn tiếp tục bị tắt trong phiên bản này.
## KIẾN THỨC NỀN
llama.cpp là một thư viện C/C++ mã nguồn mở phổ biến được thiết kế để suy luận hiệu quả các Mô hình Ngôn ngữ Lớn (LLM) trên nhiều nền tảng phần cứng khác nhau. MUSA (Moore Threads Unified System Architecture) là kiến trúc phần cứng và phần mềm GPU độc quyền do Moore Threads phát triển nhằm tăng tốc các tác vụ đồ họa và trí tuệ nhân tạo.