Mind Lab ra mắt dòng mô hình Macaron-V1 xây dựng trên Qwen 3.6
Mind Lab đã giới thiệu dòng mô hình tác nhân Macaron-V1, bao gồm các biến thể được xây dựng trên mô hình nền tảng Qwen3.6-35B-A3B mới ra mắt. Dòng mô hình này bao gồm biến thể "Tall" 35B và biến thể "Venti" 748B lớn hơn sử dụng kiến trúc Mixture-of-LoRA (MoL). Việc phát hành này cho thấy sự đón nhận nhanh chóng của các mô hình mã nguồn mở Qwen 3.6 mới cho các ứng dụng tác nhân. Bằng cách tận dụng Mixture-of-LoRA, nó cung cấp một phương pháp hiệu quả về tài nguyên để mở rộng quy mô các mô hình tác nhân lớn cho các tình huống thực tế hàng ngày. Dòng Macaron-V1 sử dụng thiết kế đồng bộ giữa mô hình và khung thử nghiệm (model-harness co-design), với phiên bản thử nghiệm (Macaron-V1-Preview) là mô hình 749B được hậu huấn luyện từ GLM5.1 bằng MinT. Kiến trúc này kết hợp một mô hình nền tảng với nhiều bộ điều hợp LoRA (chẳng hạn như nền tảng 744B với năm bộ điều hợp LoRA 1B) để tối ưu hóa hiệu suất.
## KIẾN THỨC NỀN
Qwen 3.6 là phiên bản mới nhất trong chuỗi mô hình ngôn ngữ lớn mã nguồn mở của Alibaba, trong đó Qwen3.6-35B-A3B là một trong những biến thể đầu tiên của nó. Mixture-of-LoRA (MoL) là một phương pháp tiếp cận kiến trúc kết hợp nhiều mô-đun Thích ứng thứ hạng thấp (LoRA), cho phép các mô hình chuyên môn hóa vào các tác vụ khác nhau một cách hiệu quả mà không cần huấn luyện lại toàn bộ mô hình nền tảng khổng lồ.