ByteDance hoãn ra mắt mô hình ngôn ngữ lớn Doubao 2.2 để tập trung nâng cấp khả năng lập trình và tác tử
ByteDance được cho là đã hoãn việc ra mắt mô hình ngôn ngữ lớn Doubao 2.2 vốn được lên lịch vào tháng 8. Quyết định trì hoãn này nhằm thực hiện quá trình tiền huấn luyện và hậu huấn luyện kỹ lưỡng hơn để cải thiện đáng kể khả năng lập trình, gọi công cụ và tác tử (agent) của mô hình. Sự trì hoãn này phản ánh sự chuyển dịch chiến lược của ByteDance hướng tới khả năng tự chủ lâu dài và chất lượng, ưu tiên nâng cấp đáng kể năng lực thay vì lặp lại nhanh chóng. Điều này cũng làm nổi bật sự cạnh tranh gay gắt trong thị trường AI tại Trung Quốc, nơi ByteDance đặt mục tiêu cạnh tranh với các đối thủ như Zhipu AI và Kimi về hiệu suất lập trình. Ban lãnh đạo của ByteDance, bao gồm cả nhà sáng lập Trương Nhất Minh (Zhang Yiming), đã tuyên bố rõ ràng rằng công ty sẽ không phụ thuộc vào kỹ thuật chưng cất tri thức (knowledge distillation) để cải thiện các mô hình của mình, thay vào đó chấp nhận tụt hậu trong ngắn hạn để tối ưu hóa dài hạn. Mô hình Doubao 2.2 đóng vai trò như một bước đệm quan trọng trước khi ra mắt các mô hình siêu lớn thế hệ tiếp theo của ByteDance, vốn có thể lên tới 5 nghìn tỷ tham số.
## KIẾN THỨC NỀN
Chưng cất tri thức (knowledge distillation) trong AI là một kỹ thuật huấn luyện mô hình "học sinh" nhỏ hơn và hiệu quả hơn bằng cách sử dụng dữ liệu đầu ra từ một mô hình "giáo viên" lớn hơn và mạnh mẽ hơn. Quá trình phát triển AI của ByteDance được thúc đẩy bởi đội ngũ mô hình nền tảng Seed, tập trung vào khả năng hiểu đa phương thức, lập luận và tác tử (agent) đa dụng.