Arena Ra Mắt Gemini 3.6 Flash và 3.5 Flash-Lite Cho Tác Nhân AI
Arena đã công bố triển khai các mô hình Gemini mới, bao gồm Gemini 3.6 Flash và Gemini 3.5 Flash-Lite. Các mô hình này được thiết kế để giúp các tác nhân AI hoạt động nhanh hơn, thông minh hơn và tiết kiệm chi phí hơn ở quy mô lớn. Bằng cách tối ưu hóa việc sử dụng token và tốc độ xử lý, các mô hình này giúp giảm chi phí vận hành và độ trễ cho các nhà phát triển đang xây dựng các tác nhân AI tự trị. Điều này hỗ trợ xu hướng chuyển dịch rộng lớn hơn của ngành hướng tới các quy trình làm việc dạng tác nhân (agentic workflows) hiệu quả cao. Gemini 3.6 Flash mang lại chất lượng công việc cao hơn với cùng mức chi phí như Gemini 3.5 Flash nhờ sử dụng ít token hơn. Trong khi đó, Gemini 3.5 Flash-Lite đóng vai trò là một giải pháp thay thế nhanh chóng, tiết kiệm ngân sách được thiết kế riêng cho các tác vụ hàng ngày.
## KIẾN THỨC NỀN
Tác nhân AI (AI agents) là các hệ thống tự trị có thể thực hiện các tác vụ phức tạp và thiết kế quy trình làm việc bằng các công cụ có sẵn. Các mô hình ngôn ngữ lớn xử lý văn bản bằng cách chia nhỏ nó thành các đơn vị gọi là token, đại diện cho các từ hoặc ký tự. Việc giảm số lượng token cần thiết cho một tác vụ sẽ trực tiếp làm giảm tài nguyên tính toán và chi phí cần thiết để vận hành các mô hình này.