Anthropic ra mắt Claude Sonnet 5.5 với khả năng tư duy mở rộng
Anthropic đã chính thức công bố Claude Sonnet 5.5, mang lại hiệu suất điểm chuẩn được nâng cấp cùng khả năng tư duy mở rộng cho dòng mô hình AI tầm trung của mình. Đợt phát hành này đã kích hoạt những đánh giá kỹ thuật từ cộng đồng xung quanh mức tiêu thụ token tư duy, hành vi bộ lọc an toàn và điểm số benchmark so với Opus 5.5. Sonnet vốn đóng vai trò là dòng mô hình cân bằng hiệu năng và chi phí của Anthropic, vì vậy việc nâng cấp khả năng suy luận mở rộng giúp mang lại hiệu suất tiệm cận cấp cờ đầu cho quy trình làm việc hằng ngày với chi phí hợp lý hơn. Việc hiểu rõ sự cân bằng giữa tốc độ xử lý, rào cản an toàn và hiệu quả sử dụng token tư duy là rất quan trọng đối với các đội ngũ kỹ thuật khi xây dựng hệ thống AI thực tế. Trong các bài kiểm tra điểm chuẩn như Terminal-Bench, Sonnet 5.5 đạt 70,6 điểm so với 66,4 điểm của Opus 5.5, phần lớn do Opus chịu tỷ lệ 10% bị lùi về mô hình dự phòng vì bộ lọc an toàn so với chỉ 1,5% ở Sonnet. Các nhà kỹ thuật cũng ghi nhận rằng chế độ tư duy mở rộng ở mức tối đa có thể tiêu tốn tới 128.000 token tư duy và dẫn đến hết thời gian chờ khi giải quyết các tác vụ quá phức tạp.
## KIẾN THỨC NỀN
Anthropic phân loại dòng mô hình Claude thành các cấp độ chuyên biệt: Opus là mô hình cờ đầu dành cho phân tích sâu, Sonnet cân bằng hiệu năng và tốc độ, còn Haiku phục vụ các tác vụ yêu cầu độ trễ thấp. Khả năng tư duy mở rộng (extended thinking) cho phép AI tạo ra các token suy luận nội bộ để xử lý bài toán logic hoặc lập trình phức tạp trước khi đưa ra kết quả cuối cùng.