Ra Mắt LLM 0.32 Hỗ Trợ Chuỗi Suy Luận, Công Cụ Phía Máy Chủ Và OpenAI Responses
Simon Willison đã phát hành phiên bản LLM 0.32, giới thiệu khả năng hỗ trợ hiển thị chuỗi suy luận (reasoning traces), các công cụ phía máy chủ và các tính năng từ OpenAI Responses API. Bản cập nhật lớn này cũng chuyển sang sử dụng mô hình mặc định là GPT-5.6 Luna và thiết kế lại hệ thống ghi nhật ký SQLite. Bản phát hành này giúp công cụ dòng lệnh phổ biến này tương thích với các khả năng LLM hiện đại như gọi công cụ dạng tác nhân (agentic tool-calling) và các mô hình suy luận, giúp các nhà phát triển dễ dàng xây dựng và gỡ lỗi các quy trình AI phức tạp. Việc tách biệt chuỗi suy luận khỏi đầu ra tiêu chuẩn (stdout) giúp tránh làm gián đoạn các đường ống lệnh CLI, cải thiện trải nghiệm của nhà phát triển. Các chuỗi suy luận được xuất ra đầu ra lỗi tiêu chuẩn (stderr) theo mặc định để tránh làm ảnh hưởng đến đầu ra tiêu chuẩn (stdout), mặc dù người dùng có thể ẩn chúng bằng cờ `-R` hoặc `--hide-reasoning`. Ngoài ra, lệnh `llm openai endpoint` mới cho phép chạy các prompt một lần không lưu nhật ký trên bất kỳ API nào tương thích với OpenAI.
## KIẾN THỨC NỀN
Công cụ dòng lệnh và thư viện Python `llm`, do Simon Willison phát triển, cho phép các nhà phát triển tương tác với nhiều mô hình ngôn ngữ lớn khác nhau trực tiếp từ giao diện dòng lệnh. OpenAI Responses API, được giới thiệu vào đầu năm 2025, giúp đơn giản hóa việc phát triển các ứng dụng dạng tác nhân bằng cách kết hợp tính năng hoàn thành trò chuyện với khả năng gọi công cụ nâng cao và đầu ra có cấu trúc.