DeepSeek Harness 0.1.5 Ra Mắt Với Hỗ Trợ DeepSeek V4.1 Flash Và Cải Tiến Giao Diện
DeepSeek đã phát hành DeepSeek Harness v0.1.5, mang đến các tối ưu hóa chuyên biệt cho mô hình DeepSeek V4.1 Flash cùng với tính năng tải lên tệp và xem trước tệp ở thanh bên mới. Bản cập nhật này cũng bổ sung các điểm mở rộng UI chuẩn hóa cho plugin, cải thiện hiệu suất phiên trò chuyện dài và tính năng thử nghiệm Agent Teams. Bản phát hành này củng cố hạ tầng agent mã nguồn mở của DeepSeek bằng cách cho phép các agent LLM thực thi các luồng công việc phức tạp gồm nhiều sub-agent hiệu quả hơn. Thông qua việc hỗ trợ giữ lại KV Cache khi cập nhật câu lệnh hệ thống (system prompt) và gọi công cụ bằng lập trình (PTC), các nhà phát triển có thể giảm độ trễ và lượng token tiêu thụ cho các tác vụ agent phức tạp. Bản cập nhật cho phép cập nhật câu lệnh hệ thống trong khi vẫn giữ lại KV Cache đã có cho DeepSeek V4.1 Flash trên các chế độ tiêu chuẩn, gọi công cụ bằng lập trình (PTC) và cực giản. Ngoài ra, các nhà phát triển có thể khởi động nhanh Web UI bằng lệnh `npx @deepseek-ai/dsh web` hoặc bật các tính năng cộng tác đa agent thử nghiệm thông qua hồ sơ CLI tùy chỉnh.
## KIẾN THỨC NỀN
DeepSeek Harness (dsh) là một khung làm việc (framework) agent mã nguồn mở do DeepSeek AI phát triển trên kiến trúc plugin Cordis, được thiết kế để điều phối các LLM, thực thi mã và các công cụ lập trình. Các khái niệm quan trọng trong suy luận LLM bao gồm KV Cache (bộ nhớ tạm lưu các cặp key-value giúp tăng tốc quá trình tạo token) và gọi công cụ bằng lập trình (PTC, nơi LLM tạo mã có thể thực thi để kết hợp nhiều cuộc gọi công cụ cục bộ thay vì thực hiện từng vòng gọi API riêng lẻ).