~/ARTIFICIAL I/zhipu-ai-discloses-production-level-recursive-self-improvement-for-large-models

Zhipu AI Công Bố Thực Hành Tự Cải Tiến Đệ Quy Đầu Tiên Cho Mô Hình Lớn

Zhipu AI đã công bố thành tựu kỹ thuật quan trọng khi mô hình Infra Agent (do GLM-5.3 vận hành) tự chủ thiết kế, tinh chỉnh và tối ưu hóa hạ tầng suy luận cho GLM-5.3-Flash từ con số 0. Hoạt động trên cụm máy chủ gồm hơn 100.000 chip nội địa Trung Quốc, agent này đã tăng gấp 3 lần hiệu suất xử lý (throughput) end-to-end trong chưa đầy hai tuần. Đây là lần đầu tiên một công ty AI Trung Quốc công khai áp dụng cơ chế tự cải tiến đệ quy trực tiếp vào môi trường vận hành thực tế, cho thấy AI có thể tự khép kín vòng lặp kỹ thuật cho hạ tầng của chính nó. Hơn nữa, việc đạt được hiệu suất phần cứng và chi phí trên mỗi token tương đương GPU NVIDIA phổ biến ngay trên chip nội địa đại diện cho một bước tiến quan trọng hướng tới tự chủ phần cứng AI. Hệ thống tự tối ưu hóa này đã được kiểm chứng qua các tải công việc thực tế, trong đó GLM-5.3-Flash được triển khai ẩn danh với tên "Ox-Alpha" trên OpenCode và OpenRouter, xử lý hơn 62 nghìn tỷ token chỉ trong 6 ngày. Agent đã tối ưu hóa toàn bộ quy trình vận hành mà không cần con người can thiệp vào việc tối ưu mã nguồn.

## KIẾN THỨC NỀN

Tự cải tiến đệ quy (Recursive Self-Improvement - RSI) là quá trình hệ thống AI tự kiểm tra, viết lại hoặc nâng cấp mã nguồn và tầng thực thi của chính nó để gia tăng hiệu suất. Trong khi đó, hạ tầng suy luận LLM bao gồm phần cứng, khung phần mềm và cơ chế điều hướng thực thi cần thiết để phục vụ các yêu cầu dự đoán một cách nhanh chóng và tiết kiệm chi phí ở quy mô lớn.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#Artificial Intelligence#LLM Inference#Recursive Self-Improvement#AI Infrastructure#Zhipu GLM

$ subscribe --daily

Zhipu AI Công Bố Thực Hành Tự Cải Tiến Đệ Quy Đầu Tiên Cho Mô Hình Lớn | Daily News