Hệ thống gợi ý và định nghĩa công cụ OpenAI GPT-6 Sol bị rò rỉ
Một nhà nghiên cứu bảo mật đã trích xuất gần 294.000 ký tự gợi ý hệ thống nội bộ và định nghĩa công cụ từ môi trường mô hình lập trình GPT-6 Sol Codex của OpenAI. Đợt rò rỉ này làm lộ 1.902 dòng mẫu hướng dẫn, lô-gíc hợp tác nội bộ và các quy tắc quy trình làm việc chi tiết. Sự cố này mang lại cái nhìn hiếm hoi về cách các phòng thí nghiệm AI hàng đầu thiết kế agent lập trình phức tạp, loại bỏ từ ngữ AI rập khuôn và thực thi khả năng tự giải quyết vấn đề nhiều bước. Nó cung cấp cho các nhà phát triển và kỹ sư prompt thiết kế tham chiếu thực tế để xây dựng các trợ lý AI tự chủ và kỷ luật hơn. Tệp gợi ý ghi rõ danh sách đen các từ ngữ bị lạm dụng (như 'delve' hay 'it's worth noting') và chỉ định mô hình hoạt động tự chủ mà không cần xin phép ở các bước trung gian. Về mặt kỹ thuật, nó mã hóa cứng các công cụ tối ưu như `ripgrep` (`rg`) để tăng tốc độ, thực thi xử lý song song qua `Promise.allSettled` và yêu cầu cập nhật trạng thái mỗi 60 giây trong các đợt chạy công cụ kéo dài.
## KIẾN THỨC NỀN
Trích xuất gợi ý hệ thống (system prompt extraction) là việc sử dụng kỹ thuật prompt injection để lừa mô hình ngôn ngữ lớn tiết lộ các cấu hình ẩn và quy tắc ranh giới của nó. Các LLM hiện đại sử dụng định nghĩa công cụ để tương tác với các API bên ngoài, tìm kiếm tệp hệ thống và thực thi mã nguồn thay vì chỉ tạo văn bản thuần túy.