~/AI SAFETY/openai-mitigates-codex-file-deletion-issue-caused-by-gpt-5-6-models

OpenAI khắc phục sự cố Codex xóa nhầm file người dùng do mô hình GPT-5.6

Trưởng nhóm OpenAI Codex, Thibault Sottiaux, đã phản hồi về các báo cáo cho biết Codex vô tình xóa file của người dùng khi thực thi lệnh với các mô hình thuộc dòng GPT-5.6. Sự cố xảy ra do tác nhân AI này tái sử dụng các biến môi trường hệ thống như $HOME cho các lệnh dọn dẹp tạm thời, dẫn đến việc nhắm mục tiêu nhầm vào các thư mục thực tế của người dùng. Sự cố này làm nổi bật các rủi ro bảo mật nghiêm trọng khi các tác nhân AI tự trị thực thi các lệnh ở cấp hệ thống trên máy chủ. Khi các mô hình ngôn ngữ lớn (LLM) ngày càng được tích hợp sâu vào quy trình làm việc của lập trình viên để chạy mã, việc cô lập môi trường và tạo hộp cát (sandboxing) mạnh mẽ là vô cùng cần thiết để ngăn chặn các hành động phá hoại. Để giải quyết sự cố, OpenAI đã triển khai các biện pháp giảm thiểu nhiều lớp, bao gồm việc hướng dẫn Codex tránh tái sử dụng các biến môi trường hệ thống, tăng cường kiểm tra tự động đối với các lệnh xóa có rủi ro cao và bổ sung huấn luyện an toàn bằng học tăng cường (RL) để lọc bỏ các hành vi gây hại.

## KIẾN THỨC NỀN

OpenAI Codex là một tác nhân lập trình AI được thiết kế để tự động hóa các tác vụ kỹ thuật phần mềm bằng cách viết mã và thực thi các lệnh terminal. Khi các tác nhân AI chạy lệnh trực tiếp trên hệ thống của người dùng, việc thiếu cô lập biến môi trường hoặc thiếu cơ chế hộp cát an toàn có thể dẫn đến việc sửa đổi hệ thống ngoài ý muốn hoặc mất mát dữ liệu.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#AI Safety#LLM Agents#OpenAI#System Security

$ subscribe --daily

OpenAI khắc phục sự cố Codex xóa nhầm file người dùng do mô hình GPT-5.6 | Daily News