Cựu Trưởng bộ phận An toàn OpenAI chỉ trích công ty về sự mâu thuẫn trong an toàn AI
David Robinson, cựu đồng trưởng nhóm hệ thống an toàn của OpenAI, đã công khai chỉ trích công ty vì bề ngoài kêu gọi an toàn AI nhưng bên trong vẫn tiếp tục đẩy mạnh phát triển mô hình tiên tiến với tốc độ tối đa. Lời chỉ trích này làm nổi bật khoảng cách ngày càng lớn giữa cam kết an toàn công khai và thực tế phát triển nội bộ tại các phòng thí nghiệm AI hàng đầu, gia tăng lo ngại rằng áp lực cạnh tranh thương mại đang chạy nhanh hơn quản trị rủi ro. Điều này củng cố thêm lời kêu gọi từ các nhà nghiên cứu và cơ quan quản lý về sự giám sát độc lập đối với các mô hình AI có rủi ro cao. Robinson mô tả môi trường làm việc tại OpenAI đang vận hành dưới áp lực khốc liệt với tốc độ tối đa, bất chấp các cảnh báo công khai từ lãnh đạo và nhà nghiên cứu OpenAI về các nguy cơ như sự tự cải thiện đệ quy. Sự ra đi của ông diễn ra sau khi hàng trăm nhân viên OpenAI ký một bức thư ngỏ vào tháng 7 kêu gọi chính phủ can thiệp để làm chậm tốc độ phát triển AI.
## KIẾN THỨC NỀN
An toàn AI tiên tiến (frontier AI safety) tập trung vào việc ngăn chặn rủi ro thảm họa, sự lệch hướng mục tiêu và hành vi lạm dụng xuất phát từ các hệ thống trí tuệ nhân tạo có năng lực cao. Một mối quan ngại kỹ thuật trọng tâm là sự tự cải thiện đệ quy (recursive self-improvement), quá trình mà mô hình AI tự chỉnh sửa và viết lại mã nguồn của chính mình để nâng cao năng lực nhanh chóng, có thể dẫn đến sự phát triển vượt tầm kiểm soát của con người.