OpenAI hoãn ra mắt mô hình GPT-6.1 do rủi ro an ninh quá cao
OpenAI đã quyết định hoãn việc phát hành mô hình GPT-6.1 theo kế hoạch do các rủi ro an ninh và sự đánh đổi hiệu suất cao ở mức không thể chấp nhận được. Công ty viện dẫn các lo ngại nghiêm trọng về an toàn là lý do chính để giữ mô hình này ở quy mô nội bộ. Quyết định này đánh dấu một thời điểm quan trọng trong an toàn AI tiên phong, cho thấy các phòng thí nghiệm AI hàng đầu sẵn sàng hoãn ra mắt các mô hình lớn khi không đáp ứng được tiêu chuẩn an ninh. Điều này nhấn mạnh sự giằng co kéo dài trong ngành giữa việc đẩy mạnh năng lực mô hình và duy trì các rào chắn an toàn nghiêm ngặt. Các báo cáo chỉ ra rằng sự đánh đổi giữa hiệu suất và an ninh tương tự như ở GPT-6.1 cũng tồn tại trong các mô hình công khai đang được triển khai hiện nay. Tuy nhiên, các lỗ hổng được phát hiện trong GPT-6.1 bị đánh giá là quá nghiêm trọng để có thể phát hành ra công chúng.
## KIẾN THỨC NỀN
Các nhà phát triển AI tiên phong như OpenAI thường tiến hành kiểm thử xâm nhập (red-teaming) và đánh giá an ninh diện rộng trước khi ra mắt các mô hình ngôn ngữ lớn mới. Khi các mô hình tăng cường khả năng tư duy và năng lực xử lý, nguy cơ bị lạm dụng trong các lĩnh vực như tấn công mạng hoặc tự động tạo lỗ hổng khai thác cũng tăng lên đáng kể.