Mô hình Astra sắp ra mắt của OpenAI hoàn tất đánh giá an toàn tự nguyện với Chính phủ Mỹ
CEO Sam Altman của OpenAI đã xác nhận rằng mô hình Astra sắp ra mắt của công ty đã hoàn tất quy trình đánh giá an toàn tự nguyện trước khi phát hành với chính phủ Mỹ. Đáng chú ý, Astra là mô hình đầu tiên của OpenAI đạt mức năng lực an ninh mạng "nghiêm trọng" (critical) theo khung theo dõi rủi ro nội bộ. Cột mốc này phản ánh sự hợp tác ngày càng tăng giữa các phòng thí nghiệm AI hàng đầu và giới chức an ninh quốc gia đối với các mô hình AI tiên tiến có rủi ro cao. Nó cũng thể hiện cách các cơ chế giám sát tự nguyện đang định hình quản trị AI trong bối cảnh luật pháp liên bang về AI vẫn chưa được ban hành. Theo khung làm việc tự nguyện của chính phủ Mỹ, các quan chức được phép truy cập sớm mô hình tối đa 30 ngày để đánh giá an toàn, dù các tiêu chuẩn kiểm tra cụ thể không được công khai. Các báo cáo chỉ ra rằng Astra sở hữu các năng lực vượt trội trong cả khả năng thâm nhập an ninh mạng lẫn suy luận toán học nâng cao.
## KIẾN THỨC NỀN
OpenAI sử dụng Khung An toàn Chuẩn bị (Preparedness Framework) nội bộ để theo dõi và quản lý các rủi ro hệ thống nghiêm trọng từ AI tiên tiến, phân loại năng lực thành các cấp độ như Cao (High) và Nghiêm trọng (Critical). Các mô hình chạm ngưỡng nghiêm trọng trong những lĩnh vực nhạy cảm như an ninh mạng yêu cầu các quy trình đánh giá và biện pháp giảm thiểu rủi ro nghiêm ngặt hơn trước khi triển khai.