Chính phủ Mỹ hoàn tất khung đánh giá tự nguyện cho các mô hình AI tiên tiến nhưng không công khai chi tiết
Chính phủ Mỹ đã hoàn thành khung đánh giá tự nguyện dành cho các mô hình AI tiên tiến, được xây dựng với sự hợp tác của các phòng thí nghiệm AI lớn bao gồm OpenAI, Anthropic và Google. Tuy nhiên, Nhà Trắng đã quyết định không công khai các chi tiết cụ thể, ngưỡng giới hạn hoặc danh sách các thực thể tham gia khung đánh giá này cho công chúng. Khung đánh giá này đại diện cho một bước tiến quan trọng trong việc quản trị và điều chỉnh an toàn AI của Mỹ, thiết lập các quy trình để chính phủ tiếp cận các mô hình mạnh mẽ trước khi phát hành. Tuy nhiên, việc thiếu minh bạch công khai làm hạn chế khả năng giám sát từ bên ngoài và khiến các nhà quan sát chính sách chưa rõ về các ngưỡng quy định cụ thể. Khung này xác định các yêu cầu bảo mật, an ninh mạng và bảo vệ sở hữu trí tuệ khi chính phủ tiếp cận các mô hình tối đa 30 ngày trước khi phát hành. Mặc dù bản thân khung đánh giá không bị phân loại mật, nhưng các tiêu chuẩn đánh giá cụ thể để kiểm tra khả năng tấn công mạng và ngưỡng kích thước mô hình áp dụng vẫn được giữ bí mật.
## KIẾN THỨC NỀN
Vào cuối năm 2023, chính quyền Mỹ đã ban hành một Sắc lệnh hành pháp mang tính cột mốc về AI an toàn, bảo mật và đáng tin cậy, yêu cầu các cơ quan liên bang thiết lập các tiêu chuẩn an toàn và cơ chế đánh giá. Các tổ chức như Viện An toàn AI Hoa Kỳ (US AISI) kể từ đó đã hợp tác với các nhà phát triển AI hàng đầu để thiết lập các Biên bản ghi nhớ (MoU) nhằm thử nghiệm mô hình trước khi phát hành và thực hiện red-teaming.