~/OPENAI/pentagon-reportedly-requested-openai-model-with-minimum-refusal-rate-for-military-commands

Bộ Quốc phòng Mỹ bị cáo buộc từng yêu cầu OpenAI cung cấp AI có 'tỷ lệ từ chối tối thiểu'

Tài liệu FOIA bị rò rỉ do báo The Intercept thu thập cho thấy Bộ Quốc phòng Mỹ từng yêu cầu một mô hình OpenAI tùy chỉnh phục vụ an ninh quốc gia với 'tỷ lệ từ chối tối thiểu' khi thực hiện mệnh lệnh quân sự. Cả OpenAI và Ngũ Giác Đài đều phủ nhận điều khoản này xuất hiện trong hợp đồng chính thức, khẳng định tài liệu bị công bố chỉ là bản thảo ban đầu. Vụ rò rỉ làm nổi bật những tranh cãi đạo đức gay gắt xung quanh việc triển khai các mô hình AI tiên tiến thương mại vào các hoạt động quân sự và bảo mật. Điều này làm dấy lên lo ngại về việc liệu các hàng rào bảo vệ an toàn ngăn chặn AI thực hiện hành vi nguy hiểm hoặc gây chết người có bị dỡ bỏ cho các ứng dụng quốc phòng hay không. Cụm từ 'tỷ lệ từ chối tối thiểu' xuất hiện trong tài liệu thuộc hợp đồng mở rộng 'P00003' với giá trị lên tới 200 triệu USD. Mặc dù luật sư Bộ Tư pháp ban đầu xác nhận đây là bản hợp đồng chính thức đã ký, các quan chức sau đó đã rút lại tuyên bố, và OpenAI mới đây đã ký thỏa thuận triển khai trên mạng bảo mật với khẳng định giữ vững hai ranh giới đỏ cấm giết người tự động và giám sát công dân Mỹ.

## KIẾN THỨC NỀN

Các mô hình ngôn ngữ lớn thương mại được tinh chỉnh bằng các hàng rào bảo vệ an toàn nhằm tự động từ chối những câu lệnh gây hại, chẳng hạn như lên kế hoạch không kích hoặc chế tạo chất nguy hiểm. Trong kỹ thuật an toàn AI, sự từ chối của mô hình xảy ra khi bộ phân loại an toàn hoặc cơ chế căn chỉnh đánh giá một lệnh đầu vào là vi phạm các chính sách an toàn.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#OpenAI#AI Safety#Military AI#AI Ethics#Defense Contracting

$ subscribe --daily

Bộ Quốc phòng Mỹ bị cáo buộc từng yêu cầu OpenAI cung cấp AI có 'tỷ lệ từ chối tối thiểu' | Daily News