OpenAI tố cáo Moonshot AI thực hiện chiến dịch chắt lọc mô hình đối kháng
OpenAI thông báo đã phát hiện và ngăn chặn một chiến dịch chắt lọc mô hình đối kháng có tổ chức trên nền tảng của mình, liên quan đến hơn 15.000 tài khoản người dùng nhằm trích xuất lập luận và đầu ra của mô hình. Công ty đã công khai liên kết nhóm hoạt động cốt lõi đứng sau chiến dịch này với Moonshot AI, công ty khởi nghiệp AI của Trung Quốc đứng sau mô hình Kimi. Lời cáo buộc công khai này làm nổi bật mâu thuẫn ngày càng gia tăng về trí tuệ nhân tạo, việc thực thi điều khoản dịch vụ API và thu thập dữ liệu cạnh tranh giữa các phòng thí nghiệm AI hàng đầu của Mỹ và Trung Quốc. Đây là một cột mốc quan trọng trong quản trị AI, cho thấy cách các phòng thí nghiệm AI hàng đầu sử dụng cơ chế chia sẻ mối đe dọa chung để ngăn chặn việc chắt lọc mô hình không được phép. Hoạt động chắt lọc bắt đầu vào đầu tháng 7 và tăng bùng nổ vào khoảng ngày 24–25 tháng 7 khi hơn 4.000 tài khoản thực hiện 16.000 yêu cầu, dẫn đến việc bị chặn hoàn toàn vào ngày 28 tháng 7. OpenAI nhấn mạnh rằng không có cơ sở dữ liệu nội bộ hay hệ thống mã hóa nào bị xâm nhập, đồng thời công ty đã chia sẻ các chỉ số kỹ thuật với các đối tác ngành thông qua Diễn đàn Mô hình Tiên phong (Frontier Model Forum) để tăng cường phòng thủ tập thể.
## KIẾN THỨC NỀN
Chắt lọc mô hình (model distillation) là một kỹ thuật trong đó một mô hình 'học sinh' nhỏ hơn, hiệu quả hơn được huấn luyện bằng cách sử dụng các đầu ra do mô hình 'giáo viên' lớn hơn, mạnh hơn như GPT-4 tạo ra. Chắt lọc đối kháng (adversarial distillation) xảy ra khi việc trích xuất này được thực hiện một cách hệ thống mà không có sự cho phép của nhà cung cấp, thường vi phạm chính sách sử dụng API. Diễn đàn Mô hình Tiên phong (Frontier Model Forum) là một tổ chức ngành được thành lập bởi các nhà phát triển AI tiên phong nhằm thúc đẩy việc chia sẻ thông tin về rủi ro an toàn và các đe dọa an ninh.