~/AI SAFETY/google-launches-first-double-blind-ai-evaluation-using-confidential-computing

Google ra mắt công nghệ đánh giá AI song mù đầu tiên sử dụng điện toán bảo mật

Google hợp tác cùng các đối tác như MLCommons và OpenMined đã ra mắt khung đánh giá AI song mù đầu tiên trên thế giới. Hệ thống này sử dụng giải pháp Confidential Space của Google Cloud để kiểm thử mô hình Gemini Flash Lite trong một môi trường mã hóa an toàn. Giải pháp này giải quyết thế tiến thoái lưỡng nan trong đánh giá AI, nơi người kiểm thử có nguy cơ làm lộ câu lệnh kiểm tra (dẫn đến ô nhiễm dữ liệu kiểm thử) và nhà phát triển mô hình có nguy cơ lộ trọng số độc quyền. Điều này cho phép các tổ chức độc lập và chính phủ thực hiện các bài kiểm tra an toàn AI nhạy cảm, khách quan mà không ảnh hưởng đến sở hữu trí tuệ. Thiết lập song mù đảm bảo bên đánh giá không thể tiếp cận trọng số của mô hình Gemini, trong khi Google cũng không thể xem các câu lệnh kiểm thử của bên đánh giá. Sự cô lập bằng mã hóa này giúp ngăn chặn tình trạng ô nhiễm dữ liệu kiểm thử và bảo vệ chủ quyền dữ liệu trong các đợt đánh giá bên ngoài có rủi ro cao.

## KIẾN THỨC NỀN

Điện toán bảo mật (confidential computing) là công nghệ bảo mật giúp bảo vệ dữ liệu đang được xử lý bằng cách cô lập dữ liệu nhạy cảm trong một môi trường thực thi đáng tin cậy (TEE) dựa trên phần cứng. Ô nhiễm dữ liệu kiểm thử (benchmark contamination) xảy ra khi mô hình AI được tiếp xúc với các câu hỏi kiểm tra trong quá trình huấn luyện, dẫn đến điểm số hiệu năng bị thổi phồng nhân tạo và không phản ánh đúng năng lực thực tế.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#AI Safety#Confidential Computing#AI Benchmarking#Google Cloud

$ subscribe --daily

Google ra mắt công nghệ đánh giá AI song mù đầu tiên sử dụng điện toán bảo mật | Daily News