~/AI BENCHMARK/anthropic-and-academic-partners-introduce-cryptanalysisbench-to-evaluate-llms

Anthropic và các đối tác học thuật giới thiệu CryptanalysisBench để đánh giá LLM

Anthropic đã hợp tác với các nhà nghiên cứu từ ETH Zurich, Đại học Tel Aviv và Đại học Haifa để giới thiệu CryptanalysisBench. Bộ đánh giá mới này được thiết kế để đo lường khả năng thám mã (cryptanalysis) của các mô hình ngôn ngữ lớn (LLM). Khi các LLM ngày càng tiên tiến, việc hiểu rõ khả năng giải mã các hệ thống mật mã của chúng là rất quan trọng đối với an toàn AI và an ninh mạng. Bộ đánh giá này giúp các nhà nghiên cứu đo lường một cách hệ thống liệu các mô hình AI có gây ra rủi ro cho các tiêu chuẩn mã hóa hiện đại hay có thể hỗ trợ kiểm định an ninh hay không. CryptanalysisBench bao gồm 191 nhiệm vụ trải rộng trên sáu nhóm nguyên mẫu mật mã, bao gồm hàm băm, mã khối, AEAD, KEM, PKE và chữ ký số. Các nhiệm vụ này được lấy từ bốn cuộc thi mật mã của NIST cùng với các thuật toán mật mã học thuật và thực tế được nghiên cứu rộng rãi.

## KIẾN THỨC NỀN

Thám mã (cryptanalysis) là việc nghiên cứu phân tích và phá vỡ các hệ thống mật mã để giải mã dữ liệu đã mã hóa mà không cần biết khóa. Vốn là một lĩnh vực toán học chuyên sâu, việc đánh giá hiệu suất của các mô hình AI hiện đại trong lĩnh vực này là rất cần thiết để đánh giá các rủi ro lưỡng dụng tiềm ẩn của chúng trong an ninh mạng.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#AI Benchmarks#Large Language Models#Cryptanalysis#Cybersecurity

$ subscribe --daily

Anthropic và các đối tác học thuật giới thiệu CryptanalysisBench để đánh giá LLM | Daily News