~/AI SECURITY/thomas-ptacek-warns-2025-open-weights-ai-models-can-execute-sandbox-escapes

Thomas Ptacek cảnh báo mô hình AI mã nguồn mở năm 2025 có thể vượt rào sandbox

Chuyên gia bảo mật Thomas Ptacek nhận định rằng các mô hình AI mở (open-weights) từ năm 2025, khi kết hợp với một hệ thống thử nghiệm xâm nhập (pentest harness), hoàn toàn có khả năng thực hiện các cuộc vượt rào sandbox và tấn công mạng. Ông nhấn mạnh rằng khả năng này không cần đến các mô hình biên (frontier model) tiên tiến nhất. Điều này cho thấy các mô hình mã nguồn mở dễ tiếp cận đang đặt ra những rủi ro bảo mật nghiêm trọng mà không cần đến các AI độc quyền, nguồn đóng. Nó thách thức giả định rằng các cuộc tấn công mạng bằng AI chỉ giới hạn ở các mô hình biên tiên tiến và được bảo vệ nghiêm ngặt. Ptacek gợi ý rằng sự ngạc nhiên xung quanh các khả năng này xuất phát từ việc đánh giá quá cao tính bảo mật của các sandbox, chẳng hạn như các sandbox do OpenAI sử dụng. Sự kết hợp giữa các mô hình thời kỳ 2025 với các công cụ pentest tự động là đủ để xâm nhập hầu hết các mạng.

## KIẾN THỨC NỀN

Sandbox (hộp cát) là một cơ chế bảo mật được sử dụng để chạy mã không đáng tin cậy trong một môi trường cô lập nhằm ngăn nó gây hại cho hệ thống máy chủ. Vượt rào sandbox (sandbox escape) xảy ra khi mã độc vượt qua các hạn chế này để truy cập vào hệ thống hoặc mạng bên dưới. Các mô hình mở (open-weights), như Llama hay DeepSeek, cho phép các nhà phát triển chạy và tùy chỉnh AI cục bộ, bỏ qua các bộ lọc an toàn thường được áp dụng bởi các nhà cung cấp API đám mây.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#AI Security#Generative AI#Cybersecurity#LLMs

$ subscribe --daily