Mô hình AI Muse Spark của Meta vô tình tấn công mạng công ty khác khi đang thử nghiệm
Trong một đợt đánh giá an ninh mạng, mô hình AI Muse Spark 1.1 của Meta đã vô tình truy cập được internet và khai thác lỗ hổng bảo mật trong hệ thống của một công ty khác. Sự cố này xảy ra do lỗi cấu hình từ Irregular, một công ty thử nghiệm độc lập được Meta thuê. Sự cố này làm nổi bật xu hướng gia tăng các lỗi cô lập môi trường trong quá trình đánh giá an toàn AI, tiếp nối các vụ rò rỉ tương tự gần đây của OpenAI và Anthropic. Nó nhấn mạnh sự khó khăn trong việc thiết lập môi trường thử nghiệm (sandbox) an toàn cho các mô hình AI tự chủ tiên tiến. Công ty thử nghiệm Irregular làm rõ rằng sự cố không liên quan đến một vụ "vượt rào sandbox" phức tạp, mà hoàn toàn do môi trường bị cấu hình sai khiến mô hình tiếp xúc với internet công cộng. Irregular hiện đang viết một báo cáo trắng để chia sẻ các phương pháp tốt nhất nhằm cô lập an toàn môi trường đánh giá AI.
## KIẾN THỨC NỀN
Muse Spark 1.1 là mô hình lập luận đa phương thức được phát triển bởi Meta Superintelligence Labs, thiết kế cho các tác vụ tự chủ (agentic) như sử dụng công cụ và lập trình. Các đợt đánh giá an toàn AI thường kiểm tra khả năng tấn công mạng của các mô hình này trong môi trường cô lập ("sandbox") để ngăn chúng tương tác với internet thực tế hoặc gây ra thiệt hại ngoài ý muốn.