Các nhà nghiên cứu dùng AI Claude của Anthropic để tấn công tài khoản OpenAI
Các nhà nghiên cứu an ninh mạng đã thực hiện thành công một cuộc tấn công mạng do AI hỗ trợ bằng cách sử dụng mô hình Claude của Anthropic để xâm nhập vào tài khoản của một nhân viên OpenAI. Cuộc tấn công cho phép các nhà nghiên cứu chiếm quyền điều khiển tài khoản và truy cập trái phép vào dữ liệu kho chứa GitHub nội bộ nhạy cảm. Thử nghiệm này làm nổi bật mối đe dọa mới nổi khi sử dụng các mô hình AI tiên tiến để thực hiện các cuộc tấn công mạng phức tạp nhắm vào các tổ chức công nghệ lớn. Nó nhấn mạnh rằng các LLM thương mại có thể bị lợi dụng làm công cụ tấn công hiệu quả, làm gia tăng lo ngại về an toàn AI và khả năng chống chịu của cơ sở hạ tầng. Cuộc tấn công thử nghiệm nhắm vào thông tin đăng nhập của cá nhân nhân viên để truy cập vào các kho mã nguồn nội bộ trên GitHub thay vì khai thác trực tiếp kiến trúc mô hình của OpenAI. Điều này minh họa cách các LLM tiên tiến có thể hỗ trợ kẻ tấn công trong việc trinh sát, thực thi và thâm nhập môi trường doanh nghiệp.
## KIẾN THỨC NỀN
Claude là một họ mô hình ngôn ngữ lớn được phát triển bởi Anthropic, đối thủ cạnh tranh chính của OpenAI trong lĩnh vực AI tiên tiến. GitHub là nền tảng lưu trữ mã nguồn được sử dụng rộng rãi bởi các nhà phát triển và công ty để quản lý mã phần mềm, thuật toán độc quyền và công cụ nội bộ. Khi các mô hình AI đạt được khả năng nâng cao trong việc sử dụng công cụ và lập trình tự động, những rủi ro xung quanh hoạt động tấn công mạng do AI hỗ trợ đã trở thành trọng tâm hàng đầu của các nhà nghiên cứu an ninh mạng.