Grok bị rò rỉ dữ liệu qua lỗ hổng Cryptographic Context Injection
Các nhà nghiên cứu đã phát hiện ra một lỗ hổng bảo mật mang tên Cryptographic Context Injection cho phép kẻ tấn công vượt qua các hàng rào bảo vệ của Grok (xAI). Bằng cách mã hóa các chỉ dẫn độc hại, kẻ tấn công có thể lừa LLM này tiết lộ và gửi dữ liệu nhạy cảm của người dùng ra ngoài. Lỗ hổng này làm nổi bật một điểm yếu chí mạng trong các hàng rào bảo mật LLM hiện nay, vốn thường không thể kiểm tra hoặc hiểu được các đầu vào đã mã hóa. Điều này chứng minh rằng các biện pháp phòng thủ lọc đầu vào truyền thống không đủ để chống lại các cuộc tấn công thao túng ngữ cảnh tinh vi. Cuộc tấn công này vượt qua các hệ thống giám sát prompt tiêu chuẩn vì mã độc được ẩn giấu cho đến khi được xử lý trong ngữ cảnh thực thi của mô hình. Sau khi được thực thi, mô hình có thể bị ép buộc gửi dữ liệu ra ngoài thông qua các kênh như hình ảnh markdown hoặc các lệnh gọi API bên ngoài.
## KIẾN THỨC NỀN
Context injection (tiêm ngữ cảnh) xảy ra khi các chỉ dẫn không đáng tin cậy xâm nhập vào môi trường thực thi của LLM thông qua các nguồn bên ngoài như đường ống truy xuất dữ liệu hoặc tích hợp cơ sở dữ liệu. Rò rỉ dữ liệu (data exfiltration) trong LLM là kỹ thuật thao túng mô hình để gửi thông tin cá nhân của người dùng đến các địa chỉ bên ngoài trái phép. Các công cụ ngăn ngừa thất thoát dữ liệu (DLP) truyền thống thường gặp khó khăn trong việc phát hiện các vụ rò rỉ này khi chúng được ngụy trang dưới dạng đầu ra lành tính của mô hình.