Kẻ phát tán thư rác dùng thủ thuật ASCII smuggling để qua mặt bộ lọc văn bản
Những kẻ phát tán thư rác đang tăng cường áp dụng kỹ thuật ASCII smuggling — phương pháp sử dụng các ký tự Unicode vô hình từng phổ biến trong các cuộc tấn công prompt injection vào AI — để qua mặt các bộ lọc thư rác và văn bản truyền thống. Bằng cách chèn các ký tự có độ rộng bằng 0 hoặc ký tự định dạng vào tin nhắn, kẻ tấn công làm gián đoạn các từ khóa mà máy quét bảo mật đang tìm kiếm. Xu hướng này cho thấy các kỹ thuật tấn công được phát triển cho hệ thống AI đang nhanh chóng lan sang các chiến dịch tội phạm mạng diện rộng như email lừa đảo và thư rác. Điều này làm lộ lỗ hổng của các bộ lọc bảo mật cũ vốn chỉ dựa vào phân tích văn bản hiển thị, buộc các tổ chức phải làm sạch dữ liệu văn bản đầu vào. Kỹ thuật này tận dụng các điểm mã Unicode vô hình, chẳng hạn như ký tự thẻ (tag characters) hoặc khoảng trắng độ rộng bằng 0, vốn được xử lý bởi các thuật toán bên dưới nhưng không hiển thị đối với người đọc. Kết quả là các công cụ bảo mật chỉ thấy chuỗi văn bản đã bị biến đổi để né tránh quy tắc phát hiện từ khóa, trong khi con người vẫn đọc được văn bản bình thường.
## KIẾN THỨC NỀN
ASCII smuggling lần đầu tiên thu hút sự chú ý của các nghiên cứu bảo mật như một phương thức tấn công prompt injection vào AI, nơi các ký tự ẩn được dùng để bí mật đưa câu lệnh độc hại vào các mô hình ngôn ngữ lớn (LLM) mà không làm người dùng nghi ngờ. Chuẩn Unicode bao gồm nhiều ký tự đặc biệt không in ra được thiết kế cho mục đích định dạng, hướng văn bản hoặc dữ liệu đặc tả cũ, vốn bị kẻ tấn công lợi dụng làm vật chở dữ liệu vô hình.