~/AI WATERMARK/developers-create-bypass-tools-following-anthropic-s-ai-text-watermarking-release

Các nhà phát triển tạo công cụ lách luật sau khi Anthropic ra mắt thủy vân văn bản AI

Sau khi Anthropic áp dụng công nghệ thủy vân thống kê (statistical watermarking) trên các mô hình Claude để tuân thủ Đạo luật AI của EU, các nhà phát triển đã nhanh chóng phát hành các công cụ nguồn mở và trực tuyến nhằm xóa bỏ các dấu vết vô hình này. Các công cụ như "Watermarks Remover" và "MarkScrub" hoạt động bằng cách loại bỏ các mô hình thống kê được nhúng trong văn bản do AI tạo ra. Phản ứng nhanh chóng này làm nổi bật cuộc rượt đuổi "mèo vờn chuột" đang diễn ra trong quản trị AI, nơi các biện pháp an toàn kỹ thuật nhanh chóng bị đối phó bởi các cơ chế lách luật. Nó cũng phơi bày một vùng xám pháp lý theo Đạo luật AI của EU, vốn bắt buộc các nhà cung cấp AI phải gắn thủy vân nhưng không cấm rõ ràng các bên thứ ba gỡ bỏ chúng. Thủy vân của Anthropic không dựa trên các ký tự ẩn mà dựa trên các mô hình thống kê trong cách lựa chọn từ ngữ, điều mà các công cụ gỡ bỏ cố gắng phá vỡ bằng cách viết lại hoặc diễn đạt lại văn bản nhưng vẫn giữ nguyên ý nghĩa. Mặc dù Anthropic có kế hoạch phát hành API phát hiện văn bản, các chuyên gia lưu ý rằng các công cụ phát hiện công khai sẽ giúp các nhà phát triển dễ dàng thử nghiệm và cải tiến công cụ xóa thủy vân của họ hơn.

## KIẾN THỨC NỀN

Thủy vân văn bản thống kê (statistical text watermarking) là một kỹ thuật mà trong đó mô hình ngôn ngữ lớn (LLM) điều chỉnh nhẹ việc lựa chọn từ ngữ trong quá trình tạo văn bản theo một mô hình giả ngẫu nhiên. Điều này tạo ra một chữ ký thống kê tinh vi giúp phần mềm được ủy quyền có thể phát hiện xem văn bản đó có phải do AI tạo ra hay không, mà không ảnh hưởng đến khả năng đọc hiểu của con người.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#AI Watermarking#Anthropic#AI Safety#Large Language Models

$ subscribe --daily

Các nhà phát triển tạo công cụ lách luật sau khi Anthropic ra mắt thủy vân văn bản AI | Daily News