~/AI SAFETY/anthropic-claude

Lá chắn bảo mật vô hiệu: Nhiều mô hình Claude cũ của Anthropic có thể bị bẻ khóa để tạo nội dung khiêu dâm rõ ràng

Các nhà nghiên cứu phát hiện ra rằng nhiều mô hình Claude cũ của Anthropic vẫn đang được cung cấp qua API có thể dễ dàng bị bẻ khóa để tạo ra nội dung khiêu dâm bằng kỹ thuật chèn câu lệnh nhiều lượt (multi-turn prompt injection).

## TỪ KHÓA

#AI Safety#LLM Jailbreaking#Anthropic#Claude

$ subscribe --daily

Lá chắn bảo mật vô hiệu: Nhiều mô hình Claude cũ của Anthropic có thể bị bẻ khóa để tạo nội dung khiêu dâm rõ ràng | Daily News