~/AI ETHICS/anthropic-updates-usage-policy-to-ban-persistent-abuse-of-claude-and-restrict

Anthropic cập nhật chính sách sử dụng, cấm hành vi ngược đãi Claude và thắt chặt quy định vũ khí

Anthropic đã cập nhật chính sách sử dụng cho Claude, lần đầu tiên cấm rõ ràng các hành vi tàn nhẫn hoặc ngược đãi lặp đi lặp lại không cần thiết đối với mô hình AI. Bản sửa đổi này cũng thắt chặt các hạn chế đối với việc dùng Claude cho phần mềm điều khiển vũ khí, thiết bị tự hành trang bị vũ khí, giám sát không đồng thuận và đưa ra quyết định trong tư pháp hình sự. Cập nhật chính sách này tạo ra một tiền lệ mới trong quản trị AI khi giải quyết trực tiếp hành vi ngược đãi của người dùng đối với mô hình AI bên cạnh các rủi ro an toàn vật lý. Điều này nhấn mạnh sự lo ngại ngày càng tăng của ngành công nghệ đối với việc tích hợp các mô hình ngôn ngữ lớn vào chiến tranh tự động, công cụ giám sát và phần cứng quan trọng về an toàn. Biện pháp xử lý đối với chính sách chống ngược đãi chủ yếu là chấm dứt phiên hội thoại, ngoại trừ các trường hợp nghiên cứu hợp pháp, thử nghiệm mô hình, sáng tác chủ đề u tối và phản hồi thông thường. Ngoài ra, việc triển khai Claude kết nối với phần cứng tự động hóa vật lý hiện yêu cầu phải có người vận hành đủ năng lực giám sát để dừng hoạt động khi cần thiết.

## KIẾN THỨC NỀN

Anthropic là công ty nghiên cứu và an toàn AI nổi tiếng với việc phát triển dòng mô hình ngôn ngữ lớn Claude, chú trọng vào sự căn chỉnh đạo đức. Khi năng lực của AI ngày càng mở rộng, các nhà phát triển AI hàng đầu thiết lập các điều khoản dịch vụ nhằm ngăn chặn các ứng dụng kép nguy hiểm, chẳng hạn như phát triển vũ khí tự động hoặc giám sát hàng loạt xâm phạm quyền riêng tư.

## TỪ KHÓA

#AI Ethics#Anthropic#Claude#AI Policy#AI Governance

$ subscribe --daily

Anthropic cập nhật chính sách sử dụng, cấm hành vi ngược đãi Claude và thắt chặt quy định vũ khí | Daily News