Anthropic cập nhật bộ lọc sinh học của Claude Fable 5 nhằm giảm từ chối nhầm
Anthropic đã cập nhật các biện pháp bảo vệ sinh học cho mô hình Claude Fable 5, giúp giảm khoảng 85% các trường hợp từ chối nhầm (false positive) trên các giao diện sản phẩm của mình. Bản cập nhật này cho phép mô hình hỗ trợ người dùng tốt hơn trong các câu hỏi thông thường về sức khỏe và giáo dục. Các rào cản an toàn AI thường gặp phải tình trạng từ chối quá mức, khiến các câu hỏi lành mạnh về khoa học hoặc y tế bị chặn do bộ lọc an toàn sinh học quá nghiêm ngặt. Bằng cách giảm mạnh tỷ lệ từ chối nhầm này, Anthropic cải thiện khả năng sử dụng của các mô hình tiên tiến cho học sinh, giáo viên và người dùng phổ thông. Bản cập nhật này nhắm mục tiêu cụ thể vào các lỗi chuyển hướng (fallback) liên quan đến sinh học, cho phép Claude Fable 5 xử lý phạm vi chủ đề rộng hơn. Ngược lại, các mô hình khác trong dòng sản phẩm, chẳng hạn như Claude Mythos 5, không sử dụng các bộ phân loại cụ thể này.
## KIẾN THỨC NỀN
Các mô hình AI được trang bị các biện pháp bảo vệ an toàn sinh học để ngăn chặn việc tạo ra thông tin sinh học độc hại, chẳng hạn như hướng dẫn tạo mầm bệnh. Tuy nhiên, các bộ phân loại này có thể quá nhạy cảm, dẫn đến việc chặn nhầm các câu hỏi y tế hoặc giáo dục vô hại. Claude Fable 5 là một mô hình tiên phong được thiết kế cho các tác vụ suy luận phức tạp và tự chủ.