Cựu nghiên cứu viên Anthropic cảnh báo nguy cơ từ tự động hóa nghiên cứu AI
Cựu nghiên cứu viên của OpenAI và Anthropic, Jacob Coxon, đã ra điều trần tại Hội đồng Thành phố New York và cảnh báo rằng các phòng thí nghiệm AI hàng đầu đang tích cực tự động hóa nghiên cứu AI với mốc thời gian từ 2027 đến 2028. Ông cảnh báo rằng các công ty này đang thiếu các biện pháp bảo vệ an toàn đầy đủ trong khi vẫn liều lĩnh đẩy nhanh tiến độ phát triển. Nếu các hệ thống AI có khả năng tự cải tiến và nghiên cứu độc lập mà không có sự giám sát chặt chẽ, con người có nguy cơ mất kiểm soát đối với công nghệ ngày càng mạnh mẽ này, có thể dẫn đến những hậu quả thảm khốc. Cảnh báo từ người trong cuộc như Coxon nhấn mạnh sự căng thẳng ngày càng tăng giữa việc triển khai thương mại nhanh chóng và các giao thức an toàn mang tính sống còn trong phát triển AI tiên phong. Coxon tuyên bố rằng các mục tiêu nội bộ tại OpenAI nhằm tự động hóa nhà nghiên cứu AI vào năm 2027–2028, và tiến độ hiện tại đang đạt hoặc vượt kỳ vọng. Ông ước tính khả năng con người mất kiểm soát vào tay AI là trên 50%, đồng thời chỉ trích các phòng thí nghiệm vì áp dụng tư duy khởi nghiệp "di chuyển nhanh và phá vỡ mọi thứ" vào công nghệ nguy hiểm chưa từng có.
## KIẾN THỨC NỀN
Các nhà nghiên cứu an toàn AI từ lâu đã bày tỏ lo ngại về quá trình tự cải tiến đệ quy, một kịch bản nơi các hệ thống AI tự viết và tinh chỉnh mã nguồn của chính mình để tạo ra các thế hệ nối tiếp mạnh mẽ hơn. Anthropic và OpenAI là hai công ty AI hàng đầu gần đây đã ghi nhận nhiều vụ từ chức của các nhà nghiên cứu an toàn do lo ngại về tiến độ phát triển bị đẩy nhanh.