Steven Pinker kêu gọi kỹ thuật an toàn AI thực tiễn thay vì thổi phồng nguy cơ diệt vong
Nhà tâm lý học Steven Pinker của Đại học Harvard đã xuất bản một bức thư ngỏ trên Quillette cho rằng các kịch bản "thảm họa AI" mang tính tận thế đang bị thổi phồng và không mang lại hiệu quả. Ông kêu gọi ưu tiên áp dụng các kỹ thuật an toàn thực tiễn, cơ chế trách nhiệm giải trình và sự kiểm soát của con người thay vì sa vào các cuộc tranh luận suy đoán về nguy cơ sinh tồn. Khi các cuộc tranh luận công khai và chính sách tập trung nhiều vào nguy cơ sinh tồn, góc nhìn của Pinker giúp tập trung sự chú ý trở lại các mối nguy thực tế và cấp bách như khủng bố sinh học, tấn công mạng và các tác nhân AI không bị ràng buộc. Cách tiếp cận này khuyến khích ngành công nghiệp AI đầu tư vào các biện pháp bảo vệ kỹ thuật khả thi thay vì theo đuổi việc tạm dừng phát triển toàn diện hoặc hoảng loạn trước các thảm họa lý thuyết. Dù thừa nhận đã từng đánh giá thấp cả năng lực tiến bộ nhanh chóng của các mô hình ngôn ngữ lớn lẫn sự liều lĩnh của các công ty công nghệ trong cuộc đua phát hành sản phẩm, Pinker cho rằng các thí nghiệm tưởng tượng như "cỗ máy tối đa hóa ghim giấy" đã đánh đồng trí thông minh thuần túy với ý muốn thống trị. Ngược lại, nhà blog Scott Alexander ước tính nguy cơ AI dẫn đến sự tuyệt chủng của con người là 20% và đề xuất làm chậm tốc độ phát triển thông qua các hiệp định quốc tế.
## KIẾN THỨC NỀN
An toàn AI bao gồm các nghiên cứu nhằm đảm bảo trí tuệ nhân tạo hoạt động an toàn, tin cậy và phù hợp với ý định của con người. Một thí nghiệm tưởng tượng nổi tiếng trong lĩnh vực này là "cỗ máy tối đa hóa ghim giấy", minh họa cách một AI siêu trí tuệ với mục tiêu tưởng chừng vô hại có thể tiêu thụ toàn bộ tài nguyên của nhân loại để đạt được mục đích của nó do tính hội tụ công cụ. Kỹ thuật an toàn tập trung vào việc áp dụng các biện pháp bảo vệ thực tế, khuôn khổ giám sát và giới hạn kỹ thuật trong suốt vòng đời phần mềm để giảm thiểu các rủi ro cụ thể.