Bài đăng Reddit gây xôn xao cho rằng ảo giác AI suýt dẫn đến cuộc tấn công quân sự của Mỹ
Một bài đăng trên subreddit r/LocalLLaMA đã lan truyền tuyên bố giật gân rằng một ảo giác của AI liên quan đến các linh kiện hạt nhân Trung Quốc suýt dẫn đến một cuộc tấn công quân sự từ phía Mỹ. Tuy nhiên, bài đăng này thiếu thông tin kỹ thuật, nguồn tin xác minh cũng như nội dung chi tiết đi kèm. Mặc dù tin đồn chưa được xác minh này thiếu bằng chứng, nó vẫn phản ánh sự lo ngại ngày càng tăng về rủi ro khi tích hợp các mô hình AI tạo sinh vào hệ thống quốc phòng và quy trình ra quyết định. Điều này nhấn mạnh tầm quan trọng cấp thiết của việc con người phải giám sát chặt chẽ trước khi dựa vào kết quả của AI trong các lĩnh vực có độ rủi ro cao. Bài đăng nhận được điểm đánh giá thấp về chất lượng do chỉ đưa ra tiêu đề gây chú ý mà không cung cấp tài liệu gốc hay phân tích kỹ thuật. Ảo giác AI xảy ra khi các mô hình đưa ra thông tin nghe có vẻ hợp lý nhưng lại hoàn toàn sai sự thật, làm cho các đầu ra AI chưa được kiểm chứng trở nên đặc biệt nguy hiểm trong phân tích tình báo.
## KIẾN THỨC NỀN
Các mô hình ngôn ngữ lớn (LLM) hoạt động theo cơ chế xác suất bằng cách dự đoán các từ tiếp theo dựa trên dữ liệu huấn luyện thay vì truy cập sự thật khách quan. Do đó, mô hình có thể gặp hiện tượng 'ảo giác'—đưa ra các thông tin sai lệch nhưng với văn phong rất tự tin. Việc giảm thiểu rủi ro này thường đòi hỏi các kỹ thuật như Retrieval-Augmented Generation (RAG) và Reinforcement Learning from Human Feedback (RLHF) để buộc AI phải dựa trên dữ liệu đáng tin cậy.