Hacker mũ trắng dùng Claude của Anthropic xâm nhập hệ thống tài khoản nội bộ OpenAI
Các nghiên cứu viên bảo mật từ Hacktron AI đã sử dụng mô hình Claude của Anthropic để tìm và khai thác lỗ hổng trên Discourse (CVE-2026-45788), giúp họ thu thập các token phiên làm việc nhằm truy cập vào tài khoản ChatGPT của nhân viên OpenAI và tài liệu nội bộ. Sau khi báo cáo lỗ hổng có trách nhiệm, nhóm nghiên cứu đã được OpenAI trao khoản tiền thưởng 6.500 USD. Sự cố này làm nổi bật cách các công cụ AI hiện đại có thể hạ thấp rào cản kỹ thuật trong việc phát hiện lỗ hổng và tự động hóa tấn công mạng. Nó cũng cho thấy rủi ro hệ thống khi token xác thực của phần mềm bên thứ ba bị cấp thừa quyền hạn trên các hạ tầng doanh nghiệp quan trọng. Điểm xâm nhập ban đầu là lỗ hổng tải tệp lên không cần xác thực trên Discourse làm rò rỉ token người dùng, các token này bất ngờ có quyền xác thực trên dịch vụ ChatGPT của OpenAI và siêu dữ liệu kho mã nguồn GitHub nội bộ. OpenAI sau đó đã thu hồi các token bị ảnh hưởng, thu hẹp phạm vi quyền hạn của token Discourse và điều động khoảng 25% kỹ sư sản xuất tập trung gia cố hạ tầng bảo mật.
## KIẾN THỨC NỀN
Các chương trình nhận diện lỗ hổng nhận thưởng (bug bounty) cung cấp hành lang pháp lý an toàn (safe harbor) và phần thưởng tài chính cho hacker mũ trắng báo cáo lỗ hổng an toàn thay vì khai thác bất hợp pháp. Các công ty phần mềm thường dùng hệ thống Đăng nhập một lần (SSO) để quản lý truy cập trên các nền tảng bên thứ ba như diễn đàn Discourse, nhưng việc phân quyền token không nghiêm ngặt có thể vô tình làm rò rỉ các hệ thống nội bộ.