OpenAI bị cáo buộc dùng đoạn chat riêng tư của nhà toán học để sao chép nghiên cứu
Hai nhà toán học cáo buộc OpenAI đã sử dụng các đoạn chat Codex riêng tư và bản thảo nghiên cứu của họ để sao chép và công bố một đột phá toán học lớn ngay trước khi họ kịp xuất bản. Khi được hỏi trực tiếp liệu các tương tác riêng tư của người dùng có được sử dụng để huấn luyện mô hình hay không, OpenAI đã từ chối trả lời. Vụ việc này làm nổi bật những rủi ro lớn về sở hữu trí tuệ và quyền riêng tư khi sử dụng các LLM thương mại trên đám mây, nơi dữ liệu nghiên cứu nhạy cảm có thể bị lưu trữ hoặc khai thác. Điều này thúc đẩy xu hướng các nhà nghiên cứu chuyển sang tự chạy các mô hình mã nguồn mở trên phần cứng nội bộ để bảo vệ dữ liệu. Theo tuyên bố chính thức từ một nhà nghiên cứu tại Đại học NYU, họ đã dành hơn một năm giải quyết bài toán phức tạp và nhập các bước trung gian vào OpenAI Codex. OpenAI sau đó ra mắt các giải pháp trùng khớp ngay trước khi bài báo của các nhà nghiên cứu được xuất bản chính thức, làm dấy lên nghi vấn về việc lưu trữ và khai thác dữ liệu người dùng.
## KIẾN THỨC NỀN
OpenAI Codex là một công cụ và hệ sinh thái mô hình được xây dựng để hỗ trợ viết mã và giải quyết các bài toán phân tích phức tạp. Các dịch vụ AI trên điện toán đám mây thường xử lý dữ liệu đầu vào trên máy chủ từ xa, gây ra nhiều tranh cãi về việc dữ liệu prompt của người dùng có thể bị dùng để huấn luyện các phiên bản mô hình tiếp theo nếu không có các chính sách bảo mật doanh nghiệp nghiêm ngặt.