~/OPENAI/openai-s-project-lily-leaked-human-reviewers-read-chatgpt-logs-for-model

Rò rỉ Project Lily của OpenAI: Nhân viên đọc nhật ký ChatGPT để tinh chỉnh mô hình

Báo cáo rò rỉ từ 404 Media tiết lộ sáng kiến nội bộ của OpenAI mang tên "Project Lily", trong đó nhân viên đối tác đọc và chấm điểm các nhật ký hội thoại ChatGPT thực tế. Với mức thù lao hơn 50 USD/giờ, các nhân viên này đánh giá chất lượng phản hồi nhằm loại bỏ giọng văn cứng nhắc và nịnh hót, dù bộ lọc ẩn danh đôi khi vẫn làm lọt các dữ liệu cá nhân nhạy cảm. Sự việc làm nổi bật rủi ro nghiêm trọng về quyền riêng tư, khi nhiều người dùng tâm sự các bí mật cá nhân với ChatGPT mà không biết rằng con người có thể đọc chúng. Nó cũng cho thấy quá trình tinh chỉnh và định hướng LLM vẫn phụ thuộc rất nhiều vào lao động thủ công của con người chứ không hoàn toàn nhờ nâng cấp kỹ thuật tự động. Các nhân viên chấm điểm phản hồi dựa trên quy định chi tiết cấm AI tự nhận có trải nghiệm cá nhân hay tỏ thái độ lên mặt dạy đời, kèm theo bản tóm tắt bộ nhớ người dùng chứa bối cảnh và có thể cả thông tin vị trí. Hơn nữa, việc tắt chia sẻ dữ liệu sau này không có tác dụng xóa hồi truy những đoạn hội thoại đã bị thu thập vào tập dữ liệu trước đó.

## KIẾN THỨC NỀN

Các mô hình ngôn ngữ lớn dựa vào phương pháp Học tăng cường từ phản hồi của con người (RLHF) để tinh chỉnh câu trả lời của AI phù hợp với kỳ vọng của người dùng về văn phong và độ hữu ích. Hầu hết các nền tảng AI đều mặc định bật tính năng thu thập dữ liệu ở các gói người dùng cá nhân, nhưng mặc định tắt đối với các tài khoản doanh nghiệp và giáo dục.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#OpenAI#LLM#Data Privacy#AI Ethics#RLHF

$ subscribe --daily