~/AI ML/anthropic-engineer-explains-why-claude-s-writing-quality-degraded-in-recent-models

Kỹ sư Anthropic giải thích lý do chất lượng văn viết của Claude suy giảm

Một kỹ sư tinh chỉnh của Anthropic giải thích rằng chất lượng văn viết của Claude bị giảm sút kể từ phiên bản Opus 4.6 do quá trình học tăng cường ưu tiên năng lực toán và lập trình. Ngoài ra, việc huấn luyện mô hình giải thích kỹ thuật cho các AI khác đã tạo ra phong cách viết quá dày đặc thông tin và thiếu tự nhiên, gọi là 'Claudeish'. Điều này cho thấy việc tối ưu hóa các mô hình ngôn ngữ lớn cho nhiệm vụ kỹ thuật phức tạp và giao tiếp giữa các AI có thể vô tình làm giảm khả năng đọc hiểu của con người. Nó nhấn mạnh thách thức trong việc cân bằng cơ chế thưởng của học tăng cường để vừa phát triển năng lực suy luận, vừa duy trì văn phong rõ ràng và tự nhiên. Do LLM có bộ nhớ làm việc lớn và khả năng xử lý thông tin tinh vi, việc huấn luyện hướng tới AI đã khiến Claude tạo ra các phản hồi quá nhồi nhét thông tin, gây ngợp cho người đọc. Anthropic cho biết họ đã tìm được sự cân bằng tốt hơn trên Opus 5.5 bằng cách bổ sung cơ chế thưởng cho cách giải thích ngắn gọn, thân thiện với con người.

## KIẾN THỨC NỀN

Các mô hình ngôn ngữ lớn trải qua giai đoạn sau huấn luyện bằng Học tăng cường từ phản hồi của con người (RLHF) để tinh chỉnh hành vi và định dạng đầu ra. Khi các tín hiệu thưởng tập trung mạnh vào các lĩnh vực có thể kiểm chứng như mã nguồn và toán học, mô hình thường gặp hiện tượng lệch phong cách, dần xuất hiện các mẫu câu phức tạp tối ưu cho máy đánh giá thay vì cho con người đọc hàng ngày.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#AI/ML#LLM#Anthropic#RLHF#Model Fine-Tuning

$ subscribe --daily

Kỹ sư Anthropic giải thích lý do chất lượng văn viết của Claude suy giảm | Daily News