~/LLMS/humorous-human-like-reasoning-trace-discovered-in-deepseek-flash-model

Phát hiện chuỗi suy luận hài hước giống con người của mô hình DeepSeek Flash

Một người dùng Reddit đã chia sẻ một chuỗi suy luận (reasoning trace) cực kỳ giống con người từ mô hình DeepSeek Flash, trong đó AI đã thốt lên "OH MY GOD. I THINK I FINALLY SEE IT!!!" trước khi tự sửa sai ngay lập tức. Điều này làm nổi bật một hành vi tự phát thú vị ở các mô hình suy luận được huấn luyện bằng học tăng cường (RL). Hành vi này cho thấy các mô hình suy luận hiện đại được huấn luyện bằng học tăng cường có thể bắt chước các mô hình nhận thức của con người, bao gồm cả những khoảnh khắc chợt nhận ra, các câu cảm thán và việc tự sửa lỗi ngay lập tức. Nó cung cấp cái nhìn sâu sắc về tính biểu cảm và tự nhiên của các chuỗi suy luận (Chain of Thought). Mô hình đang cố gắng giải quyết một vấn đề kỹ thuật liên quan đến mipmapping của đạo hàm UV và vị trí pixel khi tạo ra câu cảm thán này. DeepSeek Flash là một mô hình Mixture-of-Experts (MoE) được tối ưu hóa hiệu năng, thiết kế cho việc suy luận và suy đoán nhanh.

## KIẾN THỨC NỀN

Các mô hình suy luận lớn sử dụng "chuỗi suy luận" (reasoning traces) hoặc Chuỗi suy nghĩ (Chain of Thought) để ghi lại quá trình ra quyết định từng bước bên trong của chúng. Các chuỗi này thường bao gồm việc quay lui (backtracking), tự sửa sai và các tính toán trung gian, giúp mô hình giải quyết các vấn đề phức tạp nhưng cũng có thể dẫn đến việc tạo ra các văn bản giống con người một cách bất ngờ.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#LLMs#DeepSeek#Chain of Thought#AI Behavior

$ subscribe --daily

Phát hiện chuỗi suy luận hài hước giống con người của mô hình DeepSeek Flash | Daily News