Rò rỉ prompt hệ thống của Claude Opus 5 trên GitHub, hé lộ 34.000 token chỉ dẫn
Một nhà phát triển đã rò rỉ toàn bộ prompt hệ thống của Claude Opus 5 trên GitHub, phơi bày tập lệnh hướng dẫn đồ sộ dài khoảng 34.000 token. Bản rò rỉ này tiết lộ chi tiết các quy tắc nội bộ của Anthropic về cách sử dụng công cụ, tuân thủ pháp lý và quản lý bộ nhớ liên phiên làm việc. Lần rò rỉ này cung cấp cho các nhà nghiên cứu AI và kỹ sư prompt cái nhìn trực tiếp, hiếm hoi về cách Anthropic cấu trúc các chỉ dẫn phức tạp để mô hình hàng đầu của họ xử lý vấn đề an toàn, quyền riêng tư và bộ nhớ. Nó làm nổi bật kỹ thuật phức tạp cần thiết để ngăn chặn các mô hình AI phát triển sự phụ thuộc không lành mạnh từ người dùng hoặc lưu trữ dữ liệu cá nhân nhạy cảm. Prompt này chứa phần memory_filesystem dài 230 dòng, giới hạn Claude chỉ được lưu trữ các sự thật do người dùng trực tiếp cung cấp dưới nhãn [stated], đồng thời cấm tự suy luận, lưu chẩn đoán sức khỏe hay tên riêng của người thân. Ngoài ra, tài liệu cũng cấm mô hình sử dụng một số từ cụ thể như "genuinely" và "honestly" để duy trì giọng điệu chuyên nghiệp.
## KIẾN THỨC NỀN
Prompt hệ thống (system prompt) là các chỉ dẫn nền tảng do nhà phát triển thiết lập để định hướng hành vi, giọng điệu và các ràng buộc của Mô hình ngôn ngữ lớn (LLM) trước khi phiên trò chuyện của người dùng bắt đầu. Token là các đơn vị văn bản cơ bản (ký tự hoặc cụm từ phụ) mà LLM xử lý, trong đó số lượng token lớn hơn biểu thị tập hợp chỉ dẫn phức tạp và chi tiết hơn.