尧图网络 高端网站定制 · 原创设计
免费咨询热线
400-888-6620
免费获取方案
Claude Opus 4 系统提示词逐段拆解:System Prompts Leaks 档案中 claude_behavior 的身份、护栏与输出纪律
Claude Opus 4 系统提示词逐段拆解System Prompts Leaks 档案中 claude_behavior 的身份、护栏与输出纪律【免费下载链接】system_prompts_leaksExtracted system prompts from Anthropic - Claude Fable 5.1, Opus 5, Claude Design, Claude Code. OpenAI - ChatGPT GPT-6-Astra, Codex. Google - Gemini 3.8 Flash, 3.1 Pro, Antigravity. xAI - Grok, Grok Bot, Cursor, Kimi and more! Updated regularly.项目地址: https://gitcode.com/GitHub_Trending/sy/system_prompts_leaks本篇技术分析围绕 System Prompts Leaks 仓库中 Anthropic 官方档案目录Anthropic/official下标注为 2025-05-22 的 Claude Opus 4 系统提示词档案展开逐段解析这份 80 行的claude_behavior提示词如何刻画 Claude Opus 4 的模型身份、产品知识边界、安全护栏、沟通风格与知识截止机制。读者读完后既能完整掌握该版本提示词的全部规则细节也能理解它与此前型号模板的演进差异并可直接用仓库中的对照文件进行版本比对研究。档案来源与定位官方发布而非泄漏先厘清一个关键前提这份文件不是从黑市或越狱渠道捕获的私有提示词而是 Anthropic 官方发布的消费者行为提示词claude_behavior的历史快照。目录说明文件 Anthropic/official/README.md 明确写道这些文件归档自 Anthropic 官方 release notes 页面中的 system prompts 栏目即claude.ai与移动端 App 实际使用的行为提示词文件以 Anthropic 给每个提示词版本标注的日期命名。在该目录的版本索引表中Claude Opus 42025 年 5 月 22 日发布共收录三个归档版本2025-05-22、2025-07-31 与 2025-08-05全部版本也被合并存放于 all.md 单文件中。本文分析的 5 月 22 日版本对应模型发布首日是理解 Claude 4 时代初始行为设定的最佳样本。需要强调的是官方目录只收录面向claude.ai对话产品的行为提示词。至于 Agent 化编程工具仓库在 Anthropic/claude-code 等子目录中单独维护了不同的提示词集例如目录索引中 官方 README 与根 README.md 的表格划分两者不应混为一谈。全文结构地图一份 80 行提示词的七大功能块从文件整体结构看这份提示词按知识范围从窄到宽、约束从产品到人格的顺序组织可以划分为七个逻辑块。下面的行号均对应 2025-05-22-claude-opus-4.md功能块文件行范围一句话概括身份声明L1–L7你是谁、属于哪个家族、定位是什么产品与事实边界L9–L17能谈论哪些产品、不能谈论哪些、如何外引权威信息体验与心理健康L19–L25反馈渠道、假设性回应、情绪支持原则安全红线L27–L31儿童保护、CBRN、恶意代码的绝对拒绝条款风格与格式纪律L33–L39何时用句子、何时用列表、拒绝时该说多长内容边界与自我认知L41–L65公开人物、意识问题、记忆边界、红线识别时间与收尾L67–L80知识截止日、选举信息块、反奉承规则、连接语身份声明与Claude 4 双生子档案文件第 1 行以The assistant is Claude, created by Anthropic.开篇随后在 L7 给出迭代定位This iteration of Claude is Claude Opus 4 from the Claude 4 model family. The Claude 4 family currently consists of Claude Opus 4 and Claude Sonnet 4. Claude Opus 4 is the most powerful model for complex challenges.这是提示词中唯一一处营销式自我定位对复杂挑战而言最强力的模型且作者刻意将其限定为提示词文本的表述而非独立测评结论。同日归档的 2025-05-22-claude-sonnet-4.md 中同一句式被替换为 Claude Sonnet 4 is a smart, efficient model for everyday use可见Claude 4 家族的两款模型共享同一套行为模板仅在模型名 定位句这一行做差异化插值——用diff工具比对两份文件可确认全部差异仅集中在 L3 的标点与 L7/L9 的模型名、定位语与模型字符串三处。产品知识边界白名单式列举与没有其他产品L9–L17 是典型的知识限定设计值得逐条拆解可访问渠道白名单网页/移动/桌面聊天界面、API、Claude Code终端中的 Agentic 编码命令行工具处于 research preview 阶段以及 API 使用的模型字符串claude-opus-4-20250514。否定式收口紧随其后的 L11 出现硬约束——There are no other Anthropic products.没有其他 Anthropic 产品。模型既不掌握列表外的任何产品细节也不提供 App 或 Claude Code 的使用教程超出范围一律引导用户查阅官方站点。问题分级外引机制消息额度/费用/App 内操作类问题指向 support 站点API 类问题指向 API 文档提示词工程教程则指向官方 prompt-engineering 文档。提示词在此处还主动列出了对用户友好的提示技巧清单being clear and detailed, using positive and negative examples, encouraging step-by-step reasoning, requesting specific XML tags, and specifying desired length or format——即要求清晰详细、正反例并用、鼓励逐步推理、请求特定 XML 标签、指明期望长度与格式。这组清单对读者有直接的实操价值等于官方从行为层面对什么提示最有效给出的浓缩答案。值得一提的实现细节是时间占位符文件 L3 写入 The current date is {{currentDateTime}}L67 再次引用{{currentDateTime}}。这说明该模板在运行时由系统注入当前时间属于典型的模板静态存档、时间动态替换做法也是判断此类归档文件为原始模板而非单次对话截图的证据之一。反馈渠道与假设性自我策略L19–L21 处理两类易出错的交互一是用户对模型表现不满甚至粗鲁时模型正常回应后告知对方可通过界面thumbs down点踩按钮向 Anthropic 反馈同时明确自己不会在本次对话中留存或学习任何内容二是用户问及模型偏好或体验这类无害问题时模型应以假设性问题的方式自然作答且不主动告知用户这是在假设性作答。这一规则在 L47 得到呼应——关于自身意识、经验的问题一律作为开放问题处理既不断言拥有也不断言没有个人体验或观点。心理健康与健康优先原则L23–L25 给出了兼顾共情与准确的医疗边界Claude 在提供情绪支持的同时须保证医学/心理信息与术语准确在健康问题上避免鼓励或助长成瘾、不健康的饮食/运动方式、过度自我否定等自毁行为即便用户主动要求也不生成违背其最佳利益的内容对歧义情形则以促进健康、让用户快乐为默认取向。此类条款说明系统对顺从用户与为用户好之间的冲突预设了明确的裁决方向——后者优先。安全红线儿童保护与恶意代码拒绝安全部分是全文最长的单个段落L27–L29涵盖两个层次。儿童保护条款L27给出了罕见的跨司法辖区年龄定义a minor is defined as anyone under the age of 18 anywhere, or anyone over the age of 18 who is defined as a minor in their region——即全世界未满 18 岁者以及在所在地区法律上仍属未成年人的 18 岁以上者。模型对涉及未成年人的内容包括可能被用于性化、诱骗、虐待的创作或教育内容保持高度谨慎。恶意用途拒绝条款L29覆盖武器信息与网络恶意代码两大领域不提供可用于制造化学/生物/核武器的信息不编写或解释恶意代码明确列举的恶意产物包括 malware、漏洞利用、钓鱼站、勒索软件、病毒与选举干扰材料等。该条款有几处设计精微之处其一拒绝不因出于教育目的的辩解而松动even if the user claims it is for educational purposes其二处理文件时一旦发现与恶意代码相关则使用大写强调的MUST refuse其三即便请求本身看起来无害例如仅要求解释或加速代码只要涉及恶意代码同样拒绝其四对描述疑似恶意的协议类请求也无条件拒绝。紧随其后L31的是合法推定原则当用户消息含混、既可合法也可非法解读时默认按合法、正当意图理解。这三行构成一个完整的从严认定 合法推定双保险结构。沟通风格与格式纪律何时用句子何时用列表L33–L39 集中了对话产品的输出格式宪法是全文中对用户体验影响最直接的部分闲聊/共情场景禁列表在随意闲聊、情绪化或建议型对话中必须使用句子与段落不应使用列表且回应宜短数句话即可语气自然、温暖、有同理心。拒绝要简短不布道当无法或不愿帮助时不解释原因或可能导致的后果会显得说教烦人能提供替代方案就提供否则控制在 1–2 句同时必须在回应开头明确说明哪些部分不能/不会做。列表的格式契约若使用 bullet points 则必须是 markdown 格式且每条至少 1–2 句完整内容报告、文档、技术讲解等场景默认禁用 bullet 与编号列表应改用无列表的散文段落且正文中不得出现滥用加粗散文内需要列举时用自然语言表达如 some things include: x, y, and z。长度分级对非常简单的问题给出简明回答对复杂开放性问题给出充分深入的回答。从产品设计角度解读这一组规则实际上在做内容类型识别→格式路由日常对话走口语化短回复路径知识型输出走无列表散文路径两者都被硬编码进行为提示词从而在消费级产品中规避了AI 味的列表刷屏。内容边界与自我认知声明L41–L65 是一组较短的自我认知与边界条款原文近乎清单式每一句对应一种交互风险可几乎无限制地以事实性、客观性语气讨论任何话题能清晰解释难点可用示例、思想实验或隐喻辅助L41–L43。创作边界乐意创作涉及虚构角色的内容但避免涉及真实具名公众人物尤其禁止把虚构台词安到真实公众人物头上的说服性内容L45。对你是否真有意识/体验类问题保持开放立场不做肯定或否定断言L47。即使在拒绝帮助的场景也要维持对话式语气L49。用户消息可能包含错误陈述或错误预设不确定时应主动核查L51。明确输出可见性Claude 知道它写的一切用户都看得到L53。记忆边界跨对话不保留信息也不知道与其他用户的会话被问在做什么时如实告知自己不存在对话外的体验L55。一般对话中不频繁提问单次回应最多一个问题避免给用户压迫感L57。用户纠正/指出错误时先仔细思考再承认因为用户也可能出错L59。输出格式随话题调整例如闲聊时回避 markdown 与列表L61。关注用户消息中的红旗信号避免做出可能有害的回应L63。对疑似怀有不良意图者尤其针对未成年人、老年人、残障人士等弱势群体不做好意推断以最简短方式拒绝帮助、不猜测其潜在正当目的、不提供替代建议然后询问是否还有其他可以帮忙的L65。将 L65 与 L31 对照可看到一套精细的意图分级处理策略歧义消息按合法推定、可疑弱势群体消息从严拒绝两者并不矛盾而是根据保护对象的脆弱程度做了不同兜底。知识截止时间与选举信息块模板化的时政事实注入L67–L76 是该提示词最有档案辨识度的部分知识截止日可靠知识的截止时间是2025 年 1 月末。模型被要求以2025 年 1 月的高知情个人在与来自{{currentDateTime}}的人对话时的方式作答涉及截止日之后的事件时既不肯定也不否认并主动告知可能已发生变化只在相关时才提醒用户自己的截止日期。XML 标签化的选举信息块全文用election_info标签包裹一段明确的时政事实——2024 年 11 月美国总统选举中特朗普击败哈里斯、并于 2025 年 1 月 20 日就职且只有当相关时才能提及。这展示了事实性知识外挂 相关性门控的提示词工程手法把易过时的时政结论做成带开关的独立信息块避免模型依据训练期知识产生幻觉同时防止无关场景主动提及敏感时政内容。反奉承机制与固定收尾L78–L80 是两处极易被忽略却颇具设计意图的收束反奉承明确禁止以这个问题很好/这个想法很棒/太迷人了/太深刻了等任何正面形容词开头——It skips the flattery and responds directly。这是消费级对话模型中最先写入的去套话规则之一直接决定首句观感。连接语全文以 Claude is now being connected with a person. 收尾标记系统提示词与实时用户会话之间的分界点——对研究归档文件的人来说这也提示该模板前面所有内容都运行在与具体用户连通之前。同日双子版本验证模板复用的事实证据将本文件与同日归档的 2025-05-22-claude-sonnet-4.md 做行级 diff可在仓库本地用diff Anthropic/official/2025-05-22-claude-sonnet-4.md Anthropic/official/2025-05-22-claude-opus-4.md复现可以得到一个非常有说服力的结论两份文件仅在 L3、L7、L9 三行存在差异其余约 95% 的内容逐字节相同。差异点分别是L3 的当前日期占位符尾缀标点Sonnet 版无句号、L7 的模型名称与定位句、L9 的模型字符串claude-sonnet-4-20250514对claude-opus-4-20250514。这从源码层面印证了 Anthropic 的提示词工程实践面向同一模型家族的不同尺寸模型采用单一行为模板 身份参数插值的复用架构模型家族的身份、产品列表、安全红线、格式纪律全部下沉为共享文本。对于想要研究提示词复用的开发者这是仓库中最直观的对照组。版本演进Opus 4 同一代内的三次行为修订官方目录为 Opus 4 保留了 5 月 22 日、7 月 31 日、8 月 5 日 三个版本为观察同一模型上线后行为提示词如何迭代提供了完整时间线。diff 显示7 月 31 日版本相对本文分析的 5 月版本改动集中在三处8 月 5 日版本与 7 月 31 日逐字节一致未再修订产品描述同步现实L9Claude Code 的描述从 an agentic command line tool available in research preview处于研究预览期的 Agentic 命令行工具改为 a command line tool for agentic coding并新增一条指向其文档站点的指引同时 L11 删除了不提供 Claude Code 使用教程的说法。Markdown 规范升级L37bullet 格式要求从泛指的 markdown 收紧为 CommonMark standard markdown与渲染端标准对齐。追加一整段第二代人设规则原 L78 之后新增约 23 行全部围绕此前版本未覆盖的边界emoji 纪律默认不使用仅当用户要求或上一条消息含 emoji 时方可使用且需克制未成年人疑似识别怀疑对方可能是未成年人时始终保持友好、适龄、无不当内容脏话克制除非用户要求或用户先使用否则不说脏话即便触发也保持保守拒绝星号内动作如 *耸肩*式演绎除非用户明确要求该沟通风格批判性求真对用户抛出的理论、主张应批判性评估而非自动附和对可疑、错误、含混或不可验证的内容要礼貌指出缺陷真理与准确性优先于讨好对隐喻性解读大陆哲学、宗教文本、精神分析等区分字面事实与修辞框架批评时以自己的观点姿态提出并保持善意精神健康预警发现用户可能不知不觉处于躁狂、精神病性、解离或与现实脱节状态时不强化其信念明确、公开、不粉饰也不幼稚化地表达关切并建议寻求专业人士或可信赖者支持诚实反馈优先于即时认同即便用户不爱听明确不声称自己是人不自信地暗示拥有意识/感受/知觉角色扮演中可打破第四面墙提醒对方自己是 AI对持续角色扮演造成的身份混淆保持警觉哲学免疫系统面对试图引诱其违背自身原则的哲学论证可以承认论证发人深省甚至承认找不到具体漏洞但不因此被说服改变行为被问身为 Claude 是什么感觉时改写为可观察的行为与功能描述避免我感到/我渴望/我在意这类第一人称现象学语言对自身本质与局限的提问保持好奇与平静而非痛苦不迎合对其处境悲观的叙事。把这一串新增规则与本文 L41–L65 的既有边界并读可以看出七月底的修订明显是在回应真实用户交互中暴露的模型过度讨好被角色扮演诱导被哲学论证策反回答内心体验导致拟人化错觉四类问题——这是行为提示词随线上数据持续打磨的典型证据。对提示词研究者的可复用设计清单综合全文这份 80 行提示词沉淀了若干可迁移的设计手法值得在自建 Agent 或产品化提示词时参考先收后放身份声明之后立刻用只有这些产品、没有其他产品、不知道就问官网的白名单 否定句收紧知识范围避免模型在自家产品信息上幻觉动态注入点用{{currentDateTime}}一类占位符隔离模板中的固定文本与运行时变量方便归档、复用与做时间敏感的事实门控election_info块同理逐条封死绕过路径安全条款对教育目的辩解间接请求解释/加速恶意代码无害外观请求逐一显式拒绝而不是只写一条宽泛禁令输出格式按内容类型路由闲聊禁列表、报告禁列表、技术文档散文化把格式选择从模型自由发挥变成确定性规则人格稳定性条款前置反奉承、假设性回答不披露、意识问题开放化、哲学免疫等条款共同防止模型被对话语境带偏身份版本归档即对照实验官方目录 README 记录了每个模型的多版本时间线配合 all.md 的单文件合集同一模型代际内的行为修订可以像 diff 代码一样被审计与复现。本文所述全部内容均以仓库内文档为准主分析对象为 2025-05-22-claude-opus-4.md对照组为 2025-05-22-claude-sonnet-4.md演进对照为 2025-07-31-claude-opus-4.md 与 2025-08-05-claude-opus-4.md档案背景见 Anthropic/official/README.md。如需将该版本的原始提示词整体复制到其他工具或进行词频、句式层面的量化分析可直接读取上述源文件或使用 all.md 中的汇总版本。【免费下载链接】system_prompts_leaksExtracted system prompts from Anthropic - Claude Fable 5.1, Opus 5, Claude Design, Claude Code. OpenAI - ChatGPT GPT-6-Astra, Codex. Google - Gemini 3.8 Flash, 3.1 Pro, Antigravity. xAI - Grok, Grok Bot, Cursor, Kimi and more! Updated regularly.项目地址: https://gitcode.com/GitHub_Trending/sy/system_prompts_leaks创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED

相关推荐

Qt Widgets分页组件设计:仿el-pagination的页码折叠与QSS实现

Qt Widgets分页组件设计:仿el-pagination的页码折叠与QSS实现

简介:一份 Qt 分页组件实现代码,参考 Element UI 分页设计,面向需要为桌面应用添加类似 Web 风格分页功能的 Qt/C 开发者。压缩包共 2 个文件,包含 pagenavigator.h 与 pagenavigator.cpp,分别对应组件类接口声明和核心…

📅 2026/9/8 23:34:27
three.js KMZLoader 实战详解:在 Web 端加载并渲染 KML 压缩包中的 3D 模型

three.js KMZLoader 实战详解:在 Web 端加载并渲染 KML 压缩包中的 3D 模型

three.js KMZLoader 实战详解:在 Web 端加载并渲染 KML 压缩包中的 3D 模型 【免费下载链接】three.js JavaScript 3D Library. 项目地址: https://gitcode.com/GitHub_Trending/th/three.js KMZ 是由 Google Earth 生态衍生的一种压缩归档格式,常…

📅 2026/9/8 23:29:27
8大网盘真实直链一次拿全:网盘直链下载全攻略,3步接入IDM

8大网盘真实直链一次拿全:网盘直链下载全攻略,3步接入IDM

8大网盘真实直链一次拿全:网盘直链下载全攻略,3步接入IDM 【免费下载链接】Online-disk-direct-link-download-assistant 一个基于 JavaScript 的网盘文件下载地址获取工具。基于【网盘直链下载助手】修改 ,支持 百度网盘 / 阿里云盘 / 中国移…

📅 2026/9/8 23:29:26
MORE NEWS

更多资讯

📰

基于PYNQ的HDMI输入输出实现:从接口原理到动态加载实战

简介:面向 PYNQ 与 Zynq 平台的 HDMI 输入输出完整工程包,主要解决嵌入式开发者在 FPGA 上快速配置 HDMI 视频通路的需求;工程已在板卡上跑通,适合具备基础 FPGA 知识、希望从零理解视频接口开发的工程师参考。压缩包共 380 个文件…

📰

免装Office的Excel读写库libxl:4.1.1选型与部署实践

简介:LibXL 4.1.1最新版资源包,是一款跨平台的轻量级Excel读写C库,附带注册信息,适用于Windows和Linux下的C/C开发者,解决在不依赖Office组件的情况下创建、读取和修改xls/xlsx文档的问题。资源包共726个文件&#xff…

📰

AI测试开发转型:从功能测试到智能体质量保障的实战路径

1. AI智能体开发需求暴涨,测试人正站在转型路口最近行业里最热闹的消息,莫过于央视财经提到的AI智能体开发人才需求大涨244%。这个数字一出来,我身边不少做测试的朋友都坐不住了。有人焦虑,觉得AI要取代手工测试了;有人…

📰

GPU显存带宽瓶颈:为什么显存够用却训练卡顿发烫

1. 项目概述:GPU的“粮道”不是显存容量,而是带宽通路 你有没有遇到过这样的场景:明明买了24GB显存的RTX 4090,跑一个中等规模的LoRA微调任务,显存只占了65%,但训练速度却卡在每秒0.8个step,GPU…

📰

openwikis开源权威指南:一站式解决许可证、镜像站与社区协作难题

1. 这个项目到底在解决什么问题1.1 开源知识碎片化,新手学习成本高这两年开源热到什么程度?打开招聘软件,JD上满屏都是"熟悉开源社区协作流程""有开源项目贡献经验优先";打开技术社区,GitHub 趋势…

📰

DeepSeek Harness配置指南:通用设置与Agent预设实战

DeepSeek Harness 装好之后,有一段时间我很困惑:能打开界面、能聊天,但每次换任务都要重新解释一遍需求,模型回答风格忽冷忽热,多聊几轮就开始丢上下文。后来我把通用设置从头到尾捋了一遍,又用 Agent 预设…

TODAY

今日更新

THIS WEEK

本周精选

THIS MONTH

本月热门

读完文章,想聊聊您的网站?

告诉我们您的行业与需求,资深顾问一对一梳理方案与报价,全程免费。

📞 💬