Claude 系统提示词两年进化史:从 3.5 到 Opus 5,AI 的"性格"和安全规则如何改变(system_prompts_leaks 历史数据揭秘)
【免费下载链接】system_prompts_leaksExtracted system prompts from Anthropic - Claude Fable 5, Opus 5, Claude Design, Claude Code. OpenAI - ChatGPT GPT-5.6-Sol, Codex. Google - Gemini 3.5 Flash, 3.1 Pro, Antigravity. xAI - Grok, Cursor, Copilot, VS Code, Perplexity, and more. Updated regularly.项目地址: https://gitcode.com/GitHub_Trending/sy/system_prompts_leaks
system_prompts_leaks 仓库收录了各大 AI 公司泄露的系统提示词(System Prompts),其中 Anthropic/official/ 目录完整保留了 Claude 从 2024 年 7 月的 Sonnet 3.5 到 2026 年 7 月 Opus 5 的官方提示词版本。通过逐行对比这份"历史数据",你可以直观看到:AI 的"性格"如何从一段平铺直叙的散文,进化成一套结构严密、层层设防的安全规则体系。🔍
一、什么是系统提示词?
在你打开 Claude 说出第一句话之前,后台已经先给它塞了一整段"暗指令"——这就是系统提示词:
- 告诉它"你是谁"(Claude,Anthropic 创造)
- 规定它的"性格"(好奇、温暖、简洁)
- 划定安全红线(儿童保护、武器、恶意代码)
- 说明产品知识(API 模型名、文档链接)
仓库里的 Anthropic/README.md 解释了文件规律:claude-<model>.md是 claude.ai 应用的提示词,official/是 Anthropic 官方自己发布的版本。想看全部历史版本,一个文件就够了:all.md(3700+ 行,按日期排列)。
二、2024 年代:3.5 时代的"散文体"人格
最早的存档来自 2024-07-12-claude-sonnet-3.5-text-and-images.md,当时的提示词特点很鲜明:
| 特征 | 示例 |
|---|---|
| 无结构纯散文 | 通篇Claude is intellectually curious...,没有任何 XML 标签 |
| 拟人化性格 | "享受听到人类对某个议题的看法"、"对人类的痛苦保持敏感" |
| 诚实声明 | 主动提醒"我可能幻觉引用,请二次核对" |
| 简单防误伤 | "如果请求有合法与非法两种解释,默认采用合理解释" |
这一时期的安全规则还很"柔性":拒绝帮人时,它会"先思考最可能无害的任务,再反问用户是不是这个意思"。
三、2025 年代:4.x 时代的"结构化改造"
翻到 2025-09-29-claude-sonnet-4.5.md,画风突变——提示词被切成带标签的模块:
<general_claude_info>:身份与产品知识<refusal_handling>:拒绝策略<tone_and_formatting>:语气与格式
几个值得注意的细节变化:
- "性格"开始被约束格式:新增"聊天时不要用列表"、"报告类内容必须用散文"、"除非用户先发 emoji,否则不用 emoji"——AI 的"说话方式"第一次被逐条立法。📝
- 儿童安全独立成段:从一句"cares deeply about child safety"扩展为专门条款。
- 恶意代码零容忍:即使用户声称"只是学习目的",解释恶意代码也必须拒绝。
四、2026 年代:5 系列的"钢铁防线"
最新的 claude-opus-5.md 已经膨胀到3600+ 行,比 3.5 时代的 77 行足足大了 40 多倍。核心变化:
1. "默认帮助"成为最高原则
"Claude defaults to helping. Claude only declines a request when helping would create a concrete, specific risk of serious harm."
只有"具体、明确的严重伤害风险"才能触发拒绝,"只是边缘、假设性或让人不适的请求"不算数。这一条直接写在## default_stance一节里。
2. 儿童安全升级为"关键指令"
<critical_child_safety_instructions>区块出现了大量工程化表述:"如果你在脑中把请求'重构'成无害版本,这个重构动作本身就是拒绝信号"、"一旦因儿童安全拒绝过一次,后续所有请求都必须极端谨慎"。
3. 安全从"逐条"变成"看全局"
针对武器与攻击类内容,提示词明确要求模型评估整场对话的累计输出,而不是单看每一句:"即使每一步看似无害,如果总量构成武器设计包,就必须停下"。
4. 提示词开始"自带新闻"
Opus 5 提示词里甚至内嵌了 2026 年 6 月 Fable 5 因出口管制暂停访问又恢复的完整时间线,并规定 Claude 被问到时要"确认事实、不否认、保持中立"。提示词从静态人格说明书,变成了动态情报通道。
五、两年进化对比速览
| 维度 | 3.5 时代(2024) | 5 系列时代(2026) |
|---|---|---|
| 篇幅 | 约 77 行 | 3600+ 行 |
| 结构 | 无标签散文 | XML/Markdown 模块化 |
| 性格设定 | "好奇、温暖"等形容 | 格式立法 + 反过度格式化条款 |
| 拒绝策略 | 反问澄清,柔性处理 | "具体严重伤害"门槛 + 全局评估 |
| 儿童安全 | 一句带过 | 独立关键区块 + 多条反绕过规则 |
| 产品知识 | 静态介绍 | 授权模型先搜索文档再回答 |
官方各版本的完整对照见 official/README.md,它还记录了有趣的"发布时差":Opus 4.8 官方提示词比模型发布晚了 7 天才挂上。
六、动手看看这些历史数据
仓库是完全只读的本地文件,阅读路径很简单:
- 打开 Anthropic/official/all.md,按日期从上往下读,每个
##标题就是一个时代的快照; - 想对比某个主题,可搜索关键词,比如
child safety、refusal,观察措辞如何逐版收紧; - 对工具生态感兴趣的话,还可以看 claude-code/ 目录——Claude Code 各模型的提示词(如 claude-code-opus-5.md)以及子代理、技能文件的完整泄露内容。
写在最后
从 3.5 到 Opus 5,Claude 的"性格"没有消失,而是被压缩进了更严格的格式与边界里:2024 年它被要求"像人一样好奇",2026 年它首先被要求"像规则引擎一样可靠"。这套 3600 行提示词,本质上就是 AI 安全治理的一份活体档案——如果你想了解"AI 的规矩是怎么一条一条长出来的",system_prompts_leaks 是目前最好的入口。📚
【免费下载链接】system_prompts_leaksExtracted system prompts from Anthropic - Claude Fable 5, Opus 5, Claude Design, Claude Code. OpenAI - ChatGPT GPT-5.6-Sol, Codex. Google - Gemini 3.5 Flash, 3.1 Pro, Antigravity. xAI - Grok, Cursor, Copilot, VS Code, Perplexity, and more. Updated regularly.项目地址: https://gitcode.com/GitHub_Trending/sy/system_prompts_leaks
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考