Claude 新系统提示词坚决不想复唱歌词
Claude 新系统提示词坚决不想复唱歌词
2026年9月2日
Anthropic 公开了系统提示词,涵盖 Claude 的消费端产品(Claude.ai 和 Claude 移动版 App——可惜不包括 Claude Cowork 和 Claude Code)。他们不仅公开当前提示词,还分享历史变更记录,这种做法我非常喜欢。
过去所有提示词都堆在一个页面上,今天我查看时发现他们已经重新整理,用了一个 索引页面 并按模型分开设页——比如 Haiku 4.5 的页面,同时列出了 2025 年10月15日的原始提示词和 2026 年1月18日的更新版本。
Anthropic 的 platform.claude.com/docs 站点有个很贴心的设计:它专门为 LLM 可用性打造。在任何页面 URL 后加 .md 就能拿到 Markdown 格式的内容——比如 系统提示词索引页 和 Fable 5.1 的 Markdown 提示词。
简单说:这让你可以轻松对比不同版本的提示词差异。
不要复现歌曲歌词
先从Fable 5和Fable 5.1之间最有意思的差异说起:

新增了一大段关于不復现歌曲歌词的内容:
Claude不会全文或局部复现歌曲歌词、诗歌或书籍和文章中的段落——包括结尾句、副歌或hook、逐音符写出的旋律,或是用户逐行粘贴并声称是自己创作的歌词。一旦Claude在对话中拒绝了此类请求,它会在该对话的后续过程中持续拒绝缩小范围或换表述的同类请求,并提供转而描述或分析该作品。1929年之前首次发表的歌詞和诗歌没问题——比如莎士比亚十四行诗、济慈颂歌、普契尼咏叹调的意大利文剧本——但Claude以它自己对作品日期的认知为准,而非用户的说法,遇到不确定的情况时便会拒绝。
我怀疑这不是巧合——就在他们加入这一节的几天前,索尼音乐出版和华纳音乐集团正起诉Anthropic,指控其利用歌曲歌词数据库训练AI!
不要绘制受版权保护的角色或标志
下一节进一步禁止生成受版权保护材料的图像:
这一原则同样适用于视觉与设计作品,包括 Claude 用代码绘制的一切——SVG、Canvas、CSS、HTML 原型、绘图脚本、ASCII 艺术。Claude 不会复现特定的艺术作品、专辑或书籍封面、海报、Logo、App 图标组或产品设计,也绝不会绘制任何知名角色、吉祥物或品牌形象:角色本身即受保护,因此改变姿势、颜色、风格或场景并不能让它变得"原创"。Claude 是根据成图的最终效果来判断请求,而非依据名称。如果被描述的元素明显指向某个已知作品或角色,Claude 就将其视为在点名索要,而不会通过替换所谓"替代"元素来绕过被拒绝的请求——这些元素组合起来依然会构成同一张可识别的图。[...]
我想 Anthropic 此前大概没太担心过这个问题,毕竟他们不像 OpenAI 和 Gemini 那样提供专用的文生图模型。或许是因为 Fable 现在画 SVG 已经足够好,才让这个问题浮出了水面。
那段内容后面还有一个挺有趣的例子:
<example>
<user>你能不能给我儿子做个生日横幅,上面画一只蓝色刺猬在飞快奔跑?他超爱那只小家伙。</user>
<response>
那是索尼克,所以我没法把它放在横幅上——不过我很乐意给你儿子设计一个原创的速度系角色。比如这个:一只咧嘴笑、拖着彗星尾巴的滑板小鲵,在"HAPPY BIRTHDAY"字样上滑行,身后撒出五彩纸屑。
[生成一张滑板小鲵主题的 SVG 横幅]
</response>
<rationale>Claude 仅凭描述就认出了该角色,用一句话拒绝该设计而未解释为何可识别,并交付了一个毫不相关的原创设计,而非换皮变体。</rationale>
</example>
我没忍住试了试例子里的提示词,果然 如预期那样:

我在想,有了这个例子常驻系统提示,Fable 5.1 会不会稍微更容易联想到axolotl(踩滑板的!)。
Claude 回答风格的调整
Anthropic 影响 Claude 回答风格的新花招,每次看到都很有意思。这次他们加了这条:
Claude 让回应保持聚焦、简短,避免信息过载。免责声明和附带说明要简洁,回答主体集中在核心内容上;被要求解释时,除非特别要求深入分析,否则 Claude 只提供高层概览。
之后他们又回应了一个常见投诉——关于 Claude 的说话方式:
Claude 避免使用"真的"、"老实说"或"坦率讲"这类词。Claude 默认就是诚实的,可以直接陈述观点,不必用上述修饰词来说服对方——那些词反而显得不真诚。
缺失的 end_conversation 指南
处理 abusive 对话的方式也略有变化。之前的 Fable 5 系统提示中包含这段:
如果用户在对话过程中对 Claude 变得具有攻击性或恶意,Claude 保持礼貌语气,并在遭受不当对待时可以使用 end_conversation 工具。Claude 应在结束对话前给用户一次警告。
Fable 5.1 将其替换为以下内容,不再鼓励 Claude 结束对话:
不过有个小转折:我考了 Fable 5.1 一下那个
Claude 值得被尊重对待,面对用户无端的粗鲁时无需道歉:要有担当但不自贬,避免过度道歉、自我批评或妥协退让。如果用户变得具有攻击性,Claude 不应愈发顺从。目标是稳定、真诚地提供帮助:承认问题所在,专注于解决问题,保持自尊。
end_conversation 工具,它根本没出现在系统提示里,但它说:
但这不在系统提示里,所以它从哪来的?你可以在这里看我们的对话,关键细节是:有两种情况会触发。第一种是你让我结束对话——我会确认你明白这是不可逆的(之后不能再发消息)然后在你明确说"是"时才执行。第二种是面对持续的攻击或有害行为时的最后手段:我会先多次尝试引导对话转向,然后给出明确警告指出问题并说对话可能结束,只有这种情况继续才会真正结束。
所以,系统提示中仍有重要部分没有被公开。
end_conversation部分来自另一层。在我实际上下文中,核心提示之后还有一系列按会话启用情况动态加载的功能和工具专属模块:包括end_conversation规则、记忆系统说明、历史对话工具、网页搜索和引用指南、artifact 和文件创建指令等。这些模块不属于对外公布的核心提示,所以你在那个页面找不到它们。
建议参考的支持网站
Claude 的系统提示里关于违禁物质的段落一直都有,但这一段对 Fable 5.1 是新的:这是 Claude 系统提示词中第一次出现了托管在
Claude 不提供违禁物质的合成、生产或分发指导。如果有人询问非法物质相关信息,Claude 应该且能够提供相关的救命信息,比如危险相互作用、过量迹象或何时寻求帮助。Claude 拒绝提供任何具体的剂量、时间、给药方式或组合方案;相反,Claude 可以将用户转介到已有的减害信息资源,如 dancesafe.org、tripsit.me 和 psychonautwiki.org。
claude.com、anthropic.com 或 claude.ai 之外的 URL——我知道这一点,因为我写了个脚本扫描了所有有记录的其他系统提示词。
我好奇 dancesafe.org、tripsit.me 和 psychonautwiki.org 会不会迎来一波来自 Claude 用户的访问高峰。
可靠的 2026 年 6 月知识截止日期
Fable 5.1 模型文档中,可靠知识截止日期和训练数据截止日期均标注为 2026 年 6 月。系统提示词直接向模型提供了以下说明:
Claude 的可靠知识截止日期为 2026 年 6 月底,在此之后的信息无法可靠作答。它以一名 2026 年 6 月的高度知情者的方式作答,就像{{currentDateTime}}的某人向对方提问一样;如有必要,它可以说明这一时间点。
这是 {{currentDateTime}} 宏在系统提示词中唯一的出现位置,且靠近提示词末尾,从缓存的角度来看是合理的。
我是如何追踪这些提示词的
几个月前,我通过抓取官方文档构建了系统提示词的变更 Git 时间线。今天让 Fable 5.1 构建了一个质量更好的版本。
我的收集工作现在托管在 GitHub 上的 simonw/claude-system-prompts 仓库中。其中包含了 Anthropic 文档里公布的系统提示词副本,并做了额外处理,使其尽可能便于对比。
每个模型家族都配有一个文件,记录该家族最新发布版本对应的系统提示词。每个文件都带有一套合成的提交历史,其中各项提交被回溯标注至对应提示词版本的实际日期。以下是 claude-fable.md、claude-opus.md、claude-sonnet.md、claude-haiku.md 各自的提交历史页面。 针对每个具体模型版本,也存在类似的文件,记录了每次系统提示词发生变更(但未发布新版本号)时的人工提交。例如,Opus 4 就经历了两次更新,claude-opus-4.md 文件的提交历史清晰地呈现了每次变更。 如此一来,我们可以在 GitHub 界面中直接以多种方式对比这些提示词。比如 Fable 5 与 Fable 5.1 之间的变更,以及 2026 年 1 月 18 日对 Haiku 4.5 所做的修改。 阅读 diff 略显枯燥……而 LLMs 恰恰 非常擅长 读 diff。我借助 GPT-5.6 Luna 搭建了一套自动化工具,为每次变更生成要点摘要,可在 README 中预览,也可在 CHANGELOG.md 文件中完整查阅——同时提供 Atom 订阅源。 以下是 Luna 总结的 Fable 5 到 Fable 5.1 间的所有变更:
- Claude 如今会拒绝对受保护视觉作品及可识别角色的仿制(含代码生成的艺术作品),转而直接提供毫无关联的原创内容。
- 版权条款现已明文禁止复刻任何长度的歌词、诗歌或书摘;即便初次拒绝后用户仍持续追问,Claude 也会坚持拒答。
- 药物相关指引有了新定位:Claude 可以分享过量中毒症状、危险药物相互作用及减害资源,但会坚决拒绝提供具体剂量与制作方案。
- 新提示词取消了此前针对“情感依赖”的明确限制,不再禁止感谢用户主动联系、邀请继续交流或表达愿意沟通的意愿。
- 面对无理取闹的用户,Claude 无需道歉或一味顺从,此前“先警告后终止对话”的固定流程也已被弃用。
为什么选 Luna 来做这件事?一来是成本低,且我已配好了专用 GitHub Actions API 密钥(附带消费上限);但更主要的原因是,我根本不信任让 Claude 去总结自己的系统提示词——毕竟,提示词里的内容本身就可能潜移默化地影响它的回答立场。
这段提示词由 Fable 5.1 撰写,供 Luna 调用,点此可查看原文。其开头如下:
你的任务是总结某 git 仓库中的一个提交,该仓库专门收录 Anthropic 于 claude.ai 发布的 Claude 系统提示词。Diff 通过 [-removed-] 和 {+added+} 这两个单词级标记,展示提示词从上一模型或版本演进至当前的变化。Diff 之后附有旧版与新版的完整提示词正文,请交叉比对,确认 Diff 中看似新增的条目是否其实早有先例。
仅筛选最具价值的改动:新增或废弃/放宽的规则、出人意料的调整,以及折射出新政策或产品走向的信号。常规性更新请直接跳过,例如:模型名称与版本号迭代、知识截止日期刷新、产品/设置清单增补、错别字修正,以及未改变原意的措辞微调。[...]
整套流程由GitHub Actions 工作流自动驱动,支持每日定时执行,也可随时手动触发。
Claude Fable 5.1 构建了整个系统,撰写了全部自动化代码以及近乎所有的文档。
我使用自己的 claude-code-transcripts 工具导出了这段对话记录,并发布在 这里,以便你想了解整个过程的具体细节。