← 文章 / AI技术
Hacker News 5小时前 · 2026-10-04 06:29:31 · 11 阅读

在 Claude 和 Claude Code 中充分发挥 Opus 5.5 的使用指南

Opus 5.5 能无缝融入你现有的 Claude 使用方式,但有几点行为不同:它能独立工作更长时间,会直白地告诉你它做了什么,并且每次回复前都会先思考。本指南介绍如何在 Claude 应用和 Claude Code 中用好 Opus 5.5,包括如何编写提示词、如何引导长时间运行的任务、以及如何检查结果。

先试试这些

首次使用 Opus 5.5 时的三个建议

  1. 把整个任务交给它。说清楚“完成”的标准,以及什么情况下停下来问你。然后就放手让它干。
  2. 删掉“仔细思考”之类的提示语。Opus 5.5 每次回复前本来就会思考。
  3. 长任务结束时,先看看它需要你提供什么。

1. 如何提问

说清楚“完成”的标准,然后让它跑

怎么做。在一条消息里给出完整任务。明确终点线,比如“测试全部通过”或“所有 endpoint 都迁移完成”。然后就让它干。

为什么在 Opus 5.5 上很重要。Opus 5.5 在长时间、多环节任务上的持续工作能力比 Opus 5 更强。与之前的 Opus 模型相比,它最大的提升正是在多步骤工作上,比如在大型代码仓库中把一处改动贯彻到底直到测试通过。早期测试者让它在几乎无人监督的情况下连续运行数小时的编码任务。有了清晰的终点线,它就知道什么时候算完成。

示例。在 Claude Code 中可以这样写:

PROMPTCopy
Migrate the payment endpoints from the old client to the new one.
Done means: every endpoint uses the new client, the old client is deleted, and the test suite passes.
Stop and ask me only if a test fails for a reason you can't explain.
The example prompt split into three labelled boxes: the whole task (migrate the payment endpoints from the old client to the new one), the finish line, highlighted (every endpoint uses the new client, the old client is deleted, and the test suite passes), and when to stop (only if a test fails for a reason you can’t explain). Footer: “Give the whole task in one message. Name the finish line. Then leave it alone.”
FIG A一条消息包含:完整任务、终点线、以及何时停下来。

别再让它“深度思考”了

该做什么。把“仔细想想”“一步步思考”之类的话从你的提示词和保存的指令里删掉。

为什么在 Opus 5.5 上重要。Opus 5.5 回复前一定会思考,思考多少由它自己决定,不需要你去提醒。我们在聊天产品中测试发现,删掉“仔细想想”这类语句后,回复开始得更快,质量也没有明显下降。

怎么做。直接删掉即可。如果只是想快速回答一个简单问题,就明说:“直接回答。”在 Claude Code 中想调整思考力度,改用 effort 设置。

给正在运行的任务追加内容

该做什么。如果任务跑到一半你想起什么,可以在它运行时直接输入补充消息。

为什么在 Opus 5.5 上重要。现在的任务运行时间更长,重启的代价也更大。

怎么做。在 Claude Code 里,趁 Claude 运行时输入消息并按回车即可,比如“把旧的 endpoint 名称也保留为别名”。

做设计时,明确列出你不想要的风格

该做什么。让生成页面、应用或 artifact 时,把不想要的那些设计套路列出来。

为什么在 Opus 5.5 上重要。没有明确设计方向时,Opus 5.5 会退回到几种默认风格。像“避免看起来太套路”这种笼统指令,通常只是把一种默认风格换成另一种。列出具体模式要有效得多。

怎么做。直接点名那些模式:

PROMPTCopy
Build a personal website with placeholder content.
Don't use a cream or off-white background, italic accent words in headings, numbered "01 / 02 / 03" section labels, monospace labels, or pill-shaped buttons.

然后看看它换成了什么。如果还是不满意,把它也加进列表,再让它重试。

2. 在 CLAUDE CODE 中引导长任务

告诉它你想要哪些停顿点

该做什么。在 CLAUDE.md 里写一条简短规则,说明什么时候停下来询问你,什么时候继续干。

为什么在 Opus 5.5 上重要。Opus 5.5 工作时会持续汇报进度。面对长任务,它有时会停下来汇报而不是继续:给出一份摘要、提到下一步却不动手,或者询问要不要继续,又或者列出一堆并不影响工作的选项。它能听懂点名这些行为的指令。所以把你想要的停顿点也明确写出来。

怎么做。把下面的内容加进 CLAUDE.md,并根据你的项目做调整:

PROMPT复制
如果某一步骤不需要我介入,请继续执行。将状态备注与下一步操作放在同一条消息中。
只有在我无法继续,或涉及破坏性操作(删除数据、强制推送、修改本仓库以外的任何内容)时,才停下来询问我。
一张标题为“告知它你希望在哪一步暂停”的 CLAUDE.md 卡片,包含两个框。继续执行:如果某一步骤不需要我介入,请继续执行,并将状态备注与下一步操作放在同一条消息中。停下来询问:只有在我无法继续,或涉及破坏性操作(删除数据、强制推送、修改本仓库以外的任何内容)时。底部注释:“请根据你的项目调整此规则。破坏性命令仍保留权限提示。”
图 B CLAUDE.md 规则:何时继续,何时停下询问。

如果运行中断并显示“要我继续吗?”,回复“继续”。如果这种情况频繁发生,上述规则会有帮助。

“继续”的规则意味着更少的停顿,因此在执行任何高风险或难以撤销的操作前,务必保留人工检查。上述规则的最后一条起到了这个作用。对于破坏性命令,也请保留权限提示。

对于结对编程,你可能想要相反的效果:开始前制定单行计划,结束后简短回顾。请在 CLAUDE.md 中说明这一点。Opus 5.5 遵循任一模式。

让它将大型任务分发给子智能体

怎么做。 进行审计、迁移或大型代码库评审时,要求 Opus 5.5 将工作分派给子智能体,并检查每个结果。

为何在 Opus 5.5 上重要。 早期测试者让 Opus 5.5 协调并行子智能体执行长期审计和迁移,且几乎无需人工监督。

如何操作。

PROMPT复制
审计 services/ 目录下所有服务在关联 issue 中提到的重试 bug。
将每个服务交给独立的子智能体。当子智能体汇报结果时,在接受前务必核查其证据。
最后生成一张表格:服务名称、是否受影响(是/否)、证据。
示意图标题为“将每个服务分配给专属子智能体”。提示词“审计 services/ 目录下的所有服务,检查链接 Issue 中提到的重试 bug”并行分发给四个子智能体。它们的报告在“核实其证据”步骤汇合(“当子智能体回报结果时,先核实其证据再接受”),随后箭头指向“用一张表格收尾”,该表格包含 Service、Affected(是/否)和 The Evidence 三列。
图 C:分发给子智能体,逐一核实其证据,最后用一张表格收尾。

将任务清单保存在文件中

怎么做。 对于耗时较长的运行任务,让 Opus 5.5 将任务清单写入文件,并随执行进度实时更新。查看运行进度时,直接读取该文件,而非翻阅滚动日志。

为何对 Opus 5.5 重要。 现在的运行时间变长了。长任务会填满上下文窗口,Claude Code 随后会对较早的对话轮次进行总结压缩。存储在文件中的任务清单不会受此影响,且能让你一眼看清已完成和待办事项。

示例指令。 “在 TASKS.md 中维护一份检查清单。每完成一项就勾选,发现新事项时添加进去。”

3. 检查运行结果

优先关注它需要你做什么

怎么做。 长任务结束后,先查看 Claude 是否有等待你确认的事项,例如留下的待决事项或请求你批准修改的内容。然后再阅读其余摘要部分。

为何对 Opus 5.5 重要。 Opus 5.5 的工作汇报比 Opus 5 更清晰。其进度更新和最终摘要会简明扼要地说明做了什么、发现了什么以及需要你做什么。

示例指令。 若要自定义摘要格式,请在 CLAUDE.md 中说明,例如:“每次运行结束时列出三个小标题:需我决策的、已修改的、发现的。”

让它审查代码

怎么做。 在人工审查前,让 Opus 5.5 先审查代码差异或拉取请求。

为何对 Opus 5.5 重要。 一位早期测试者反馈,Opus 5.5 在最低努力等级下捕获的 bug 比 Opus 5 在高努力等级下更多,且误报更少。它还用平实的语言解释代码变更,因此其拉取请求描述更易于人工审阅。

示例指令。 将以下提示词发送给 Claude:

PROMPT复制
对比 main 分支审查这个分支的 diff。
只列出足以阻止合并的问题。每个问题都要给出文件和行号、错误原因,以及如何验证它确实会出错。

让它标注无法确认的内容

做法。做研究或分析时,让它说明哪些内容没找到或没法核实。

为什么在 Opus 5.5 上有效。“这个我没找到”这样的话是值得看的,主动要求它这么说,也更容易发现盲区。

怎么用。在请求中加一句“凡是无法确认的内容都要标注出来,并说明你查过哪些地方”。这在 Claude 研究报告和 Claude Code 中都有效。

4. 在 CLAUDE 应用中

首先,确认模型选择器里选的是 Opus 5.5。

直接分享图表或截图本身

做法。直接附上图表、示意图、截图或幻灯片,不要手动把数字重新敲一遍。

为什么在 Opus 5.5 上有效。Opus 5.5 读取图表、示意图和截图的准确度比 Opus 5 更高,而且不需要任何额外操作。它在理解图像中位置关系方面的能力也更强:比如箭头连接的是哪几个框、示意图两个版本之间改了什么,或者日历截图中会议的开始和结束时间。

怎么用。附上图片并提一个具体问题,比如:“这些服务里哪些直接调用了 billing API?”

让它检查长文档

做法。把长篇计划、报告或幻灯片发给它,让它找错误。

为什么在 Opus 5.5 上有效。Opus 5.5 对细节的关注度超过之前的 Opus 模型。在我们的测试中,它发现了一份长规划文档里落在错误星期几的日期,以及一组与幻灯片数字不符的图表数据。

怎么用。提交这样的提示词:“检查这份幻灯片里有没有自相矛盾的地方:数字、日期和名称。逐条引用问题并说明位置。”

直接要成品文件

做法。需要电子表格或文档时,直接要文件,而不是要大纲。

为什么在 Opus 5.5 上有效。Opus 5.5 生成的电子表格和文档,在分享之前需要修改的地方比 Opus 5 的更少。

怎么用。“把它做成一份可以直接分享的电子表格:每个供应商一行,列包括成本、合同到期日和负责人。”

在项目中,说明哪些问题已有定论

怎么做。如果在长对话中追问时感觉响应变慢,可以加一条指令,说明之前的回答已经确定,不必再回顾。

为什么在 Opus 5.5 上重要。在长对话中,Opus 5.5 有时会在思考一个简短追问时,回头重审之前的回答,导致回复变慢。

方法。在项目的 instructions 中加入以下内容:

PROMPTCopy
Once you have answered something, treat that answer as done. Focus on what I'm asking now, and don't go back over an earlier answer unless I ask about it or point out a problem with it.

如果是长篇分析类项目,请不要加这条,因为后面的步骤可能会暴露前面步骤中的错误。

5. 当消息被标记时

Opus 5.5 是首款搭载 Fable 级别生物与网络安全防护措施的 Opus 模型。在 Claude 应用和 Claude Code 中,大多数被标记的消息会转由旧版模型处理,你的工作可以在那里继续。在源代码中查找安全漏洞是允许的,日常健康和教育类问题也照常可用。这些防护措施有时会误伤正常工作,我们正在持续调整以减少误判。如果你被切换了模型,以下是你会看到的内容和处理方法。

在 Claude 应用中

你会看到。一条以"Switched to"开头、并显示旧版模型名称的提示。Claude 会在那个模型上回答,对话也将保持在那个模型上。

怎么处理。

  • 想切回 Opus 5.5,在模型选择器中选择它即可。如果之前被标记的消息还在对话中,可能会再次被标记。开一个新对话可以避免这个问题。
  • 想在切换前先收到询问,进入 Settings,然后是 Capabilities,关闭"Switch models when a message is flagged"。之后你会看到一个"paused"卡片,上面有可选操作。

安全检查覆盖整个对话内容,包括文件和搜索结果。所以被标记的原因可能是之前的内容,而不只是你最后那条消息。

在 Claude Code 中

你会看到。一条显示旧版模型名称的提示。会话将在那个模型上继续。

怎么处理。

  • 运行 /model 切回原模型。
  • 连按两次 Esc,编辑你上一条消息后重试。
  • 想在切换前先收到询问,运行 /config 并修改"Switch models when a message is flagged"。
  • 如果认为被误判了,运行 /feedback 反馈。

不要要求它在回复中展示推理过程

怎么做。在提示词和指令中,删掉要求 Claude 在回复里复现其内部推理的内容。

为什么对 Opus 5.5 重要。要求在回复中复现内部推理的请求可能被拒绝,这属于敏感标记类别之一。

怎么做。直接向 Claude 提出你真正的需求,比如“用三句话解释你为什么选择这个方案”。

6. 速度

当你需要等待每条回复时,开启快速模式

怎么做。在 Claude Code 中,来回交互式的工作(即每条回复你都要先读过再发下一条消息)使用快速模式。

为什么对 Opus 5.5 重要。Opus 5.5 发布时即可使用快速模式(研究预览版)。模型完全相同,但文本会更早到达。需要额外开启用量额度,且每 token 价格高于标准模式。

怎么做。在 Claude 中输入 /fast。

你的 OPUS 5.5 检查清单

在下一个长任务之前过一遍。

The checklist as a card with four groups of checkbox items: Asking, Long runs in Claude Code, Checking, and Flags. The same items are listed as text below.
FIG D检查清单一览。

提问

  • 任务里写明了“完成”的标准
  • 提示词或保存的指令中没有“think hard”之类的语句
  • 设计类请求列出了需要排除的风格
  • 图表和截图直接附上,而不是重新描述

Claude Code 长任务

  • CLAUDE.md 写明了何时停止、何时继续,并在执行破坏性操作前先停止
  • 破坏性命令的权限确认仍然开启
  • 大规模审计和迁移拆分给 subagents
  • 任务清单保存在文件中

检查

  • 先读报告中“需要你处理”的部分
  • 人工审查之前先跑一轮 review pass
  • 研究类回答标注了哪些内容无法确认

敏感标记

  • 你知道如何切换回原模型:模型选择器或 /model
  • “消息被标记时切换模型”已按你的偏好设置

立即开始使用 Opus 5.5 构建!

感谢 Molly Vorwerck 审阅本文。

原始来源: Hacker News

评论 (0)