转译: 如何在 Claude 和 Claude Code 中用好 Opus 5.5
译自 claude.dev 原标题:Getting the most out of Opus 5.5 in Claude and Claude Code
作者:Addy Osmani | 原文发布:2026年9月23日
如何给 Opus 5.5 写提示词、引导长任务、在 Claude 应用和 Claude Code 中检查结果。
Opus 5.5 跟你现有的 Claude 用法完全兼容,但有几件事表现不一样了:它能独立工作更长时间,会直白地告诉你它做了什么,而且每次回复前都会先思考。这篇指南讲的是如何在 Claude 应用和 Claude Code 里跟 Opus 5.5 协作——包括怎么写提示词、怎么引导长任务、怎么检查结果。
先试这三件事
第一次用 Opus 5.5,建议先试这三件事:
把整个任务一次交给它。说清楚什么算"做完了",什么时候需要它停下来问你,然后放手让它干。
删掉"仔细想想"之类的指令。Opus 5.5 在每次回复前已经会自动思考了。
长任务结束后,先看它还需要你做什么。
1. 怎么提问
说清楚什么算"做完了",然后放手
怎么做。 在一条消息里把整个任务讲清楚。定义好完成标准——比如"测试全部通过"或"所有端点都迁移完毕"。然后让它自己跑。
为什么重要。 Opus 5.5 处理长篇、多步骤任务的能力比 Opus 5 强了很多。跟之前的 Opus 模型相比,它最大的进步就在多步骤工作上——比如在一个大型仓库里一路改下去,直到测试全部通过。早期测试者让它连续跑了好几个小时的编码任务,几乎不需要人盯。有了明确的完成标准,它自己就知道什么时候该收工。
具体方法。 以 Claude Code 为例:
Migrate the payment endpoints from the old client to the new one.
Done means: every endpoint uses the new client, the old client is
deleted, and the test suite passes.
Stop and ask me only if a test fails for a reason you can't explain.别再叫它"好好想想"
怎么做。 从你的提示词和保存的指令里,把"仔细思考""逐步思考"这类话全部删掉。
为什么重要。 Opus 5.5 每次回复前都会自动思考,而且它自己决定想多深。你不需要提醒它去思考。在我们对一款聊天产品的测试中,删掉"仔细思考"这句话之后,回复速度变快了,质量没有明显下降。
具体方法。 直接删掉那句话就行。如果你想快速得到一个简单问题的答案,可以说:"直接回答。"想在 Claude Code 里调整它的思考深度,改 effort(投入档位)就行。
中途追加需求
怎么做。 如果在它工作的过程中你想起了什么,可以直接输入补充信息发送。
为什么重要。 现在任务运行时间更长了,重新开始的代价也更大。
具体方法。 在 Claude Code 里,趁它还在工作的时候输入消息然后按回车就行。比如:"顺便把旧的端点名称保留为别名。"
做设计时,说明你不要什么风格
怎么做。 当你让它做一个页面、应用或 artifact 时,列出你想排除的设计套路。
为什么重要。 如果不给设计方向,Opus 5.5 会用几种固定的默认风格。而"别太千篇一律"这种笼统指令,通常只是把一套默认换成另一套。给它一份具体的排除清单效果好得多。
具体方法。 列出你不要的设计元素:
Build a personal website with placeholder content.
Don't use a cream or off-white background, italic accent words in
headings, numbered "01 / 02 / 03" section labels, monospace labels, or
pill-shaped buttons.然后看看它给出了什么替代方案。如果还是不满意,把新发现的套路也加进排除清单,再来一次。
2. 在 Claude Code 里引导长任务
告诉它什么时候该停
怎么做。 在 CLAUDE.md 里写一条简短的规则,说明什么时候停下来问你,什么时候继续干。
为什么重要。 Opus 5.5 在工作过程中会随时汇报进度。但在长任务中,它有时候会停下来做汇报,而不是继续推进——比如列出下一步却不动手、问你"要继续吗?"、或者列出几个选项让你选(实际上哪个都不影响进度)。只要你用指令告诉它哪些情况下不用停,它就会照办。
具体方法。 把下面这段加进 CLAUDE.md,然后根据你的项目改改:
When a step doesn't need my input, keep going. Put status notes in the
same message as your next action.
Stop and ask only when you can't continue without me, or before anything
destructive: deleting data, force-pushing, or changing anything outside
this repository.如果它经常停下来问"要我继续吗?",回复"继续"就行。如果这种情况发生太频繁,上面的规则能解决问题。
让它少停意味着你自己要在高风险操作前多留个心眼。上面规则的最后一行就是干这个的。同时记得给破坏性命令保留权限提示。
如果是结对编程场景,你可能反而想要相反的节奏:开始前给一句简短计划,结束后来一段简短复盘。在 CLAUDE.md 里这么写就行。Opus 5.5 两种模式都能跟上。
让它把大任务分给子智能体
怎么做。 做代码审计、迁移或大规模代码审查时,让 Opus 5.5 把工作拆分到多个子智能体(subagent)并行处理,然后逐一核查结果。
为什么重要。 早期测试者让 Opus 5.5 在长时间的审计和迁移中协调多个并行子智能体,几乎不需要人工干预。
具体方法。
Audit every service in services/ for the retry bug in the linked issue.
Give each service to its own subagent. When a subagent reports back,
check its evidence before you accept it.
Finish with one table: service, affected yes or no, and the evidence.让任务清单落到文件里
怎么做。 如果一个任务要跑很久,让 Opus 5.5 把任务清单写在文件里,边做边更新。之后看文件就行,别翻聊天记录。
为什么重要。 现在任务运行时间更长了。长任务会填满上下文窗口,Claude Code 就会对前面的对话做摘要压缩。写在文件里的清单不会被压缩掉,一眼就能看出哪些做完了、哪些还剩着。
具体方法。 "在 TASKS.md 里维护一份清单。每完成一项就打钩,发现新问题就加上去。"
3. 检查结果
先看它需要你做什么
怎么做。 长任务结束后,先找它还在等你决定的事——比如它留了个未拍板的决策,或者有个改动需要你批准。然后再看它的总结报告。
为什么重要。 Opus 5.5 的工作汇报比 Opus 5 清晰多了。它的进度更新和最终总结会用直白的语言告诉你:做了什么、发现了什么、还需要你做什么。
具体方法。 想改总结格式的话,在 CLAUDE.md 里说明就行,比如:"每次运行结束后用三个标题汇报:等我决定的、已改动的、新发现的。"
让它先审查代码
怎么做。 让 Opus 5.5 在人工审查之前先审一遍 diff 或 PR。
为什么重要。 一位早期测试者说,Opus 5.5 在最低 effort 档位发现的 bug 比 Opus 5 在高 effort 档位还多,而且误报更少。它还会用通俗语言解释改动,所以 PR 描述也更容易看懂。
具体方法。 把这段提示词发给 Claude:
Review the diff on this branch against main.
List only problems you'd block the merge for. For each one, give the
file and line, why it's wrong, and how to show it fails.让它标记无法确认的信息
怎么做。 做研究和分析时,让它说清楚哪些信息找不到、或者没法核实。
为什么重要。 "这个我没找到"本身就是有价值的信息,而且主动要求标记能让你一眼看到。
具体方法。 在请求里加一句:"标记所有你无法确认的内容,并说明你在哪里找过。"这招在 Claude 研究报告和 Claude Code 里都管用。
4. 在 Claude 应用里使用
首先,确认模型选择器显示的是 Opus 5.5。
直接贴图表或截图
怎么做。 把图表、架构图、截图或幻灯片直接贴上来,别手动重新输入数字。
为什么重要。 Opus 5.5 读取图表、架构图和截图的准确度比 Opus 5 高了一截,而且不需要额外步骤。它对位置相关的语义理解也更强了——比如箭头连的是哪两个框、两版架构图之间有什么变化、日历截图里会议几点开始几点结束。
具体方法。 贴上图片,问一个具体的问题:"这些服务里哪几个直接调用了计费 API?"
让它检查长文档
怎么做。 给它一份长规划、报告或幻灯片,让它找错。
为什么重要。 Opus 5.5 比之前的 Opus 模型更注重细节。在我们的测试中,它在一个长规划讨论里发现了一个日期落在了错误的星期几,还发现了一份幻灯片里图表数据跟文字不一致。
具体方法。 发这样的提示词:"检查这份幻灯片里有没有自相矛盾的地方:数字、日期和人名。引用每个问题,并说明它出现在哪里。"
直接要成品文件
怎么做。 当你需要表格或文档时,直接要文件,别要大纲。
为什么重要。 Opus 5.5 生成的表格和文档,拿出去分享之前需要改的地方比 Opus 5 少多了。
具体方法。 "做一份我能直接分享的表格:每个供应商一行,列出成本、合同到期日和负责人。"
在项目里告诉它:已回答的问题不用重新想
怎么做。 如果长对话中追问感觉变慢了,加一条指令告诉它之前的回答已经定了。
为什么重要。 在长对话中,Opus 5.5 有时候在思考一个简短追问时会重新审视之前的回答。这会拖慢响应速度。
具体方法。 把这段加到项目指令里:
Once you have answered something, treat that answer as done. Focus on
what I'm asking now, and don't go back over an earlier answer unless I
ask about it or point out a problem with it.但如果项目需要做长线分析——后面的步骤可能会推翻前面的结论——就别加这条。
5. 消息被安全标记时
Opus 5.5 是第一款搭载了 Fable 级生物与网络安全护栏(safeguard)的 Opus 模型。在 Claude 应用和 Claude Code 里,被标记的消息大多会被切换到旧模型上继续处理。在源代码中查找安全漏洞是被允许的,日常的健康和教育类问题一般也没问题。这些安全护栏有时会误标正常工作,我们正在调优以减少误报。如果你被切换了模型,下面是你会看到的情况和应对方法。
在 Claude 应用里
你会看到什么。 一条通知,开头是"已切换到"加上旧模型的名字。Claude 会在那个模型上回答,之后对话也会一直停留在那个模型上。
怎么做。
想切回 Opus 5.5,在模型选择器里重新选就行。但如果之前触发标记的那条消息还在对话里,可能会再次被标记。开一个新对话可以避免这个问题。
想让系统切换前先征求你意见,去"设置" → "功能",关掉"消息被标记时自动切换模型"。之后你会看到一张"已暂停"的卡片,上面有你的选项。
安全检查覆盖整个对话的内容,包括文件和搜索结果。所以触发标记的可能是之前的内容,不一定是你刚发的那条消息。
在 Claude Code 里
你会看到什么。 一条通知,写着被切换到的旧模型名称。会话会在那个模型上继续。
怎么做。
运行
/model切回来。按两次 Esc 编辑你上一条消息,重新发送试试。
想让系统先问你再切换,运行
/config,修改"消息被标记时切换模型"的设置。如果你觉得标记有误,运行
/feedback反馈。
别让它在回复里展示推理过程
怎么做。 从你的提示词和指令里删掉所有要求它在回复中复述内部推理过程的句子。
为什么重要。 要求它在回复里复述内部推理可能会被拒绝——这是安全标记的触发类别之一。
具体方法。 换一种方式提需求,比如:"用三句话解释你为什么选了这个方案。"
6. 速度
来回对话时打开快速模式
怎么做。 在 Claude Code 里,对来回对话式的工作开启快速模式(fast mode)——就是你读完每条回复才发下一条消息那种。
为什么重要。 快速模式在 Opus 5.5 发布时就可用了,目前是研究预览。模型还是同一个,只是文本到得更快。需要开启额外用量,每个 token 的费用比标准模式略高。
具体方法。 在 Claude 里输入 /fast。
Opus 5.5 自检清单
在你下一个长任务开始前,过一遍这份清单。
提问
任务说清楚了什么算"做完了"
提示词和保存的指令里没有"仔细想想"之类的话
设计请求列出了要排除的风格
图表和截图是直接贴的,不是手动输入的
Claude Code 长任务
CLAUDE.md 写了什么时候继续、什么时候停下来问,以及在任何破坏性操作前停下来
破坏性命令的权限提示保持开启
大型审计和迁移拆分给了子智能体
任务清单写在文件里
检查结果
先看了报告里"需要你做的事"
人工审查之前先跑了一遍自动审查
研究结果标记了无法确认的部分
安全标记
知道怎么切回来:模型选择器,或
/model"消息被标记时切换模型"的设置已调成你想要的
开始用 Opus 5.5 吧!
感谢 Molly Vorwerck 审阅本文。