Claude Opus 5.5 提示词指南:努力级别、智能体、拒绝与模板
Claude Opus 5.5 提示词怎么写:依据 Anthropic 官方指南,讲清努力级别怎么选、智能体提示词模板、进度更新、拒绝原因和前端输出。
以 Markdown 阅读想给 Claude Opus 5.5 写好提示词:保留你在 Claude Opus 5 上用的提示词,先设置努力级别(effort),再改措辞;然后针对每个想改变的行为,在系统提示里加一句有针对性的指令。Anthropic 的指南说,现有的 Claude Opus 5 提示词“无需修改也应该表现良好”,而努力级别是“在智能、延迟和成本之间权衡时首先要调整的设置”。新增的建议大多和智能体有关:让无人值守的运行不中断、让长回合持续输出进度、给多个智能体组成的团队控制节奏。下文全部来自 Anthropic 的《Prompting Claude Opus 5.5》指南和该模型的 API 参考,核对于 2026 年 10 月 3 日。
与 Claude Fable 5.1 共用的请求规则,比如不能助手预填充、不能自定义 temperature,已在 Claude Fable 5.1 提示词指南里讲过。本文只讲 Claude Opus 5.5 特有的部分。
Claude Opus 5 的提示词在 Claude Opus 5.5 上能用吗?
能。Anthropic 说它们“无需修改也应该表现良好”,Claude Opus 5 的提示词写法“仍然是合理的起点”。变化在于模型怎么分配它的努力。Claude Opus 5.5 生成输出 token 的速度比 Claude Opus 5 快 30% 以上,完成同样的任务往往用更少的 token。
Anthropic 列出了模型进步的四个方面,它们决定了这份指南里哪些部分和你有关:
- 智能体编程与代码审查。 在真实代码仓库里完成多步骤工作、带子智能体的长时间自主运行,以及能抓出更多 bug、误报更少的代码审查。
- 知识工作。 写错数字或引错来源的可能性大大降低,还能在大量输入里发现细小的不一致,比如一个落在错误星期几上的日期。
- 沟通。 进度更新和最终报告会直接说清楚它做了什么、发现了什么、需要你提供什么。
- 图表、示意图、截图和计算机操作。 读取视觉材料比 Claude Opus 5 更准确,即使在最低努力级别下也是如此。
如果你的提示词主要用于聊天,读努力级别和聊天两节即可。如果你在运行智能体,新的建议都在智能体相关的几节里。
Claude Opus 5.5 应该用哪个努力级别?
从 medium 开始,这是 Claude Opus 5.5 的默认值(Claude Opus 5 默认是 high)。显式设置它,并用你自己的任务测试几个级别,不要直接沿用在 Claude Opus 5 上用的值。不同模型的努力级别名称并不对应相同的思考量:在 Anthropic 的测试中,medium 下的 Claude Opus 5.5“在编程和知识工作评测上达到或超过 high 下的 Claude Opus 5”,而在几项编程评测中,low 也接近这个水平,成本却低得多。
| 努力级别 | 典型用途(据 Anthropic 的 effort 文档) |
|---|---|
low | 需要最快速度和最低成本的简单任务,比如子智能体。如果你在 Claude Opus 5 上关闭过思考,也从这里开始。 |
medium | Claude Opus 5.5 的默认值。需要在速度、成本和效果之间取得平衡的智能体任务。 |
high | 复杂推理、困难的编程问题、智能体任务。 |
xhigh | 长时间运行的智能体和编程任务(超过 30 分钟)。只在测得质量提升时使用。 |
max | 最深的推理,不限制 token 消耗。只在测得质量提升时使用。 |
显式设置 medium 与不传 effort 的效果完全相同。
在同一级别下,Claude Opus 5.5 每个回合的思考往往比 Claude Opus 5 多,在 xhigh 和 max 下尤其明显。注意三点:
- 给
max_tokens留够空间。 即使你看不到思考内容,思考也计入max_tokens,所以按 Claude Opus 5 关闭思考时设定的上限可能会截断回复。对于长的智能体编程回合,Anthropic 发现把max_tokens设为该模型的上限 128,000 效果很好。 - 想让它少思考,先降努力级别,再考虑写“少想一点”。 降低努力级别比提示词指令更可靠地减少思考、成本和延迟。
- 依赖提示词缓存时,保持努力级别不变。 在请求之间更改顶层努力级别会让提示词缓存失效。
努力级别在 output_config 里设置:
{
"model": "claude-opus-5-5",
"max_tokens": 128000,
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Review this pull request for bugs and explain each one."}]
}Claude Opus 5.5 可以关闭思考吗?
不能。Claude Opus 5 在 high 及以下努力级别接受 "thinking": {"type": "disabled"};Claude Opus 5.5 不接受,这样的请求会返回 400 错误。思考是自适应的,并且始终开启。如果你的集成以前关闭了思考,Anthropic 建议做四处改动:
- 从
low努力级别开始并测量。 在low下,模型的思考很简短。如果首个 token 的延迟仍然重要,可以在系统提示里加一句“Answer directly without deliberating.”进一步减少思考,但加上后要检查质量。 - 删掉替代思考的指令。 如果提示词要求模型在回复里写出推理过程,删掉这句,改为从思考摘要里读取推理。现在,迫使模型在回复中复述推理过程的提示词可能会被拒绝(见下文拒绝一节)。
- 重新测试旧的变通做法。 为避免关闭思考时出现的问题而加的规则可能已经不需要了。任何要求模型不要思考的规则都要删掉。
- 按块类型读取响应。 响应不一定以
thinking块开头,所以要逐块检查类型,不要假设第一个块就是文本。
想看推理过程,就请求思考摘要:
{
"model": "claude-opus-5-5",
"max_tokens": 16000,
"thinking": {"type": "adaptive", "display": "summarized"},
"output_config": {"effort": "low"},
"messages": [{"role": "user", "content": "Which of these three invoices has a total that does not match its line items?"}]
}怎样让无人值守的 Claude Opus 5.5 智能体不提前停下?
在长任务中,Claude Opus 5.5 会边做边向用户汇报,其中一些汇报会以文本而不是工具调用结束回合(stop_reason: "end_turn")。如果智能体循环把每个这样的回合都当成“任务完成”,就会在半路停下。Anthropic 的解决办法分为运行框架(harness)和提示词两部分。
在运行框架里,把纯文本结束的回合当作一次汇报,而不是任务已完成的证明。把任务的各个部分放进一个由模型更新的清单,比如待办工具或一个文件。如果某个回合结束时还有未完成的项、又没有说明阻塞原因,就发一条简短的用户消息把它们列出来:
Your task list still has open items: migrate the remaining two endpoints and update their tests. Continue with them. If one is blocked, say what is blocking it.同一个任务自动续跑两三次后就停下,这样真正卡住的运行会结束,可以拿来复查。如果后台命令或子智能体还在运行,就等它结束,再把输出作为下一条用户消息返回。
在系统提示里,点名你不希望出现的提前停止方式。Anthropic 的示例是为完全无人值守的智能体写的,要从会话的第一个请求起就放在系统提示末尾。中途再加会改变系统提示,让对话中之前的思考块失效。
A standing instruction from the user, the person you are working for. It is about how your turns end. A message with no tool call in it ends your turn, and the work stops there until you are asked to continue. The user has seen you end turns in four ways while work they asked for was still owed, and does not want any of them. One: a long summary of what was done that closes by announcing the next step and has no tool call, so the next thing never starts. Two: an offer to carry on with something unless the user would prefer otherwise, which stops to wait for an answer the user was not going to give. Three: a list of decisions for the user when, by your own account, none of them blocks the rest of the work. Four: deciding that this is a good place to report, because the turn has been long or a milestone is done. Status notes are welcome, and so are your recommendations on open decisions, but put them in the same message as your next tool call and carry on with whatever does not depend on the user's answer. If you notice yourself inviting the user to redirect you or offering to wait, delete it and do the next thing. The stops the user does want are the ones where nothing can move without them, or where the thing blocking you is deliberately protected from you. This does not override the need for confirmation on risky or destructive actions.在有人参与的应用里不要加这段,因为有人会回答;对有风险或不可逆的操作,保留你自己的确认步骤。预计每个任务的工具调用和输出 token 会多一些。
怎样在 Claude Opus 5.5 智能体长时间运行时获得进度更新?
在两次工具调用之间,Claude Opus 5.5 会写简短的进度说明:刚发现了什么、接下来做什么。在这个模型上,这些说明以 thinking 块而不是 text 块返回,而且默认内容为空,所以只显示 text 块的客户端在长回合中看起来像没有动静。Anthropic 记录了一种 beta 显示模式,会返回每条说明的摘要;Claude Opus 5.5 API 参考列出了该接口文档中的 thinking.display 取值。
另有三个提示词和运行框架层面的手段,不需要任何特殊设置:
- 给模型一个发送原文内容的工具。 如果它可能需要在回合中途把某样东西原样交给用户,比如一段代码,就给它一个简单的“给用户发消息”工具,并说明只用于这种情况。从第一个请求起就声明这个工具;之后再加会让之前的思考块失效。
- 要求在固定节点汇报。 比如在第一次工具调用前用一句话说明打算做什么,结束时做个简短回顾。模型会严格遵循这类指令,在有人旁观时最有用。
- 由运行框架提醒长时间无输出的回合。 统计连续多少个工具调用步骤没有给用户任何可读内容。达到若干个之后,比如五个,就在最新的工具结果后追加一条提醒,提醒两三次后停止。Anthropic 的措辞:
The user hasn't heard from you in a while — say in a few words what you're doing, then continue.在 Anthropic 对智能体编程任务的测试中,这条提醒让出现长时间无输出的任务比例大约减半,成本没有可测量的变化。
怎样让 Claude Opus 5.5 智能体先查看上下文再动手?
Claude Opus 5.5 往往很快就开始干活。在跨越邮件、文档、电子表格和 CRM 记录的自动化流程中,任务所依赖的信息常常藏在请求没提到的地方,比如旧邮件线程里的一条政策,或另一个表格标签页上的一条规则。在系统提示里加一句话,就能让模型先四处看看:
Before taking any action, explore broadly with tool calls: list and open the emails, documents, spreadsheet tabs and records across the available apps that could be relevant to this task, including ones the task does not explicitly mention, and use what you find.在 Anthropic 对多应用任务的测试中,加了这句后模型正确完成的任务明显更多,medium 和 max 努力级别下都是如此,代价是工具调用略多。因为这句话要求模型根据找到的内容行动,所以不要让不可信的内容出现在它搜索的记录里。
怎样让多个 Claude Opus 5.5 智能体组成的团队更快完成?
Claude Opus 5.5 很关注已用时间。在由主智能体把工作分给子智能体的架构里,给它一个时间预算:让运行框架在每条返回给模型的消息末尾加一行简短的说明,比如 elapsed 340s / 1200s。模型会调整节奏,在预算内完成,而且通常远早于预算,所以把预算设得比你真正想花的时间稍长一些。如果无法估算预算,就只显示已用时间,并在系统提示里加上这句:
Time matters here: do not spend time that can be avoided, and the earlier a correct result is obtained, the better.预算只是建议,到了上限也不会强制停止,需要硬性截止就保留你自己的超时设置。收紧预算不等于降低努力级别:降低努力级别会减少工作本身,而预算主要让更多智能体并行工作。在时间压力下,模型的搜索和核验可能会少一些,所以要用你自己的任务检查答案质量。
聊天类系统提示应该让 Claude Opus 5.5“仔细思考”吗?
不应该。Anthropic 建议从聊天类系统提示中删掉“think carefully before answering”(回答前仔细思考)这类句子:思考多少由模型自己决定,控制手段是努力级别。在 Anthropic 对一款聊天产品的测试中,删掉这类句子后回复开始得更快,质量没有明显下降。
另外还有两句聊天场景值得了解。一句让模型把之前的回答视为已定,让后续回合更快开始;另一句标记用户粘贴进来的文本,让模型不去执行藏在邮件或网页里的指令。这两句的原文都在 Fable 5.1 提示词指南的 Claude Opus 5.5 一节里。在长篇分析和智能体任务中不要加“回答已定”那句,因为后面的步骤可能会暴露前面的错误。
怎样让 Claude Opus 5.5 更准确地读图表、示意图和截图?
先重新测试。不借助额外工具时,Claude Opus 5.5 读密集图表、流程图和日历截图的准确度远高于 Claude Opus 5;在 Anthropic 的测试中,它即使在最低努力级别下,从密集图表读取数值也比最高努力级别下的 Claude Opus 5 更准确。为旧模型搭的辅助流程可能已经不需要了。
对于最密集的输入,有两件事仍然有帮助:
- 更高分辨率的图片,对技术图纸最有用。
- 图像工具。 让模型作为智能体运行,并给它一个存放原始图片、装有 PIL 或 OpenCV 的容器,让它能裁剪、放大和测量。如果这太重,只给一个裁剪工具也有帮助。努力级别越高,模型用这些工具越好。
不用工具时,提高努力级别能改善它对技术图纸的读取,但对图表帮助不大。图片以带 URL 来源的 image 块放在用户回合里,格式见 API 参考。
怎样让 Claude Opus 5.5 的前端输出不再千篇一律?
点名你不想要的样式。没有设计方向时,Claude Opus 5.5 会退回几种默认风格,而“避免 AI 感的通用外观”这种笼统的话,大多只是把一种默认换成另一种。Anthropic 的示例列出了具体要避免的东西:
Output a vanilla HTML/CSS personal website with placeholder data. Do not use a cream or off-white background, italic accent words in headlines, numbered "01/02/03" section labels, monospace labels, or pill-shaped buttons.迭代着来:看看第一版改用了哪些样式,再把它们加进清单。
Claude Opus 5.5 为什么返回 stop_reason "refusal"?
是安全分类器拒绝了这个请求。Claude Opus 5.5 运行针对生物、网络安全和推理提取的分类器,拒绝会以一个正常响应返回,其中 stop_reason: "refusal",stop_details 对象会写明类别。
| 类别 | 涵盖什么 | 怎么办 |
|---|---|---|
| 生物 | 与 Claude Fable 5.1 相同的安全措施;如果你从 Claude Opus 5 迁移过来,这是新的。日常健康和教育类问题不受影响。 | 从事生命科学工作的机构可以申请 Anthropic 的 Life Sciences Verification Program。 |
| 网络安全 | 高风险的军民两用网络安全活动。 | 在源代码中查找漏洞是允许的,无需改动。 |
| 推理提取 | 迫使模型在回复里复述其内部推理过程的提示词。 | 删掉这些指令,设置 "display": "summarized",从思考块里读取。简短解释答案仍然可以。 |
关于无害请求被拒绝的一般情况,见 Fable 5.1 指南中的为什么 Claude 会拒绝一个无害的请求。
常见问题
有官方的 Claude Opus 5.5 提示词指南吗?
有。Anthropic 在开发者文档中发布了《Prompting Claude Opus 5.5》,另有一页适用于所有当前 Claude 模型的通用提示词最佳实践。本文总结的是截至 2026 年 10 月 3 日的 Opus 5.5 指南,模板为逐字引用。
Claude Opus 5.5 默认的努力级别是什么?
medium。Claude Opus 5 默认是 high。可选级别为 low、medium、high、xhigh 和 max,在 output_config.effort 中设置。
Claude Opus 5.5 最多能输出多少 token?
每个请求最多 128,000 个 token,这个上限包括思考。上下文窗口为 1M token。
可以预填充 Claude Opus 5.5 的回答或设置 temperature 吗?
不可以。助手预填充和默认值以外的任何 temperature 都会返回 400 错误,也不支持强制调用某个工具。请改为在提示词里描述你想要的格式。Fable 5.1 提示词指南说明了每种情况该用什么替代。
Claude Opus 5.5 和 Claude Fable 5.1,哪个更适合做智能体?
取决于任务和预算;Claude 模型对比讲了怎么选。两者的提示词建议主要差在默认值上:Claude Opus 5.5 从 medium 努力级别开始,Claude Fable 5.1 从 high 开始。
试试这些提示词
用一个 SeedRouter 密钥,通过 Anthropic SDK,或 OpenAI 的 Chat Completions 与 Responses 格式,在 Claude Opus 5.5 上运行这些模板。Claude Opus 5.5 API 参考列出了全部参数,模型页显示当前按 token 计的价格。SeedRouter 按量付费:一次充值,额度永不过期,失败的请求不收费。



