Claude Platform Docs
模型与定价Claude Opus 5.5

Claude Opus 5.5 的新功能

Claude Opus 5.5 中的破坏性变更、功能支持和行为差异概述。

Claude Opus 5.5 专为长时间运行的智能体编码和知识工作而构建,定价为每百万输入/输出令牌 $4 / $20 美元。有四项"breaking changes"(破坏性变更)会影响已在 Claude Opus 5 上运行的代码:无法禁用思考强制工具使用会返回错误思考块与模型和对话绑定,以及在 Claude API 和 Google Cloud 上不再接受早期的 computer_20251124 计算机使用工具。前三项同样适用于 Claude Fable 5.1。另有一项变更会改变响应结构,但不会导致任何请求失败:工具调用之间的文本以 thinking 块返回,在默认的 display 设置下,这些块中的文本为空。如果应用程序将这些文本作为进度更新流式传输给用户,那么在它设置一个会返回文本的 display 值之前,它在工具调用之间将保持静默。

新模型

模型Claude API ID描述
Claude Opus 5.5适用于长时间运行的智能体编码和知识工作

自适应思考始终开启,effort 参数控制思考深度;该模型上的默认值为 medium。有关上下文窗口、输出限制、知识截止日期和价格,请参阅 Claude Opus 5.5 模型页面;有关所有当前模型,请参阅模型概览

破坏性变更

无法禁用思考

在 Claude Opus 5 上,思考默认开启,并且在 effort 为 high 或更低时接受 thinking: {"type": "disabled"}。在 Claude Opus 5.5 上,思考始终开启:设置了 thinking: {"type": "disabled"} 的请求,或使用 thinking: {"type": "enabled", "budget_tokens": N} 手动设置预算的请求,都会返回 400 invalid_request_error。请省略 thinking 字段,或发送与之等效的 thinking: {"type": "adaptive"}。此变更不涉及任何 beta 标头。

错误消息如下:

"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
"thinking.type.enabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

effort 参数是控制思考深度、延迟和成本的手段:在您之前禁用思考的地方降低该参数;优化成本与智能提供了用于选择级别的实测结果。由于每个响应都可能以一个或多个 thinking 块开头(在默认的 display: "omitted" 下,这些块返回时 thinking 字段为空),请按内容块的 type 字段而非位置来选择内容块,并在工具使用循环中原样传回 thinking 块。已在 Claude Opus 5 上开启思考运行的代码无需更改。请参阅思考以及迁移指南中的变更前后对比

不支持强制工具使用

Claude Opus 5.5 不支持"forced tool use"(强制工具使用)。将 tool_choice 设置为 {"type": "any"}{"type": "tool", "name": "..."} 会返回 400 invalid_request_error

tool_choice: type "tool" and "any" are not supported for this model.

支持 tool_choice: {"type": "auto"}(默认值)和 {"type": "none"},并且相同的验证也适用于令牌计数端点。如需符合 schema 的 JSON,请保留 tool_choice: {"type": "auto"} 并通过严格工具使用设置 strict: true,或将 schema 移至结构化输出。若要让模型调用工具而不是以文本回复,请在提示中说明何时适用该工具。迁移指南展示了变更前后对比

思考块与模型和对话绑定

每个思考块都会记录生成它的模型,每个模型都能读取自己的块,但只能读取部分其他模型的块。Claude Opus 5.5 可以读取来自 Claude Opus 5 以及更早的 Opus、Sonnet 和 Haiku 模型的思考块,但不能读取来自 Claude Fable 或 Claude Mythos 模型的思考块。在 Claude API 上,Claude Fable 5.1 和 Claude Mythos 5.1 可以读取来自 Claude Opus 5.5 的思考块;其他模型均不能。从 Claude Opus 5 切换到 Claude Opus 5.5 的对话,或在 Claude API 上从 Claude Opus 5.5 升级到 Claude Fable 5.1 或 Claude Mythos 5.1 的对话,会保留其推理内容。从 Claude Opus 5.5 切换到这两个模型以外的任何模型的对话,或从 Claude Fable 或 Claude Mythos 模型切换到 Claude Opus 5.5 的对话,在切换后的轮次中将不带有先前模型的推理内容。当请求携带目标模型无法读取的块时,API 会在模型看到之前将其丢弃:请求会成功,且被丢弃的块不计费。使用 thinking-binding-controls-2026-08-01 beta 标头时,丢弃情况会在顶层的 input_transformations 数组中报告。请参阅在对话中途切换模型

API 还会检查 Claude Opus 5.5 思考块之前的任何内容(system 提示、tools 或更早的消息)自该块生成以来是否发生了变化。与 Claude Fable 5.1 一样,对于在 2026 年 8 月 31 日 00:00 UTC 或之后创建的账户,无论是在 Claude API 还是云平台上,API 都会默认强制执行该检查。在这些账户上,如果请求在发生此类变化后重放某个块,将返回 400 错误。若要改为丢弃受影响的块,请发送 thinking-binding-controls-2026-08-01 beta 标头,并将 thinking.block_binding.prefix_mismatch_behavior 设置为 "drop_block"。在较早的账户上,将该字段设置为任一值都会使请求选择启用此检查。请保持对话只追加不修改,这样就不会出现此问题:使用对话中途的系统消息来更改指令或工具,而不是进行编辑。请参阅保留思考以及迁移指南中关于此变更的说明

Claude API 和 Google Cloud 上不支持 computer_20251124 计算机使用工具

Claude Opus 5 既接受以 computer_toolset_20260801 工具集形式使用的计算机使用,也接受在使用 computer-use-2025-11-24 beta 标头时以早期 computer_20251124 工具形式使用的计算机使用。在 Claude API 和 Google Cloud 上,Claude Opus 5.5 仅支持工具集:声明了 computer_20251124 工具的请求会返回 400 invalid_request_error。该消息会指出被拒绝的类型,然后在 Did you mean one of 之后列出模型接受的工具类型(其中包括 computer_toolset_20260801);其开头如下:

'claude-opus-5-5' does not support tool types: computer_20251124.

若要迁移 Claude API 或 Google Cloud 上的现有集成,请按照computer_20251124 迁移操作:移除 beta 标头,将 tools 条目替换为 {"type": "computer_toolset_20260801"},并更新您的智能体循环以处理成员 tool_use 块、批量操作以及结果中的 toolset_name。在 Amazon Bedrock 上,早期的 computer_20251124 工具在 Claude Opus 5.5 上仍可像在 Claude Opus 5 上一样正常工作,因此无需更改。有关其他平台,请参阅计算机使用工具的兼容性部分。已经使用工具集的集成以及浏览器使用工具无需更改。迁移指南展示了请求的变更前后对比

功能支持

Claude Opus 5.5 支持按消息设置的 effort(beta)、对话中途的系统消息任务预算、最小可缓存提示为 512 个令牌的提示缓存批处理Files APIPDF 支持视觉,以及服务器端和客户端工具。在 Claude API 和 Google Cloud 上,计算机使用需要 computer_toolset_20260801 工具集(请参阅破坏性变更)。有关模型可用性,请参阅各功能的页面。

快速模式

快速模式(研究预览版)仅在 Claude API 上对 Claude Opus 5.5 可用;在 Amazon Bedrock、Claude Platform on AWS、Google Cloud 或 Microsoft Foundry 上不可用。请在使用 fast-mode-2026-02-01 beta 标头的同时设置 speed: "fast"。有关访问权限、支持的模型和定价,请参阅快速模式

在消息中定义工具(beta)

使用 inline-tools-2026-09-15 beta 标头时,对话中途系统消息中的 tool_addition 块可以携带完整的工具定义而非引用,因此您可以在对话中途添加工具、更改其 schema,或将服务器工具升级到更新版本,而无需编辑 tools,也不会丢失提示缓存。这适用于所有支持在对话中途更改工具的模型,包括 Claude Opus 5.5。请参阅在消息中定义工具

按需压缩(beta)

使用 compact-2026-09-04 beta 标头时,发送顶层 compaction 参数的请求会返回一个经过签名的 compaction 块,其中总结了整个对话,之后您可以将其放在最前面发送,以替代被总结的消息。该功能可用于支持压缩的模型,包括 Claude Opus 5.5。您可以自行选择何时压缩,请求可以在后台运行,并且您保留的轮次中的思考块在替换后仍可保持有效(需满足压缩与保留思考中的条件),这一点在 Claude Opus 5.5 上尤为重要,因为其思考块与对话绑定。有关平台可用性和完整的请求流程,请参阅按需压缩

行为差异

Claude Opus 5.5 与 Claude Opus 5 在若干方面存在差异,这些差异无需任何代码更改就会显现。每项差异在为 Claude Opus 5.5 编写提示 中都有相应指导:

  • 默认 effort 为 medium 省略 effort 的请求以 medium 运行;在 Claude Opus 5 上则以 high 运行。请显式设置 effort 并重新运行您的参数扫描;请参阅校准 effort
  • 在给定 effort 级别下每轮思考更多。 在相同的 effort 设置下,该模型每轮的思考往往比 Claude Opus 5 更多,在 xhighmax 下尤为明显。请重新运行 effort 扫描,而不是沿用原有设置,并在 max_tokens 中为思考预留空间。请参阅校准 effort
  • 工具调用之间的文本以思考块返回。 模型在工具调用之间编写的简短说明会以进度更新 thinking而非 text 块的形式返回,因此在默认的 display: "omitted" 下,将这些内容流式传输给用户的应用程序在工具调用之间会保持静默,且不会出现任何错误。迁移指南提供了接收这些内容的修复方法,面向用户的进度更新介绍了如何请求更多此类更新。
  • 更多安全防护类别。 除网络安全分类器外,该模型还运行生物安全分类器,并且促使模型在响应文本中复现其内部推理的请求可能会以 reasoning_extraction 类别被拒绝。请参阅拒绝与回退安全防护拒绝
  • 对图表、示意图和屏幕截图的解读更加精准。 该模型无需工具即可更精确地从密集图表和依赖布局的视觉内容中读取数值,因此为早期模型构建的提示端视觉变通方法可能不再需要;对于最密集的输入,图像工具仍能提高准确性。请参阅用于复杂视觉输入的工具

如果您的 Claude Opus 5 集成是在禁用思考的情况下运行的,请结合破坏性变更参阅为禁用思考而编写的提示。有关智能体编码与代码审查、知识工作、沟通、视觉输入和计算机使用方面的能力提升,请参阅与提示相关的能力

拒绝与回退

Claude Opus 5.5 附带安全分类器,拒绝与回退中的所有内容均适用。被拒绝的请求会返回 HTTP 200,其中包含 stop_reason: "refusal" 以及一个指明政策领域的 stop_details 对象,因此请处理拒绝并配置回退:通过服务器端回退fallbacks: "default",处于 beta 阶段,会在 Anthropic 针对该类别推荐的模型上重试)、SDK 中间件或您自己的重试逻辑在另一个模型上重试。

定价

Claude Opus 5.5 的价格为每百万输入令牌 $4 美元、每百万输出令牌 $20 美元,低于 Claude Opus 5 的 $5 和 $25;5 分钟缓存写入为每百万令牌 $5,1 小时缓存写入为 $8,缓存读取为 $0.20(基础输入价格的 0.05 倍)。批处理为半价:$2 和 $10。有关数据驻留和工具定价,请参阅定价

可用性

Claude Opus 5.5 可在以下平台使用:

从 Claude Opus 5 迁移

更新您的模型 ID:

model = "claude-opus-5"  # Before
model = "claude-opus-5-5"  # After

然后移除所有 thinking: {"type": "disabled"}thinking: {"type": "enabled", ...} 设置,改为选择一个 effort 级别。将 tool_choice 类型 anytool 替换为 auto 并配合严格工具使用。如果您在 Claude API 或 Google Cloud 上通过 computer_20251124 使用计算机使用功能,请迁移到工具集。如果您的界面会显示工具调用之间的文本,还需设置 thinking.display;请参阅工具调用之间的文本在思考块中返回。有关从 Claude Opus 5 及更早模型迁移的分步说明以及完整的检查清单,请参阅迁移指南

后续步骤

所有当前 Claude 模型的完整规格和定价。

将代码从 Claude Opus 5 及更早模型迁移到 Claude Opus 5.5。

Claude Opus 5.5 特有的行为差异和提示模式。

控制 Claude 在响应时使用的令牌数量,从 low 到 max。

自适应思考的工作原理以及思考块的保留方式。

处理 stop_reason: "refusal" 并在另一个模型上重试。

Was this page helpful?