Claude Platform Docs
模型与定价Claude Haiku 5.5

Claude Haiku 5.5 的新功能

概述 Claude Haiku 5.5 中的新功能、破坏性变更和行为变更,并附有每项功能指南的链接以及代码变更迁移指南的链接。

Claude Haiku 5.5 专为高吞吐量、对延迟敏感的工作而构建,例如分类、路由、提取和子智能体任务。它支持带有 effort 参数的 adaptive thinking(自适应思考)、1M 令牌的上下文窗口,以及最多 128k 输出令牌。它使用与 Claude 4.7 及更高版本模型相同的较新 tokenizer(分词器),因此相同文本的令牌数比在 Claude Haiku 4.5 上多约 30%。它的 thinking block(思考块)仅在生成它们的账户或与该账户关联的账户中有效。

有关代码变更,请参阅迁移指南。有关模型 ID、定价和限制,请参阅 Claude Haiku 5.5 概述。有关提示指导,请参阅为 Claude Haiku 5.5 编写提示。

相对于 Claude Haiku 4.5 的变更摘要

每一行列出一项变更、该变更属于新增、变更还是破坏性变更,以及您的代码需要执行的操作。

变更类型所需操作
自适应思考和 effort新增可选:设置 effort 以在响应质量与速度和成本之间进行权衡。
更大的上下文窗口和输出新增无。现有的 max_tokens 值仍然有效,但思考令牌会计入其中。
浏览器使用工具新增无。可在 Claude API 和 Google Cloud 上使用。
安全分类器可以拒绝请求新增在您的客户端中处理 stop_reason: "refusal"。服务器端回退不可用。
手动扩展思考会返回错误破坏性用自适应思考替换 budget_tokens。
非默认采样参数会返回错误破坏性省略 temperature、top_p 和 top_k。
助手消息预填充会返回错误破坏性以用户轮次结束 messages。
在 Claude API 和 Google Cloud 上,计算机使用需要工具集破坏性用 computer_toolset_20260801 替换 computer_20250124。
更改较早的轮次会使思考块失效破坏性如果您将思考块发送回去,请保持对话仅追加。
响应可能以思考块开头变更按 type 而非位置选择内容块。
默认省略思考文本变更要接收摘要形式的思考,请将 thinking.display 设置为 "summarized"。
相同文本计为更多令牌变更重新计算提示的令牌数,并重新审视 max_tokens 和成本估算。
跨账户重放思考块变更如果您通过不同的账户重放存储的对话,请通过生成每个对话的账户来重放它。

新功能

自适应思考和 effort

借助自适应思考,Claude Haiku 5.5 会自行决定何时思考以及思考多少。自适应思考默认开启。虽然在 high effort 或更低级别时,您仍然可以使用 thinking: {"type": "disabled"} 关闭思考,但在响应质量与速度和成本之间进行权衡的更好方式是使用 effort 参数。

更大的上下文窗口和输出

Claude Haiku 5.5 拥有 1M 令牌的上下文窗口,并返回最多 128k 输出令牌,而 Claude Haiku 4.5 上分别为 200k 和 64k。现有的 max_tokens 值仍然有效,但思考令牌会计入 max_tokens,因此较小的限制可能会在 thinking 块之后、任何文本之前停止。请参阅配置思考。

行为变更

响应可能以思考块开头

自适应思考默认开启,因此即使请求中未提及思考,响应也可能以一个或多个 thinking 块开头。将第一个内容块读取为答案的代码需要按其 type 字段选择块。请参阅迁移指南中的配置思考。

相同文本计为更多令牌

Claude Haiku 5.5 使用与 Claude 4.7 及更高版本模型相同的较新分词器。与所有使用此分词器的模型一样,相同的输入文本在 Claude Haiku 5.5 上产生的令牌数比在 Claude Haiku 4.5 上多约 30%。确切的增幅取决于内容。请求和响应的结构不依赖于分词器,但您以令牌为单位衡量或预算的任何内容都会发生变化。请参阅迁移指南中的重新计算令牌。

跨账户重放思考块

来自 Claude Haiku 5.5 的思考块仅在生成它们的账户或与该账户关联的账户中有效。只有当您存储对话并通过不同的账户重放它们时,这一点才有影响。请参阅通过生成思考块的账户重放思考块。

Was this page helpful?