Claude Platform Docs
模型与定价模型

Claude Sonnet 5.5Latest

The best combination of speed and intelligence

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$2/ MTok
Output pricing
$10/ MTok

概述

Claude Sonnet 5.5 兼顾速度与智能,是两者的最佳组合。有五项 "breaking changes"(破坏性变更)会影响已在 Claude Sonnet 5 上运行的代码:

另有一项变更会改变响应结构,但不会导致任何请求失败:工具调用之间的文本以 thinking 块的形式返回。如果应用程序会将这些文本流式传输给用户,那么在工具调用之间,应用程序将不再输出任何内容。要恢复输出,需设置一个会返回该文本的 display 值,或使用 between_tools 关闭前置思考。

Claude Sonnet 5.5 的新变化

对比

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.5This model1M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtended—Feb 2025

规格

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$2 / MTok
Output
$10 / MTok
5m cache write
$2.50 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fast
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 28, 2026
Retirement
Not sooner than September 28, 2027

须知

  • "Adaptive thinking"(自适应思考)默认开启。最低的思考设置是 between_tools,它会关闭前置思考。它适用于 high 或更低的 "effort"(努力程度)级别。请参阅 Claude Sonnet 5.5 的新功能。
  • 将 temperature、top_p 或 top_k 设置为非默认值会返回 400 错误。
  • 最小可缓存提示长度为 512 个令牌。请参阅提示缓存。
  • 在 Message Batches API 上,Claude Sonnet 5.5 通过 output-300k-2026-03-24 beta 标头支持最多 300k 个输出令牌。
  • 使用 Models API 以编程方式查询限制和功能。

资源

Claude Sonnet 5.5 特有的行为差异和提示模式。

用于控制思考深度、"latency"(延迟)和成本的设置。为每个工作负载选择一个级别。

自适应思考的工作原理、每个模型接受哪些思考设置,以及思考块如何保留。

参考

完整价格表,包括批处理折扣和提示缓存费率。

模型 ID、别名和固定快照的工作原理。

每个 Claude 模型的生命周期状态和停用承诺。

Was this page helpful?