模型与定价模型
Claude Opus 5.5Latest
For long-running agentic coding and knowledge work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $4/ MTok
- Output pricing
- $20/ MTok
概述
Claude Opus 5.5 专为长时间运行的智能体编码和知识工作而构建,定价为每百万输入/输出令牌 $4 / $20 美元。有四项"breaking changes"(破坏性变更)会影响已在 Claude Opus 5 上运行的代码:无法禁用思考、强制工具使用会返回错误、思考块与模型和对话绑定,以及在 Claude API 和 Google Cloud 上不再接受早期的 computer_20251124 计算机使用工具。前三项同样适用于 Claude Fable 5.1。另有一项变更会改变响应结构,但不会导致任何请求失败:工具调用之间的文本以 thinking 块返回,在默认的 display 设置下,这些块中的文本为空。如果应用程序将这些文本作为进度更新流式传输给用户,那么在它设置一个会返回文本的 display 值之前,它在工具调用之间将保持静默。
对比情况
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5This model | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
规格
Model IDs
Pricing
- Input
- $4 / MTok
- Output
- $20 / MTok
- 5m cache write
- $5 / MTok
- 1h cache write
- $8 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive (always on)
- Default effort
medium- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 22, 2026
- Retirement
- Not sooner than September 22, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
须知事项
- "Adaptive thinking"(自适应思考)始终开启,且无法关闭。您可以使用 effort 参数控制思考深度。
- 在 Message Batches API 上,使用
output-300k-2026-03-24beta 标头时,Claude Opus 5.5 最多支持 300k 个输出令牌。 - 最小可缓存提示长度为 512 个令牌。请参阅提示缓存。
- 使用 Models API 以编程方式查询限制和功能。
资源
Claude Opus 5.5 特有的行为差异和提示模式。
用于控制思考深度、延迟和成本的设置。请为每种工作负载选择合适的级别。
自适应思考的工作原理以及思考块的保留方式。
Claude API 上更低延迟的 Claude Opus 5.5(研究预览版),单独定价。
参考
Claude Opus 5.5 在 claude.ai 和 Claude 应用中使用的系统提示。
Claude Opus 5.5 的安全评估和部署决策。
完整价目表,包括批处理折扣和提示缓存费率。
模型 ID、别名和固定快照的工作方式。
每个 Claude 模型的生命周期状态和退役承诺。
Was this page helpful?