Claude Platform Docs
模型與定價模型

Claude Sonnet 5.5Latest

The best combination of speed and intelligence

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$2/ MTok
Output pricing
$10/ MTok

概覽

Claude Sonnet 5.5 提供速度與智慧的最佳組合。有五項「breaking changes」(破壞性變更)會影響已在 Claude Sonnet 5 上執行的程式碼:

另有一項變更會改變回應的結構,但不會導致任何請求失敗:工具呼叫之間的文字會以 thinking 區塊傳回。若應用程式會將這些文字串流給使用者,則在工具呼叫之間將不會有任何輸出,直到它設定會傳回文字的 display 值,或使用 between_tools 關閉預先思考為止。

Claude Sonnet 5.5 的新功能

比較

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.5This model1M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtended—Feb 2025

規格

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$2 / MTok
Output
$10 / MTok
5m cache write
$2.50 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fast
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 28, 2026
Retirement
Not sooner than September 28, 2027

須知

  • 「Adaptive thinking」(自適應思考)預設為開啟。最低的思考設定是 between_tools,它會關閉預先思考。此設定適用於 high 或更低的「effort」(努力程度)等級。請參閱 Claude Sonnet 5.5 的新功能。
  • 將 temperature、top_p 或 top_k 設為非預設值會傳回 400 錯誤。
  • 最小可快取提示長度為 512 個 token。請參閱提示快取。
  • 在 Message Batches API 上,Claude Sonnet 5.5 搭配 output-300k-2026-03-24「beta header」(beta 標頭)時,最多支援 300k 個輸出 token。
  • 使用 Models API 以程式方式查詢限制與功能。

資源

Claude Sonnet 5.5 特有的行為差異與提示模式。

控制思考深度、延遲與成本的設定。請依每個工作負載選擇等級。

自適應思考的運作方式、各模型接受哪些思考設定,以及思考區塊如何被保留。

參考

完整價目表,包括批次折扣與提示快取費率。

模型 ID、別名與固定快照的運作方式。

每個 Claude 模型的生命週期狀態與停用承諾。

Was this page helpful?