模型與定價模型
Claude Haiku 5.5Latest
For high-volume, latency-sensitive tasks such as classification, extraction, and routing
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- From $0.10/ MTok
- Output pricing
- From $0.50/ MTok
概覽
Claude Haiku 5.5 專為大量且對延遲敏感的工作而打造,例如分類、路由、擷取以及子代理任務。它支援搭配 effort 參數的自適應思考、1M token 的上下文視窗,以及最多 128k 個輸出 token。它使用與 Claude 4.7 及更新模型相同的新版「tokenizer」(分詞器),因此相同的文字會比在 Claude Haiku 4.5 上多計算約 30% 的 token。其思考區塊僅能在產生它們的帳戶中使用,或在與該帳戶連結的帳戶中使用。
如需程式碼變更,請參閱遷移指南。如需模型 ID、定價與限制,請參閱 Claude Haiku 5.5 概覽。如需提示指引,請參閱為 Claude Haiku 5.5 撰寫提示。
比較
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 5.5This model | 1M | 128K | From $0.10 / $0.50 | Fastest | Adaptive | medium | Jun 2026 |
規格
Model IDs
Pricing
- Input
- $0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
- Output
- $0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
- 5m cache write
- $0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
- 1h cache write
- $0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
- Cache read
- $0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
medium- Comparative latency
- Fastest
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- October 7, 2026
- Retirement
- Not sooner than October 7, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
須知事項
- 「Adaptive thinking」(自適應思考)預設為開啟。請使用 effort 參數控制思考深度。
- 請省略
temperature、top_p和top_k,因為其中任何一個使用非預設值都會傳回 400 錯誤。 - 在 Message Batches API 上,Claude Haiku 5.5 搭配
output-300k-2026-03-24beta 標頭時,最多支援 300k 個輸出 token。 - 使用 Models API 以程式化方式查詢限制與功能。
資源
Claude Haiku 5.5 特有的行為差異與提示模式。
選擇模型與 effort 等級、調整提示,並串流輸出以獲得更快的回應。
Claude Haiku 5.5 會自行決定何時思考以及思考多少。使用 effort 引導思考深度。
1M 個 token。視窗的計算與管理方式。
參考資料
Claude Haiku 5.5 在 claude.ai 和 Claude 應用程式中使用的系統提示。
Claude Haiku 5.5 的安全性評估與部署決策。
完整價目表,包括批次折扣與提示快取費率。
模型 ID、別名與固定快照的運作方式。
每個 Claude 模型的生命週期狀態與退役承諾。
Was this page helpful?