Claude Platform Docs

Claude Haiku 5.5Latest

For high-volume, latency-sensitive tasks such as classification, extraction, and routing

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
From $0.10/ MTok
Output pricing
From $0.50/ MTok

概覽

Claude Haiku 5.5 專為大量且對延遲敏感的工作而打造,例如分類、路由、擷取以及子代理任務。它支援搭配 effort 參數的自適應思考、1M token 的上下文視窗,以及最多 128k 個輸出 token。它使用與 Claude 4.7 及更新模型相同的新版「tokenizer」(分詞器),因此相同的文字會比在 Claude Haiku 4.5 上多計算約 30% 的 token。其思考區塊僅能在產生它們的帳戶中使用,或在與該帳戶連結的帳戶中使用。

如需程式碼變更,請參閱遷移指南。如需模型 ID、定價與限制,請參閱 Claude Haiku 5.5 概覽。如需提示指引,請參閱為 Claude Haiku 5.5 撰寫提示。

Claude Haiku 5.5 的新功能

比較

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.51M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 5.5This model1M128KFrom $0.10 / $0.50FastestAdaptivemediumJun 2026

規格

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
Output
$0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
5m cache write
$0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
1h cache write
$0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
Cache read
$0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fastest
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
October 7, 2026
Retirement
Not sooner than October 7, 2027

須知事項

  • 「Adaptive thinking」(自適應思考)預設為開啟。請使用 effort 參數控制思考深度。
  • 請省略 temperature、top_p 和 top_k,因為其中任何一個使用非預設值都會傳回 400 錯誤。
  • 在 Message Batches API 上,Claude Haiku 5.5 搭配 output-300k-2026-03-24 beta 標頭時,最多支援 300k 個輸出 token。
  • 使用 Models API 以程式化方式查詢限制與功能。

資源

Claude Haiku 5.5 特有的行為差異與提示模式。

選擇模型與 effort 等級、調整提示,並串流輸出以獲得更快的回應。

Claude Haiku 5.5 會自行決定何時思考以及思考多少。使用 effort 引導思考深度。

1M 個 token。視窗的計算與管理方式。

參考資料

Claude Haiku 5.5 在 claude.ai 和 Claude 應用程式中使用的系統提示。

Claude Haiku 5.5 的安全性評估與部署決策。

完整價目表,包括批次折扣與提示快取費率。

模型 ID、別名與固定快照的運作方式。

每個 Claude 模型的生命週期狀態與退役承諾。

Was this page helpful?