Claude Haiku 5.5Latest
For high-volume, latency-sensitive tasks such as classification, extraction, and routing
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- From $0.10/ MTok
- Output pricing
- From $0.50/ MTok
概要
Claude Haiku 5.5は、分類、ルーティング、抽出、サブエージェントタスクなど、大量かつ「latency」(レイテンシ)の影響を受けやすい作業向けに構築されています。「effort parameter」(エフォートパラメータ)を伴う「adaptive thinking」(適応型思考)、100万トークンの「context window」(コンテキストウィンドウ)、最大128kの出力トークンをサポートしています。Claude 4.7以降のモデルと同じ新しい「tokenizer」(トークナイザー)を使用しているため、同じテキストがClaude Haiku 4.5と比べて約30%多いトークンとしてカウントされます。その思考ブロックは、それを生成したアカウント、またはそれにリンクされたアカウントでのみ機能します。
コードの変更については、移行ガイドを参照してください。モデルID、料金、制限については、Claude Haiku 5.5の概要を参照してください。プロンプトのガイダンスについては、Claude Haiku 5.5へのプロンプトを参照してください。
他モデルとの比較
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 5.5This model | 1M | 128K | From $0.10 / $0.50 | Fastest | Adaptive | medium | Jun 2026 |
仕様
Model IDs
Pricing
- Input
- $0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
- Output
- $0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
- 5m cache write
- $0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
- 1h cache write
- $0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
- Cache read
- $0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
medium- Comparative latency
- Fastest
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- October 7, 2026
- Retirement
- Not sooner than October 7, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
知っておくべきこと
- 「adaptive thinking」(適応型思考)はデフォルトで有効です。思考の深さは「effort parameter」(エフォートパラメータ)で制御します。
temperature、top_p、top_kは省略してください。いずれかにデフォルト以外の値を指定すると400エラーが返されます。- Message Batches APIでは、Claude Haiku 5.5は
output-300k-2026-03-24ベータヘッダーを使用することで最大300kの出力トークンをサポートします。 - Models APIを使用して、制限と機能をプログラムで照会できます。
リソース
Claude Haiku 5.5に固有の動作の違いとプロンプトのパターン。
モデルとエフォートレベルの選択、プロンプトの構成、出力のストリーミングにより、より高速な応答を実現します。
Claude Haiku 5.5は、いつ、どの程度思考するかを自ら判断します。深さはeffortで調整します。
100万トークン。ウィンドウのカウント方法と管理方法。
リファレンス
Claude Haiku 5.5がclaude.aiおよびClaudeアプリで使用するシステムプロンプト。
Claude Haiku 5.5の安全性評価とデプロイに関する決定事項。
バッチ割引やプロンプトキャッシングの料金を含む、完全な料金表。
モデルID、エイリアス、固定スナップショットの仕組み。
すべてのClaudeモデルのライフサイクルステータスと廃止に関する約束事項。
Was this page helpful?