Claude Haiku 5.5Latest
For high-volume, latency-sensitive tasks such as classification, extraction, and routing
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- From $0.10/ MTok
- Output pricing
- From $0.50/ MTok
Ikhtisar
Claude Haiku 5.5 dibuat untuk pekerjaan bervolume tinggi yang sensitif terhadap "latency" (latensi) seperti klasifikasi, perutean, ekstraksi, dan tugas subagen. Model ini mendukung "adaptive thinking" (pemikiran adaptif) dengan parameter effort, "context window" (jendela konteks) 1M token, dan hingga 128k token output. Model ini menggunakan tokenizer baru yang sama dengan Claude 4.7 dan model-model setelahnya, sehingga teks yang sama dihitung sebagai sekitar 30% lebih banyak token dibandingkan pada Claude Haiku 4.5. Blok pemikirannya hanya berfungsi di akun yang menghasilkannya, atau di akun yang terhubung dengannya.
Untuk perubahan kode, lihat panduan migrasi. Untuk ID model, harga, dan batasan, lihat ikhtisar Claude Haiku 5.5. Untuk panduan prompting, lihat Prompting Claude Haiku 5.5.
Perbandingannya
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 5.5This model | 1M | 128K | From $0.10 / $0.50 | Fastest | Adaptive | medium | Jun 2026 |
Spesifikasi
Model IDs
Pricing
- Input
- $0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
- Output
- $0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
- 5m cache write
- $0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
- 1h cache write
- $0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
- Cache read
- $0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
medium- Comparative latency
- Fastest
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- October 7, 2026
- Retirement
- Not sooner than October 7, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Hal yang perlu diketahui
- "Adaptive thinking" (pemikiran adaptif) aktif secara default. Kendalikan kedalaman pemikiran dengan parameter effort.
- Hilangkan
temperature,top_p, dantop_k, karena nilai non-default untuk salah satunya akan mengembalikan error 400. - Pada Message Batches API, Claude Haiku 5.5 mendukung hingga 300k token output dengan beta header
output-300k-2026-03-24. - Kueri batas dan kemampuan secara terprogram dengan Models API.
Sumber daya
Perbedaan perilaku dan pola prompting yang khusus untuk Claude Haiku 5.5.
Pilih model dan tingkat effort, bentuk prompt, dan lakukan streaming output untuk respons yang lebih cepat.
Claude Haiku 5.5 memutuskan kapan dan seberapa banyak berpikir. Arahkan kedalamannya dengan effort.
1M token. Cara jendela dihitung dan dikelola.
Referensi
Prompt sistem yang digunakan Claude Haiku 5.5 di claude.ai dan aplikasi Claude.
Evaluasi keamanan dan keputusan deployment untuk Claude Haiku 5.5.
Daftar harga lengkap, termasuk diskon batch dan tarif caching prompt.
Cara kerja ID model, alias, dan snapshot yang disematkan.
Status siklus hidup dan komitmen penghentian untuk setiap model Claude.
Was this page helpful?