Claude Platform Docs

Claude Haiku 5.5Latest

For high-volume, latency-sensitive tasks such as classification, extraction, and routing

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
From $0.10/ MTok
Output pricing
From $0.50/ MTok

Ikhtisar

Claude Haiku 5.5 dibuat untuk pekerjaan bervolume tinggi yang sensitif terhadap "latency" (latensi) seperti klasifikasi, perutean, ekstraksi, dan tugas subagen. Model ini mendukung "adaptive thinking" (pemikiran adaptif) dengan parameter effort, "context window" (jendela konteks) 1M token, dan hingga 128k token output. Model ini menggunakan tokenizer baru yang sama dengan Claude 4.7 dan model-model setelahnya, sehingga teks yang sama dihitung sebagai sekitar 30% lebih banyak token dibandingkan pada Claude Haiku 4.5. Blok pemikirannya hanya berfungsi di akun yang menghasilkannya, atau di akun yang terhubung dengannya.

Untuk perubahan kode, lihat panduan migrasi. Untuk ID model, harga, dan batasan, lihat ikhtisar Claude Haiku 5.5. Untuk panduan prompting, lihat Prompting Claude Haiku 5.5.

Yang baru di Claude Haiku 5.5

Perbandingannya

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.51M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 5.5This model1M128KFrom $0.10 / $0.50FastestAdaptivemediumJun 2026

Spesifikasi

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
Output
$0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
5m cache write
$0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
1h cache write
$0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
Cache read
$0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fastest
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
October 7, 2026
Retirement
Not sooner than October 7, 2027

Hal yang perlu diketahui

  • "Adaptive thinking" (pemikiran adaptif) aktif secara default. Kendalikan kedalaman pemikiran dengan parameter effort.
  • Hilangkan temperature, top_p, dan top_k, karena nilai non-default untuk salah satunya akan mengembalikan error 400.
  • Pada Message Batches API, Claude Haiku 5.5 mendukung hingga 300k token output dengan beta header output-300k-2026-03-24.
  • Kueri batas dan kemampuan secara terprogram dengan Models API.

Sumber daya

Perbedaan perilaku dan pola prompting yang khusus untuk Claude Haiku 5.5.

Pilih model dan tingkat effort, bentuk prompt, dan lakukan streaming output untuk respons yang lebih cepat.

Claude Haiku 5.5 memutuskan kapan dan seberapa banyak berpikir. Arahkan kedalamannya dengan effort.

1M token. Cara jendela dihitung dan dikelola.

Referensi

Prompt sistem yang digunakan Claude Haiku 5.5 di claude.ai dan aplikasi Claude.

Evaluasi keamanan dan keputusan deployment untuk Claude Haiku 5.5.

Daftar harga lengkap, termasuk diskon batch dan tarif caching prompt.

Cara kerja ID model, alias, dan snapshot yang disematkan.

Status siklus hidup dan komitmen penghentian untuk setiap model Claude.

Was this page helpful?