Claude Platform Docs
Model & hargaClaude Haiku 5.5

Yang baru di Claude Haiku 5.5

Ikhtisar kemampuan baru, perubahan yang merusak kompatibilitas, dan perubahan perilaku di Claude Haiku 5.5, dengan tautan ke panduan setiap fitur dan ke panduan migrasi untuk perubahan kode.

Claude Haiku 5.5 dibuat untuk pekerjaan bervolume tinggi yang sensitif terhadap "latency" (latensi) seperti klasifikasi, perutean, ekstraksi, dan tugas subagen. Model ini mendukung "adaptive thinking" (pemikiran adaptif) dengan parameter effort, "context window" (jendela konteks) 1M token, dan hingga 128k token output. Model ini menggunakan tokenizer baru yang sama dengan Claude 4.7 dan model-model setelahnya, sehingga teks yang sama dihitung sebagai sekitar 30% lebih banyak token dibandingkan pada Claude Haiku 4.5. Blok pemikirannya hanya berfungsi di akun yang menghasilkannya, atau di akun yang terhubung dengannya.

Untuk perubahan kode, lihat panduan migrasi. Untuk ID model, harga, dan batasan, lihat ikhtisar Claude Haiku 5.5. Untuk panduan prompting, lihat Prompting Claude Haiku 5.5.

Ringkasan perubahan dari Claude Haiku 4.5

Setiap baris menyebutkan satu perubahan, apakah perubahan tersebut baru, berubah, atau merusak kompatibilitas, dan apa yang harus dilakukan kode Anda.

PerubahanJenisTindakan yang diperlukan
Pemikiran adaptif dan effortBaruOpsional: atur effort untuk menyeimbangkan kualitas respons dengan kecepatan dan biaya.
Jendela konteks dan output yang lebih besarBaruTidak ada. Nilai max_tokens yang ada tetap valid, tetapi token pemikiran dihitung terhadapnya.
Alat browser useBaruTidak ada. Tersedia di Claude API dan Google Cloud.
Pengklasifikasi keamanan dapat menolak permintaanBaruTangani stop_reason: "refusal" di klien Anda. Fallback sisi server tidak tersedia.
Pemikiran diperpanjang manual mengembalikan errorMerusak kompatibilitasGanti budget_tokens dengan pemikiran adaptif.
Parameter sampling non-default mengembalikan errorMerusak kompatibilitasHilangkan temperature, top_p, dan top_k.
Prefill pesan asisten mengembalikan errorMerusak kompatibilitasAkhiri messages dengan giliran pengguna.
Computer use memerlukan toolset di Claude API dan Google CloudMerusak kompatibilitasGanti computer_20250124 dengan computer_toolset_20260801.
Mengubah giliran sebelumnya membatalkan blok pemikiranMerusak kompatibilitasPertahankan percakapan hanya-tambah (append-only) jika Anda mengirim kembali blok pemikiran.
Respons dapat dimulai dengan blok pemikiranBerubahPilih blok konten berdasarkan type, bukan berdasarkan posisi.
Teks pemikiran dihilangkan secara defaultBerubahUntuk menerima pemikiran yang diringkas, atur thinking.display ke "summarized".
Teks yang sama dihitung sebagai lebih banyak tokenBerubahHitung ulang prompt dan tinjau kembali max_tokens serta estimasi biaya.
Memutar ulang blok pemikiran lintas akunBerubahJika Anda memutar ulang percakapan tersimpan melalui akun yang berbeda, putar ulang masing-masing melalui akun yang menghasilkannya.

Kemampuan baru

Pemikiran adaptif dan effort

Dengan pemikiran adaptif, Claude Haiku 5.5 memutuskan kapan dan seberapa banyak berpikir. Pemikiran adaptif aktif secara default. Meskipun Anda masih dapat menonaktifkan pemikiran dengan thinking: {"type": "disabled"} pada effort high atau di bawahnya, cara yang lebih baik untuk menyeimbangkan kualitas respons dengan kecepatan dan biaya adalah menggunakan parameter effort.

Jendela konteks dan output yang lebih besar

Claude Haiku 5.5 memiliki jendela konteks 1M token dan mengembalikan hingga 128k token output, naik dari 200k dan 64k pada Claude Haiku 4.5. Nilai max_tokens yang ada tetap valid, tetapi token pemikiran dihitung terhadap max_tokens, sehingga batas yang kecil dapat berhenti setelah blok thinking dan sebelum teks apa pun. Lihat Konfigurasikan thinking.

Perubahan perilaku

Respons dapat dimulai dengan blok pemikiran

Pemikiran adaptif aktif secara default, sehingga respons dapat dimulai dengan satu atau lebih blok thinking bahkan ketika permintaan tidak menyebutkan pemikiran. Kode yang membaca blok konten pertama sebagai jawaban perlu memilih blok berdasarkan field type-nya. Lihat Konfigurasikan thinking di panduan migrasi.

Teks yang sama dihitung sebagai lebih banyak token

Claude Haiku 5.5 menggunakan tokenizer baru yang sama dengan Claude 4.7 dan model-model setelahnya. Seperti semua model yang menggunakan tokenizer ini, teks input yang sama menghasilkan sekitar 30% lebih banyak token pada Claude Haiku 5.5 dibandingkan pada Claude Haiku 4.5. Peningkatan pastinya bergantung pada konten. Bentuk permintaan dan respons tidak bergantung pada tokenizer, tetapi apa pun yang Anda ukur atau anggarkan dalam token akan berubah. Lihat Hitung ulang token di panduan migrasi.

Memutar ulang blok pemikiran lintas akun

Blok pemikiran dari Claude Haiku 5.5 hanya berfungsi di akun yang menghasilkannya, atau di akun yang terhubung dengannya. Hal ini hanya penting jika Anda menyimpan percakapan dan memutarnya ulang melalui akun yang berbeda. Lihat Putar ulang blok thinking melalui akun yang menghasilkannya.

Was this page helpful?