Claude Platform Docs
Model & hargaModel

Claude Sonnet 5.5Latest

The best combination of speed and intelligence

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$2/ MTok
Output pricing
$10/ MTok

Ikhtisar

Claude Sonnet 5.5 menawarkan kombinasi terbaik antara kecepatan dan kecerdasan. Lima "breaking change" (perubahan yang merusak kompatibilitas) memengaruhi kode yang sudah berjalan di Claude Sonnet 5:

Satu perubahan lagi mengubah bentuk respons tanpa menggagalkan permintaan apa pun: teks di antara pemanggilan alat dikembalikan dalam blok thinking. Aplikasi yang melakukan streaming teks tersebut kepada penggunanya akan menjadi senyap di antara pemanggilan alat hingga aplikasi tersebut menetapkan nilai display yang mengembalikan teks, atau mematikan pemikiran di awal dengan between_tools.

Yang baru di Claude Sonnet 5.5

Perbandingan

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.5This model1M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtended—Feb 2025

Spesifikasi

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$2 / MTok
Output
$10 / MTok
5m cache write
$2.50 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fast
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 28, 2026
Retirement
Not sooner than September 28, 2027

Hal yang perlu diketahui

  • "Adaptive thinking" (pemikiran adaptif) aktif secara default. Pengaturan thinking terendah adalah between_tools, yang menonaktifkan thinking di awal. Pengaturan ini berfungsi pada effort high atau lebih rendah. Lihat Yang baru di Claude Sonnet 5.5.
  • Mengatur temperature, top_p, atau top_k ke nilai non-default akan menghasilkan error 400.
  • Panjang prompt minimum yang dapat di-cache adalah 512 token. Lihat "Prompt caching" (caching prompt).
  • Pada Message Batches API, Claude Sonnet 5.5 mendukung hingga 300k token output dengan header beta output-300k-2026-03-24.
  • Kueri batas dan kemampuan secara terprogram dengan Models API.

Sumber daya

Perbedaan perilaku dan pola prompting yang khusus untuk Claude Sonnet 5.5.

Kontrol untuk kedalaman thinking, "latency" (latensi), dan biaya. Pilih level untuk setiap beban kerja.

Cara kerja pemikiran adaptif, pengaturan thinking yang diterima setiap model, dan cara blok thinking dipertahankan.

Referensi

Daftar harga lengkap, termasuk diskon batch dan tarif caching prompt.

Cara kerja ID model, alias, dan snapshot yang disematkan.

Status siklus hidup dan komitmen penghentian untuk setiap model Claude.

Was this page helpful?