Claude Platform Docs
Model & hargaClaude Opus 5

Apa yang baru di Claude Opus 5

Ikhtisar fitur baru dan perubahan perilaku di Claude Opus 5.

Claude Opus 5 adalah peningkatan lompatan besar dibandingkan Claude Opus 4.8, dengan kemajuan terbesar dalam penalaran mendalam, tugas agentik dan berjangka panjang, serta penskalaan komputasi saat pengujian (test-time compute scaling). Halaman ini merangkum semua yang baru di Claude Opus 5, termasuk perubahan alat di tengah percakapan dan dua perubahan yang merusak kompatibilitas (breaking changes) untuk kode yang berjalan di Claude Opus 4.8: thinking aktif secara default, dan thinking hanya dapat dinonaktifkan pada effort high atau lebih rendah.

Model baru

ModelID model APIDeskripsi
Claude Opus 5claude-opus-5Untuk pengodean agentik yang kompleks dan pekerjaan enterprise

Claude Opus 5 memiliki "context window" (jendela konteks) 1M token (1M token adalah default sekaligus maksimum; tidak ada varian konteks yang lebih kecil), 128k token output maksimum, dan thinking aktif secara default. Priority Tier tidak didukung di Claude Opus 5.

Untuk harga dan spesifikasi lengkap, lihat ikhtisar model.

Fitur baru

Perubahan alat di tengah percakapan (beta)

Anda dapat menambahkan atau menghapus alat di antara giliran percakapan sambil mempertahankan cache prompt, alih-alih mengirim ulang daftar alat tetap selama masa sesi. Perubahan alat di tengah percakapan berada dalam tahap beta: sertakan header beta mid-conversation-tool-changes-2026-07-01 dalam permintaan Anda. Lihat Perubahan alat di tengah percakapan untuk penggunaannya.

Mode fallback default

Parameter fallbacks mendukung mode "default" baru, yang menerapkan model fallback yang direkomendasikan Anthropic berdasarkan kategori penolakan alih-alih daftar model yang Anda kelola sendiri. Seluruh parameter fallbacks berada dalam tahap beta. Gunakan header beta server-side-fallback-2026-07-01, yang mendukung mode "default" maupun daftar model eksplisit (header server-side-fallback-2026-06-01 yang lebih lama hanya menerima daftar eksplisit). Lihat Penolakan dan fallback.

Batas minimum cache prompt yang lebih rendah

Panjang prompt minimum yang dapat di-cache di Claude Opus 5 adalah 512 token, turun dari 1.024 token di Claude Opus 4.8. Prompt yang terlalu pendek untuk di-cache di Claude Opus 4.8 kini dapat membuat entri cache tanpa perubahan kode. Lihat "Prompt caching" (caching prompt) untuk batas minimum per model.

Fast mode

Fast mode (pratinjau riset) tersedia untuk Claude Opus 5 hanya di Claude API; saat ini tidak tersedia di Amazon Bedrock, Claude Platform on AWS, Google Cloud, atau Microsoft Foundry. Fast mode untuk Claude Opus 5 dihargai $10 USD per juta token input dan $50 USD per juta token output. Lihat Fast mode untuk akses, model yang didukung, dan harga.

Perubahan perilaku

Thinking aktif secara default

Di Claude Opus 4.8, permintaan berjalan tanpa thinking kecuali Anda menetapkan thinking: {"type": "adaptive"}. Di Claude Opus 5, permintaan yang sama berjalan dengan adaptive thinking aktif secara default: model memutuskan kapan dan seberapa banyak berpikir pada setiap giliran, dan parameter effort adalah kontrol untuk kedalaman thinking. Nilai wire tidak berubah; thinking: {"type": "adaptive"} tetap valid dan setara dengan default.

Ini adalah breaking change untuk kode yang berjalan tanpa thinking di Claude Opus 4.8. Respons dapat dimulai dengan satu atau lebih blok thinking sebelum blok text pertama, yang dikembalikan dengan field thinking kosong pada default display: "omitted", sehingga kode yang membaca content[0].text atau memperlakukan blok konten pertama yang di-streaming sebagai teks harus memilih blok konten berdasarkan field type-nya. Loop penggunaan alat harus mengirimkan kembali blok thinking secara lengkap dan tanpa modifikasi bersama hasil alatnya; lihat Mempertahankan blok thinking.

Token thinking ditagih sebagai token output dan dihitung terhadap max_tokens, batas keras pada total output (thinking ditambah teks respons), jadi tinjau kembali max_tokens dan tetapkan ulang baseline biaya untuk beban kerja yang berjalan tanpa thinking di Claude Opus 4.8.

API tetap menyediakan opsi untuk menonaktifkan thinking, dengan tunduk pada pembatasan effort untuk menonaktifkannya.

Effort menjadi lebih penting

Claude Opus 5 mengubah effort tambahan menjadi hasil yang lebih baik secara lebih andal dibandingkan model Opus sebelumnya, sehingga tingkat effort yang Anda pilih memiliki bobot lebih besar. Seluruh jenjang tersedia: low, medium, high, xhigh, dan max, dengan max sebagai tingkat teratas untuk penalaran sedalam mungkin. Mulailah dari default, high, dan sesuaikan ke arah mana pun berdasarkan evaluasi Anda: turunkan jika kualitas tetap terjaga untuk menghemat token dan latensi, atau naikkan untuk pekerjaan yang paling menuntut. Saat berjalan pada effort xhigh atau max, tetapkan max_tokens yang besar agar model memiliki ruang untuk berpikir dan bertindak di seluruh subagen dan pemanggilan alat.

Permintaan ini menaikkan effort hingga max:

client = anthropic.Anthropic()

with client.messages.stream(
    model="claude-opus-5",
    max_tokens=64000,
    output_config={"effort": "max"},
    messages=[
        {
            "role": "user",
            "content": "Explain why the sum of two even numbers is always even.",
        }
    ],
) as stream:
    response = stream.get_final_message()

print(response)

Thinking aktif secara default di Claude Opus 5, sehingga field thinking tidak diperlukan.

Menonaktifkan thinking memerlukan effort high atau lebih rendah

Di Claude Opus 5, thinking: {"type": "disabled"} hanya diterima ketika tingkat effort adalah high atau lebih rendah. Menetapkan thinking: {"type": "disabled"} dengan effort xhigh atau max mengembalikan error 400. Aturan ini diberlakukan pada setiap permintaan ke Claude Opus 5 dan model yang lebih baru. Ini adalah breaking change dari Claude Opus 4.8, di mana menonaktifkan thinking tidak bergantung pada tingkat effort. Jika permintaan Claude Opus 4.8 Anda menonaktifkan thinking pada effort xhigh atau max, pertahankan thinking nonaktif dan tetapkan effort ke high atau lebih rendah, atau pertahankan tingkat effort dan hapus field thinking.

Dengan thinking dinonaktifkan, Claude Opus 5 sesekali dapat menulis pemanggilan alat ke dalam output teksnya alih-alih mengeluarkan blok tool_use, atau menyertakan tag XML internal dalam respons yang terlihat. Jika memungkinkan, biarkan thinking tetap aktif dan kendalikan biaya token dengan tingkat effort yang lebih rendah; untuk integrasi yang harus tetap menonaktifkan thinking, lihat Menjalankan dengan thinking dinonaktifkan untuk mitigasi prompting.

Perbedaan perilaku model

Di luar perubahan API ini, Claude Opus 5 berperilaku berbeda dari Claude Opus 4.8 dengan cara yang mungkin Anda perhatikan tanpa mengubah kode apa pun. Respons default yang ditujukan kepada pengguna dan hasil kerja tertulis menjadi lebih panjang. Dalam sesi agentik, model lebih sering menarasikan kemajuannya kepada pengguna. Dalam kerangka kerja multi-agen, model lebih mudah mendelegasikan ke subagen. Model juga memverifikasi pekerjaannya sendiri tanpa diminta, jadi hapus instruksi verifikasi yang terbawa dari model sebelumnya ("sertakan langkah verifikasi akhir," "gunakan subagen untuk memverifikasi"); instruksi tersebut menyebabkan verifikasi berlebihan di Claude Opus 5. Untuk pola prompting yang menyesuaikan masing-masing perilaku ini, lihat Prompting Claude Opus 5.

Peningkatan kemampuan

Dibandingkan dengan Claude Opus 4.8, Claude Opus 5 adalah peningkatan lompatan besar, bukan peningkatan bertahap, dan menghadirkan kecerdasan terdepan dengan setengah biaya Claude Fable 5. Kemajuan terbesar ada pada:

  • Penalaran mendalam, mempertahankan analisis multilangkah di sepanjang rantai masalah yang panjang.
  • Pengodean agentik dan tugas berjangka panjang, tetap fokus pada tugas di sepanjang loop penggunaan alat yang panjang dan menyelesaikan fitur multi-file, refactor yang lebih besar, serta pekerjaan fitur end-to-end tanpa meninggalkan stub atau placeholder.
  • Penskalaan komputasi saat pengujian, mengubah effort tambahan (hingga tingkat max) menjadi hasil yang lebih baik.
  • Efisiensi pada tingkat effort yang lebih rendah, dengan effort low dan medium menghasilkan kualitas yang kuat dengan sebagian kecil token dan latensi dari pengaturan yang lebih tinggi.
  • Tinjauan kode dan pencarian bug, menemukan bug nyata dengan tingkat tinggi per pass dengan sedikit positif palsu, dan tetap akurat pada tingkat effort yang lebih rendah.
  • Visi, memahami bagan, dokumen, dan diagram serta mereplikasi visual UI dan frontend, paling kuat ketika diberi alat untuk menganalisis, memotong, dan memverifikasi pekerjaannya secara iteratif.
  • Pekerjaan konteks panjang, dengan jendela konteks 1M token sebagai default sekaligus maksimum, serta kepatuhan instruksi, pemanggilan alat, dan penalaran yang konsisten di seluruh jendela.
  • Tugas perkantoran dan dokumen, menghasilkan dan mengedit spreadsheet multi-sheet yang kompleks dengan formula yang tidak sederhana, serta menghasilkan slide deck yang terstruktur dengan baik.
  • Koordinasi multi-agen, menjalankan tim subagen dengan pola penulis-pemverifikasi yang efektif dan sedikit kasus agen yang menimpa pekerjaan satu sama lain.

Untuk pola prompting yang memaksimalkan kemampuan ini, lihat Prompting Claude Opus 5.

Harga

Claude Opus 5 dihargai $5 USD per juta token input dan $25 USD per juta token output, tidak berubah dari Claude Opus 4.8. Karena thinking aktif secara default dan token thinking ditagih sebagai token output, beban kerja yang berjalan tanpa thinking di Claude Opus 4.8 dapat menghasilkan lebih banyak token output per permintaan dengan tarif per token yang sama; lihat Kontrol biaya.

Lihat Harga untuk harga lengkap, termasuk tarif pemrosesan batch, caching prompt, dan fast mode.

Ketersediaan

Claude Opus 5 tersedia di:

Claude Opus 4.8 tetap tersedia di semua platform ini.

Panduan migrasi

Untuk bermigrasi dari Claude Opus 4.8, perbarui ID model Anda:

model = "claude-opus-4-8"  # Before
model = "claude-opus-5"  # After

Kemudian tinjau dua breaking change di bawah Perubahan perilaku: thinking aktif secara default (respons dapat dimulai dengan blok thinking, jadi pilih blok konten berdasarkan type), dan menonaktifkan thinking dengan effort xhigh atau max mengembalikan error 400. Lihat panduan migrasi untuk instruksi langkah demi langkah dan daftar periksa lengkap.

Langkah selanjutnya

Spesifikasi dan harga lengkap untuk semua model Claude saat ini.

Perbedaan perilaku dan pola prompting khusus untuk Claude Opus 5.

Kendalikan berapa banyak token yang digunakan Claude saat merespons, dari low hingga max.

Cara kerja thinking ketika aktif secara default, dan kapan dapat dinonaktifkan.

Berikan Claude anggaran token sebagai acuan untuk mengatur laju pekerjaannya.

Panduan untuk bermigrasi ke model Claude terbaru dari versi Claude sebelumnya.

Dapatkan token output per detik yang lebih tinggi dari model Claude Opus dengan harga premium.

Was this page helpful?