Claude Opus 5 adalah peningkatan besar dibandingkan Claude Opus 4.8, dengan peningkatan terbesar pada penalaran mendalam, tugas agentik dan jangka panjang, serta penskalaan komputasi saat pengujian (test-time compute scaling). Halaman ini merangkum semua hal baru di Claude Opus 5, termasuk thinking yang aktif secara default, perubahan alat di tengah percakapan, dan perubahan yang bersifat breaking terkait kapan thinking dapat dinonaktifkan.
| Model | ID model API | Deskripsi |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | Untuk pengkodean agentik yang kompleks dan pekerjaan enterprise |
Claude Opus 5 memiliki jendela konteks 1M token (1M token adalah nilai default sekaligus maksimum; tidak ada varian konteks yang lebih kecil), maksimum 128k token output, dan thinking yang aktif secara default.
Untuk harga dan spesifikasi lengkap, lihat ikhtisar model.
Anda dapat menambah atau menghapus alat di antara giliran percakapan sambil mempertahankan cache prompt, alih-alih mengirim ulang daftar alat yang tetap selama sesi berlangsung. Perubahan alat di tengah percakapan masih dalam tahap beta: sertakan header beta mid-conversation-tool-changes-2026-07-01 dalam permintaan Anda. Lihat Perubahan alat di tengah percakapan untuk cara penggunaannya.
Parameter fallbacks mendukung mode baru "default", yang menerapkan model fallback yang direkomendasikan Anthropic berdasarkan kategori penolakan, alih-alih daftar model yang Anda kelola sendiri. Seluruh parameter fallbacks masih dalam tahap beta. Gunakan header beta server-side-fallback-2026-07-01, yang mendukung mode "default" maupun daftar model eksplisit (header server-side-fallback-2026-06-01 yang lebih lama hanya menerima daftar eksplisit). Lihat Penolakan dan fallback.
Panjang prompt minimum yang dapat di-cache pada Claude Opus 5 adalah 512 token, turun dari 1.024 token pada Claude Opus 4.8. Prompt yang terlalu pendek untuk di-cache pada Claude Opus 4.8 kini dapat membuat entri cache tanpa perubahan kode. Lihat Caching prompt untuk nilai minimum per model.
Mode cepat (pratinjau riset) tersedia untuk Claude Opus 5 hanya di Claude API; saat ini tidak tersedia di Amazon Bedrock, Google Cloud, atau Microsoft Foundry. Mode cepat untuk Claude Opus 5 dihargai $10 per juta token input dan $50 per juta token output. Lihat Mode cepat untuk akses, model yang didukung, dan harga.
Pada Claude Opus 4.8, permintaan berjalan tanpa thinking kecuali Anda menyetel thinking: {"type": "adaptive"}. Pada Claude Opus 5, permintaan yang sama berjalan dengan thinking aktif: model memutuskan kapan dan seberapa banyak berpikir pada setiap giliran, dan parameter effort menjadi kontrol untuk kedalaman berpikir. Nilai pada wire tidak berubah; thinking: {"type": "adaptive"} tetap valid dan setara dengan default.
Karena max_tokens adalah batas keras untuk total output (thinking ditambah teks respons), tinjau kembali nilainya untuk beban kerja yang sebelumnya berjalan tanpa thinking pada Claude Opus 4.8.
API tetap menyediakan opsi untuk menonaktifkan thinking, dengan tunduk pada pembatasan effort di bawah ini.
Claude Opus 5 mengubah effort tambahan menjadi hasil yang lebih baik secara lebih andal dibandingkan model Opus sebelumnya, sehingga tingkat effort yang Anda pilih memiliki bobot yang lebih besar. Seluruh tingkatan tersedia: low, medium, high, xhigh, dan max, dengan max sebagai tingkat tertinggi untuk penalaran sedalam mungkin. Mulailah dari default, high, dan sesuaikan ke arah mana pun berdasarkan evaluasi Anda: turunkan jika kualitas tetap terjaga untuk menghemat token dan latensi, atau naikkan untuk pekerjaan yang paling menuntut. Saat berjalan pada effort xhigh atau max, setel max_tokens yang besar agar model memiliki ruang untuk berpikir dan bertindak di seluruh subagen dan pemanggilan alat.
Permintaan ini menaikkan effort sampai ke max:
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)Thinking aktif secara default pada Claude Opus 5, sehingga field thinking tidak diperlukan.
high atau lebih rendahPada Claude Opus 5, thinking: {"type": "disabled"} hanya diterima ketika tingkat effort adalah high atau lebih rendah. Menyetel thinking: {"type": "disabled"} dengan effort xhigh atau max akan mengembalikan error 400. Ini adalah perilaku yang tersedia secara umum pada Claude Opus 5 dan seterusnya, diberlakukan pada setiap permintaan, dan merupakan perubahan yang bersifat breaking dari Claude Opus 4.8, di mana menonaktifkan thinking tidak bergantung pada tingkat effort. Jika saat ini Anda menonaktifkan thinking pada tingkat effort tinggi, pertahankan thinking dalam keadaan nonaktif dan setel effort ke high atau lebih rendah, atau pertahankan tingkat effort dan hapus field thinking.
Dengan thinking dinonaktifkan, Claude Opus 5 terkadang dapat menuliskan pemanggilan alat ke dalam output teksnya alih-alih mengeluarkan blok tool_use, atau menyertakan tag XML internal dalam respons yang terlihat. Jika memungkinkan, biarkan thinking tetap aktif dan kendalikan biaya token dengan tingkat effort yang lebih rendah; untuk integrasi yang harus menonaktifkan thinking, lihat Menjalankan dengan thinking dinonaktifkan untuk mitigasi melalui prompting.
Di luar perubahan API di atas, Claude Opus 5 berperilaku berbeda dari Claude Opus 4.8 dalam hal-hal yang mungkin Anda perhatikan tanpa mengubah kode apa pun. Respons default yang ditujukan kepada pengguna dan hasil tulisan menjadi lebih panjang. Dalam sesi agentik, model lebih sering menarasikan kemajuannya kepada pengguna. Dalam kerangka kerja multi-agen, model lebih mudah mendelegasikan ke subagen. Model juga memverifikasi pekerjaannya sendiri tanpa diminta, jadi hapus instruksi verifikasi yang dibawa dari model sebelumnya ("sertakan langkah verifikasi akhir," "gunakan subagen untuk memverifikasi"); instruksi tersebut menyebabkan verifikasi berlebihan pada Claude Opus 5. Untuk pola prompting yang menyetel masing-masing perilaku ini, lihat Prompting Claude Opus 5.
Dibandingkan dengan Claude Opus 4.8, Claude Opus 5 merupakan peningkatan besar, bukan peningkatan inkremental, dan menghadirkan kecerdasan terdepan dengan setengah biaya Claude Fable 5. Peningkatan terbesar ada pada:
max) menjadi hasil yang lebih baik.low dan medium menghasilkan kualitas yang kuat dengan hanya sebagian kecil dari token dan latensi pengaturan yang lebih tinggi.Untuk pola prompting yang memaksimalkan kemampuan-kemampuan ini, lihat Prompting Claude Opus 5.
Claude Opus 5 dihargai $5 per juta token input dan $25 per juta token output, tidak berubah dari Claude Opus 4.8.
Lihat Harga untuk harga lengkap, termasuk pemrosesan batch, caching prompt, dan tarif mode cepat.
Claude Opus 5 tersedia di:
claude-opus-5.anthropic.claude-opus-5. Claude Opus 5 juga dapat dijangkau melalui API InvokeModel pada bedrock-runtime, yang dilayani oleh infrastruktur yang sama; integrasi Claude on Amazon Bedrock (legacy) tidak menyertakannya dalam tabel ID model berversi ARN.claude-opus-5.Claude Opus 4.8 tetap tersedia di semua platform tersebut.
Untuk bermigrasi dari Claude Opus 4.8, perbarui ID model Anda:
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # AfterKemudian tinjau dua perubahan perilaku: thinking aktif secara default, dan menonaktifkan thinking dengan effort xhigh atau max mengembalikan error 400. Lihat panduan migrasi untuk instruksi langkah demi langkah.
Spesifikasi dan harga lengkap untuk semua model Claude saat ini.
Perbedaan perilaku dan pola prompting yang spesifik untuk Claude Opus 5.
Kendalikan berapa banyak token yang digunakan Claude saat merespons, dari low hingga max.
Cara kerja thinking ketika aktif secara default, dan kapan dapat dinonaktifkan.
Berikan Claude anggaran token sebagai acuan untuk mengatur ritme pekerjaannya.
Panduan untuk bermigrasi ke model Claude terbaru dari versi Claude sebelumnya.
Dapatkan token output per detik yang lebih tinggi dari model Claude Opus dengan harga premium.
Was this page helpful?