Claude Opus 5 merupakan peningkatan signifikan dibandingkan Claude Opus 4.8, dengan peningkatan terbesar pada penalaran mendalam, tugas agentik dan jangka panjang, serta penskalaan komputasi saat pengujian. Halaman ini merangkum semua hal baru di Claude Opus 5, termasuk pemikiran yang aktif secara default, perubahan alat di tengah percakapan, dan perubahan yang bersifat breaking terkait kapan pemikiran dapat dinonaktifkan.
| Model | ID model API | Deskripsi |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | Untuk pengodean agentik yang kompleks dan pekerjaan enterprise |
Claude Opus 5 memiliki jendela konteks 1 juta token (1 juta token adalah nilai default sekaligus maksimum; tidak ada varian konteks yang lebih kecil), output maksimum 128 ribu token, dan pemikiran aktif secara default.
Untuk harga dan spesifikasi lengkap, lihat ikhtisar model.
Anda dapat menambahkan atau menghapus alat di antara giliran percakapan sambil mempertahankan cache prompt, alih-alih mengirim ulang daftar alat yang tetap selama masa sesi. Perubahan alat di tengah percakapan masih dalam tahap beta: sertakan header beta mid-conversation-tool-changes-2026-07-01 dalam permintaan Anda. Lihat Perubahan alat di tengah percakapan untuk cara penggunaannya.
Parameter fallbacks mendukung mode "default" baru, yang menerapkan model fallback yang direkomendasikan Anthropic berdasarkan kategori penolakan, alih-alih daftar model yang Anda kelola sendiri. Seluruh parameter fallbacks masih dalam tahap beta. Gunakan header beta server-side-fallback-2026-07-01, yang mendukung mode "default" maupun daftar model eksplisit (header server-side-fallback-2026-06-01 sebelumnya hanya menerima daftar eksplisit). Lihat Penolakan dan fallback.
Panjang prompt minimum yang dapat di-cache pada Claude Opus 5 adalah 512 token, turun dari 1.024 token pada Claude Opus 4.8. Prompt yang sebelumnya terlalu pendek untuk di-cache pada Claude Opus 4.8 kini dapat membuat entri cache tanpa perubahan kode. Lihat Caching prompt untuk nilai minimum per model.
Mode cepat (pratinjau riset) tersedia untuk Claude Opus 5 hanya pada Claude API; saat ini tidak tersedia di Amazon Bedrock, Google Cloud, atau Microsoft Foundry. Mode cepat untuk Claude Opus 5 dihargai $10 USD per juta token input dan $50 USD per juta token output. Lihat Mode cepat untuk akses, model yang didukung, dan harga.
Pada Claude Opus 4.8, permintaan berjalan tanpa pemikiran kecuali Anda mengatur thinking: {"type": "adaptive"}. Pada Claude Opus 5, permintaan yang sama berjalan dengan pemikiran aktif: model memutuskan kapan dan seberapa banyak berpikir pada setiap giliran, dan parameter effort adalah kontrol untuk kedalaman pemikiran. Nilai wire tidak berubah; thinking: {"type": "adaptive"} tetap valid dan setara dengan default.
Karena max_tokens adalah batas keras pada total output (pemikiran ditambah teks respons), tinjau kembali nilainya untuk beban kerja yang berjalan tanpa pemikiran pada Claude Opus 4.8.
API tetap menyediakan opsi untuk menonaktifkan pemikiran, dengan tunduk pada batasan effort di bawah ini.
Claude Opus 5 mengonversi effort tambahan menjadi hasil yang lebih baik secara lebih andal dibandingkan model Opus sebelumnya, sehingga tingkat effort yang Anda pilih memiliki bobot lebih besar. Seluruh tingkatan tersedia: low, medium, high, xhigh, dan max, dengan max sebagai tingkat tertinggi untuk penalaran sedalam mungkin. Mulailah dari default, high, dan sesuaikan ke salah satu arah berdasarkan evaluasi Anda: turunkan jika kualitas tetap terjaga untuk menghemat token dan latensi, atau naikkan untuk pekerjaan yang paling menuntut. Saat berjalan pada effort xhigh atau max, atur max_tokens yang besar agar model memiliki ruang untuk berpikir dan bertindak di seluruh subagen dan pemanggilan alat.
Permintaan ini menaikkan effort hingga ke max:
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)Pemikiran aktif secara default pada Claude Opus 5, sehingga field thinking tidak diperlukan.
high atau lebih rendahPada Claude Opus 5, thinking: {"type": "disabled"} hanya diterima ketika tingkat effort adalah high atau lebih rendah. Mengatur thinking: {"type": "disabled"} dengan effort xhigh atau max akan mengembalikan error 400. Ini adalah perilaku yang tersedia secara umum pada Claude Opus 5 dan seterusnya, diterapkan pada setiap permintaan, dan merupakan perubahan yang bersifat breaking dari Claude Opus 4.8, di mana menonaktifkan pemikiran tidak bergantung pada tingkat effort. Jika saat ini Anda menonaktifkan pemikiran pada tingkat effort tinggi, pilih salah satu: tetap nonaktifkan pemikiran dan atur effort ke high atau lebih rendah, atau pertahankan tingkat effort dan hapus field thinking.
Dengan pemikiran dinonaktifkan, Claude Opus 5 terkadang dapat menulis pemanggilan alat ke dalam output teksnya alih-alih mengeluarkan blok tool_use, atau menyertakan tag XML internal dalam respons yang terlihat. Jika memungkinkan, biarkan pemikiran tetap aktif dan kendalikan biaya token dengan tingkat effort yang lebih rendah; untuk integrasi yang harus tetap menonaktifkan pemikiran, lihat Menjalankan dengan pemikiran dinonaktifkan untuk mitigasi melalui prompting.
Di luar perubahan API di atas, Claude Opus 5 berperilaku berbeda dari Claude Opus 4.8 dalam cara-cara yang mungkin Anda perhatikan tanpa mengubah kode apa pun. Respons default yang ditampilkan kepada pengguna dan hasil tertulis cenderung lebih panjang. Dalam sesi agentik, model lebih sering menarasikan progresnya kepada pengguna. Dalam kerangka kerja multi-agen, model lebih mudah mendelegasikan ke subagen. Model juga memverifikasi pekerjaannya sendiri tanpa diminta, jadi hapus instruksi verifikasi yang dibawa dari model sebelumnya ("sertakan langkah verifikasi akhir," "gunakan subagen untuk memverifikasi"); instruksi tersebut menyebabkan verifikasi berlebihan pada Claude Opus 5. Untuk pola prompting yang menyesuaikan masing-masing perilaku ini, lihat Prompting Claude Opus 5.
Dibandingkan dengan Claude Opus 4.8, Claude Opus 5 merupakan peningkatan signifikan, bukan sekadar inkremental, dan menghadirkan kecerdasan terdepan dengan setengah biaya Claude Fable 5. Peningkatan terbesar terdapat pada:
max) menjadi hasil yang lebih baik.low dan medium menghasilkan kualitas yang kuat dengan sebagian kecil token dan latensi dibandingkan pengaturan yang lebih tinggi.Untuk pola prompting yang memaksimalkan kemampuan-kemampuan ini, lihat Prompting Claude Opus 5.
Claude Opus 5 dihargai $5 USD per juta token input dan $25 USD per juta token output, tidak berubah dari Claude Opus 4.8.
Lihat Harga untuk harga lengkap, termasuk pemrosesan batch, caching prompt, dan tarif mode cepat.
Claude Opus 5 tersedia di:
claude-opus-5.anthropic.claude-opus-5. Claude Opus 5 juga dapat diakses melalui API InvokeModel pada bedrock-runtime, dilayani oleh infrastruktur yang sama; integrasi Claude di Amazon Bedrock (legacy) tidak menyertakannya dalam tabel ID model berversi ARN.claude-opus-5.Claude Opus 4.8 tetap tersedia di semua platform tersebut.
Untuk bermigrasi dari Claude Opus 4.8, perbarui ID model Anda:
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # AfterKemudian tinjau dua perubahan perilaku: pemikiran aktif secara default, dan menonaktifkan pemikiran dengan effort xhigh atau max akan mengembalikan error 400. Lihat panduan migrasi untuk instruksi langkah demi langkah.
Spesifikasi dan harga lengkap untuk semua model Claude saat ini.
Perbedaan perilaku dan pola prompting khusus untuk Claude Opus 5.
Kendalikan berapa banyak token yang digunakan Claude saat merespons, dari low hingga max.
Cara kerja pemikiran saat aktif secara default, dan kapan dapat dinonaktifkan.
Berikan Claude anggaran token sebagai panduan untuk mengatur ritme kerjanya.
Panduan untuk bermigrasi ke model Claude terbaru dari versi Claude sebelumnya.
Dapatkan token output per detik yang lebih tinggi dari model Claude Opus dengan harga premium.
Was this page helpful?