Claude Platform Docs
Documentation

Bermigrasi ke Claude Mythos 5 dan Claude Fable 5

Bermigrasi ke Claude Mythos 5 dan Claude Fable 5 dari Claude Mythos Preview, Claude Opus 5, atau Claude Opus 4.8: ID model, perubahan API, dan daftar periksa migrasi.

Claude Fable 5 dibangun untuk penalaran yang menuntut dan pekerjaan agentik berjangka panjang. Claude Fable 5.1 dibangun di atasnya. Claude Fable 5 tersedia di Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud, dan Microsoft Foundry. Claude Mythos 5 memiliki kemampuan yang sama dan hanya ditawarkan kepada pelanggan yang disetujui dalam Project Glasswing.

Pengaturan dasar yang dimiliki bersama oleh claude-fable-5 dan claude-mythos-5:

  • Thinking: Adaptive thinking (pemikiran adaptif) selalu aktif. Model menentukan kapan dan seberapa banyak berpikir pada setiap permintaan, dan tidak diperlukan konfigurasi thinking. Baik thinking: {type: "disabled"} maupun "extended thinking" (pemikiran diperpanjang) manual (thinking: {type: "enabled", budget_tokens: N}) mengembalikan error 400.
  • Prefill: Melakukan prefill pada pesan asisten mengembalikan error 400. Gunakan instruksi prompt sistem sebagai gantinya.
  • Jendela konteks dan output: "Context window" (jendela konteks) 1 juta token secara default, dan hingga 128k token output per permintaan.
  • Harga: $10 USD per juta token input dan $50 USD per juta token output. Lihat harga Claude.
  • Retensi data: Kedua model memerlukan retensi data 30 hari dan tidak tersedia di bawah pengaturan "zero data retention" (retensi data nol), atau ZDR, kecuali diizinkan secara tegas oleh Anthropic. Keduanya ditetapkan sebagai Covered Models. Di Claude API, permintaan ke Claude Fable 5 dari organisasi yang konfigurasi retensi datanya tidak memenuhi persyaratan ini mengembalikan invalid_request_error 400. Organisasi dengan pengaturan ZDR sebaiknya menghubungi tim akun Anthropic mereka untuk mendiskusikan konfigurasi retensi data, atau mengonfigurasi retensi data per workspace. Lihat Persyaratan retensi data khusus model untuk detail per platform.

Perbedaan antara kedua model:

  • Ketersediaan: Claude Fable 5 tidak memerlukan persetujuan akses. Claude Mythos 5 hanya tersedia bagi pelanggan yang disetujui dalam Project Glasswing.
  • Pengklasifikasi keamanan: Claude Fable 5 menjalankan pengklasifikasi keamanan yang dapat menolak permintaan dengan stop_reason: "refusal". Claude Mythos 5 tidak menyertakan pengklasifikasi ini. Lihat Penolakan dan fallback.
  • Priority Tier: Priority Tier didukung pada Claude Fable 5 tetapi tidak pada Claude Mythos 5.

Bermigrasi ke Claude Mythos 5 dan Claude Fable 5 dari Claude Mythos Preview

Claude Mythos 5 adalah penerus dengan akses terbatas dari Claude Mythos Preview, pratinjau riset khusus undangan. Claude Fable 5 menawarkan kemampuan yang sama dan tidak memerlukan persetujuan akses. Perubahan dalam bagian ini berlaku sama untuk kedua target.

Migrasi sebagian besar bersifat drop-in. Claude Mythos 5 dan Claude Fable 5 menggunakan Messages API yang sama dan pola "tool use" (penggunaan alat) yang sama seperti Claude Mythos Preview, dan jumlah token kurang lebih tidak berubah karena ketiga model menggunakan tokenizer yang sama. Perubahan utama yang perlu diperiksa adalah fitur yang tidak lagi tersedia (tercantum di bagian berikutnya) dan output thinking. Jika Anda bermigrasi ke Claude Fable 5, rencanakan juga penanganan penolakan dari pengklasifikasi keamanan, yang tidak dimiliki Claude Mythos Preview dan Claude Mythos 5; lihat Penolakan dan fallback.

Untuk jadwal penghentian Claude Mythos Preview, lihat Penghentian model.

Perbarui nama model Anda

model = "claude-mythos-preview"  # Before
model = "claude-mythos-5"  # After

# Atau, untuk model dengan kemampuan yang sama dan tanpa persyaratan persetujuan akses:
model = "claude-fable-5"  # After

Fitur yang tidak tersedia pada Claude Mythos 5 dan Claude Fable 5

  1. Extended thinking dan anggaran token thinking: Extended thinking manual (thinking: {type: "enabled", budget_tokens: N}) tidak didukung pada claude-mythos-5 atau claude-fable-5 dan mengembalikan error 400. Adaptive thinking selalu aktif: model menentukan kapan dan seberapa banyak berpikir pada setiap permintaan, dan tidak diperlukan konfigurasi thinking. thinking: {type: "disabled"} mengembalikan error. budget_tokens tidak memiliki pengganti langsung: thinking bersifat adaptif, dan parameter effort adalah kontrol tingkat output yang terpisah, bukan anggaran thinking.

    Sebelum (Claude Mythos Preview):

    client.messages.create(
        model="claude-mythos-preview",
        max_tokens=16000,
        thinking={"type": "enabled", "budget_tokens": 10000},
        messages=[{"role": "user", "content": "..."}],
    )

    Sesudah (Claude Mythos 5):

    client.messages.create(
        model="claude-mythos-5",
        max_tokens=16000,
        messages=[{"role": "user", "content": "..."}],
    )

    Perubahan untuk Claude Fable 5 identik, dengan claude-fable-5 sebagai nama model.

  2. Prefill asisten: Melakukan prefill pada pesan asisten tidak didukung pada claude-mythos-5 atau claude-fable-5 dan mengembalikan error 400, sama seperti pada Claude Mythos Preview. Gunakan instruksi prompt sistem sebagai gantinya.

  3. Output thinking: Pada claude-mythos-5 dan claude-fable-5, rantai pemikiran mentah tidak pernah dikembalikan, tetapi blok thinking tetap membawa teks ringkasan yang dapat dibaca ketika thinking.display diatur ke summarized. Kirimkan kembali blok thinking tanpa perubahan saat melanjutkan percakapan pada model yang sama. Lihat Output thinking pada model Claude Fable dan Claude Mythos.

Penghitungan token dan penagihan

claude-mythos-5 dan claude-fable-5 menggunakan tokenizer yang sama dengan claude-mythos-preview (tokenizer yang diperkenalkan bersama Claude Opus 4.7). Jumlah token kurang lebih tidak berubah saat bermigrasi dari claude-mythos-preview. Dibandingkan dengan model sebelum Claude Opus 4.7, konten yang sama dapat ditokenisasi menjadi kurang lebih 30% lebih banyak token, bervariasi menurut konten dan bentuk beban kerja.

/v1/messages/count_tokens mengembalikan nilai yang kurang lebih tidak berubah untuk claude-mythos-5 dan claude-fable-5 dibandingkan dengan claude-mythos-preview. Tetapkan ulang baseline biaya dan latensi pada beban kerja Anda sendiri.

Daftar periksa migrasi

  • Perbarui nama model dari claude-mythos-preview ke claude-mythos-5, atau ke claude-fable-5, yang menawarkan kemampuan yang sama dan tidak memerlukan persetujuan akses.
  • Hapus konfigurasi extended thinking manual (thinking: {type: "enabled", budget_tokens: N}). Adaptive thinking selalu aktif, dan tidak diperlukan field thinking.
  • Hapus konfigurasi thinking: {type: "disabled"} apa pun. Menonaktifkan thinking mengembalikan error pada claude-mythos-5 dan claude-fable-5.
  • Hapus budget_tokens. Parameter ini tidak memiliki pengganti langsung: thinking bersifat adaptif, dan parameter effort adalah kontrol tingkat output yang terpisah, bukan anggaran thinking.
  • Verifikasi bahwa kode apa pun yang mem-parsing field thinking memperlakukannya hanya sebagai teks tampilan dan mengirimkan kembali blok thinking tanpa perubahan saat melanjutkan pada model yang sama. thinking.display secara default bernilai "omitted" pada claude-mythos-5 dan claude-fable-5, sama seperti pada Claude Mythos Preview. Atur display: "summarized" untuk menerima ringkasan yang dapat dibaca. Lihat Output thinking pada model Claude Fable dan Claude Mythos.
  • Jika Anda memutar ulang riwayat percakapan pada model yang lebih lama, hapus terlebih dahulu blok thinking dan redacted_thinking dari giliran asisten sebelumnya. Blok thinking dari claude-fable-5 dan claude-mythos-5 hanya dapat dibaca oleh model yang menghasilkannya atau model yang lebih baru: model yang lebih lama mengabaikannya secara diam-diam, sedangkan Claude Fable 5.1 dan Claude Mythos 5.1 membacanya, jadi pertahankan blok tersebut saat Anda memindahkan percakapan ke model-model tersebut (lihat Thinking yang dipertahankan). Penghapusan menjaga permintaan ke model yang lebih lama tetap minimal dan seragam.
  • Jika Anda bermigrasi ke Claude Fable 5, tangani stop_reason: "refusal" dan baca field stop_details.category. Claude Fable 5 menjalankan pengklasifikasi keamanan yang tidak dimiliki Claude Mythos Preview dan Claude Mythos 5. Lihat Penolakan dan fallback.
  • Tetapkan ulang baseline jumlah token dan biaya pada beban kerja Anda sendiri. Jumlah token kurang lebih tidak berubah saat bermigrasi dari claude-mythos-preview.

Bermigrasi ke Claude Mythos 5 dan Claude Fable 5 dari Claude Opus 5

Claude Fable 5 dan Claude Mythos 5 menggunakan Messages API yang sama dan pola penggunaan alat yang sama seperti Claude Opus 5, dengan jendela konteks 1 juta token yang sama secara default dan 128k token output maksimum yang sama. Pembatasan prefill dan parameter sampling, serta perilaku tampilan thinking, terbawa dari Claude Opus 5 tanpa perubahan. Perubahan yang perlu diperiksa adalah thinking yang selalu aktif, harga, Priority Tier, dan retensi data.

Perbarui nama model Anda

model = "claude-opus-5"  # Before
model = "claude-fable-5"  # After

# Atau, untuk model Project Glasswing dengan kemampuan yang sama:
model = "claude-mythos-5"  # After

Apa yang berubah

  1. Thinking tidak dapat lagi dinonaktifkan: Pada Claude Opus 5, thinking aktif secara default dan dapat dimatikan dengan thinking: {type: "disabled"} pada tingkat effort high atau lebih rendah. Pada claude-fable-5 dan claude-mythos-5, adaptive thinking selalu aktif, dan thinking: {type: "disabled"} mengembalikan error 400 pada tingkat effort apa pun. Hapus konfigurasi thinking: {type: "disabled"} dan gunakan tingkat effort yang lebih rendah untuk mengendalikan pengeluaran token sebagai gantinya.

    Jika permintaan Claude Opus 5 Anda menonaktifkan thinking, bentuk respons berubah: respons dapat dimulai dengan satu atau lebih blok thinking sebelum blok text pertama, dikembalikan dengan field thinking kosong pada default display: "omitted" (default yang sama dengan Claude Opus 5). Kode yang membaca balasan berdasarkan posisi, seperti content[0].text atau handler stream yang memperlakukan blok konten pertama sebagai teks, harus memilih blok konten berdasarkan field type-nya sebagai gantinya, dan loop penggunaan alat harus mengirimkan kembali blok thinking secara lengkap dan tanpa modifikasi bersama hasil alatnya. API menolak blok thinking yang diedit, diurutkan ulang, atau dihapus sebagian dengan error 400 (lihat Mempertahankan blok thinking). Token thinking ditagih sebagai token output bahkan ketika teks thinking tidak dikembalikan.

  2. Harga: Claude Fable 5 dan Claude Mythos 5 dihargai $10 USD per juta token input dan $50 USD per juta token output, dibandingkan dengan $5 USD dan $25 USD untuk Claude Opus 5. Lihat harga Claude.

  3. Priority Tier: Priority Tier tidak didukung pada Claude Opus 5, sehingga tidak ada lalu lintas yang ada yang terpengaruh. Jika organisasi Anda memiliki komitmen Priority Tier, Claude Fable 5 mendukungnya; Claude Mythos 5 tidak.

  4. Retensi data: Claude Fable 5 dan Claude Mythos 5 memerlukan retensi data 30 hari dan tidak tersedia di bawah pengaturan zero data retention (ZDR) kecuali diizinkan secara tegas oleh Anthropic. Keduanya ditetapkan sebagai Covered Models. Lihat Persyaratan retensi data khusus model.

Daftar periksa migrasi

  • Perbarui nama model dari claude-opus-5 ke claude-fable-5 (atau claude-mythos-5).
  • Hapus konfigurasi thinking: {type: "disabled"} apa pun; konfigurasi ini mengembalikan error 400 pada claude-fable-5 dan claude-mythos-5. Gunakan tingkat effort yang lebih rendah untuk mengendalikan pengeluaran token sebagai gantinya, dan tinjau kembali max_tokens untuk beban kerja yang berjalan dengan thinking dinonaktifkan pada Claude Opus 5.
  • Jika beban kerja tersebut membaca konten berdasarkan posisi, seperti content[0].text, perbarui agar memilih blok konten berdasarkan type: blok thinking kini tiba sebelum blok text. Kirimkan kembali blok thinking secara lengkap dan tanpa modifikasi dalam loop penggunaan alat; blok yang dimodifikasi mengembalikan error 400.
  • Jika organisasi Anda memiliki pengaturan zero data retention (ZDR), konfirmasikan kelayakan sebelum bermigrasi: model-model ini tidak tersedia di bawah ZDR kecuali diizinkan secara tegas oleh Anthropic. Lihat Persyaratan retensi data khusus model.
  • Tetapkan ulang baseline biaya pada beban kerja Anda sendiri. Jumlah token kurang lebih tidak berubah; harga per token berbeda, dan beban kerja yang berjalan dengan thinking dinonaktifkan kini menghasilkan token thinking, yang ditagih sebagai token output.

Bermigrasi ke Claude Mythos 5 dan Claude Fable 5 dari Claude Opus 4.8

Migrasi sebagian besar bersifat drop-in. Claude Fable 5 dan Claude Mythos 5 menggunakan Messages API yang sama dan pola penggunaan alat yang sama seperti Claude Opus 4.8, dengan jendela konteks 1 juta token yang sama secara default dan 128k token output maksimum yang sama. Jumlah token kurang lebih tidak berubah karena model-model tersebut menggunakan tokenizer yang sama. Perubahan utama yang perlu diperiksa adalah adaptive thinking yang selalu aktif, output thinking, penolakan dari pengklasifikasi keamanan (hanya Claude Fable 5), dan harga.

Perbarui nama model Anda

model = "claude-opus-4-8"  # Before
model = "claude-fable-5"  # After

# Atau, untuk model Project Glasswing dengan kemampuan yang sama:
model = "claude-mythos-5"  # After

Apa yang berubah

Butir-butir dalam bagian ini menjelaskan perbedaan API dan perilaku yang perlu diperiksa setelah Anda mengganti ID model. Kecuali jika disebutkan lain, butir-butir ini berlaku sama untuk claude-fable-5 dan claude-mythos-5.

  1. Adaptive thinking selalu aktif: Adaptive thinking adalah satu-satunya mode thinking pada claude-fable-5 dan claude-mythos-5. Model menentukan kapan dan seberapa banyak berpikir pada setiap permintaan, dan tidak diperlukan konfigurasi thinking. thinking: {type: "disabled"} mengembalikan error. Gunakan parameter effort untuk mengendalikan kedalaman thinking.

    Perubahan perilaku yang perlu diperiksa: pada Claude Opus 4.8, permintaan tanpa field thinking berjalan tanpa thinking; pada claude-fable-5 dan claude-mythos-5, permintaan yang sama berjalan dengan adaptive thinking. max_tokens tetap menjadi batas keras pada total output, thinking ditambah teks respons, jadi tinjau kembali untuk beban kerja yang berjalan tanpa thinking pada Claude Opus 4.8. Lihat Kontrol biaya. Respons juga dapat dimulai dengan satu atau lebih blok thinking sebelum blok text pertama, sehingga kode yang membaca balasan berdasarkan posisi (misalnya, content[0].text, atau handler stream yang memperlakukan blok konten pertama sebagai teks) harus memilih blok konten berdasarkan field type-nya sebagai gantinya. Token thinking ditagih sebagai token output bahkan ketika teks thinking tidak dikembalikan kepada Anda, sehingga beban kerja yang berjalan tanpa thinking pada Claude Opus 4.8 menghasilkan lebih banyak token output per permintaan, di samping perbedaan harga per token.

    Jika Anda menjalankan loop penggunaan alat, kirimkan kembali blok thinking dari setiap respons asisten ke API secara lengkap dan tanpa modifikasi saat Anda mengembalikan hasil alat, termasuk blok yang field thinking-nya kosong. Kembalikan pesan asisten sebagaimana diterima alih-alih memfilter blok kontennya berdasarkan tipe atau membangunnya ulang: API menolak blok thinking yang diedit, diurutkan ulang, atau dihapus sebagian dengan error 400. Lihat Mempertahankan blok thinking.

    Sebelum (Claude Opus 4.8):

    client.messages.create(
        model="claude-opus-4-8",
        max_tokens=16000,
        thinking={"type": "adaptive"},
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    Sesudah (Claude Fable 5):

    client.messages.create(
        model="claude-fable-5",
        max_tokens=16000,
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    Perubahan untuk Claude Mythos 5 identik, dengan claude-mythos-5 sebagai nama model.

  2. Extended thinking dan anggaran thinking (tidak berubah): Extended thinking manual (thinking: {type: "enabled", budget_tokens: N}) tidak didukung pada claude-fable-5 atau claude-mythos-5 dan mengembalikan error 400, sama seperti pada Claude Opus 4.8. budget_tokens tidak memiliki pengganti langsung: thinking bersifat adaptif, dan parameter effort adalah kontrol tingkat output yang terpisah, bukan anggaran thinking.

  3. Prefill asisten (tidak berubah): Melakukan prefill pada pesan asisten tidak didukung pada claude-fable-5 atau claude-mythos-5 dan mengembalikan error 400, sama seperti pada Claude Opus 4.8. Gunakan instruksi prompt sistem sebagai gantinya.

  4. Output thinking: Pada claude-fable-5 dan claude-mythos-5, rantai pemikiran mentah tidak pernah dikembalikan, tetapi blok thinking tetap membawa teks ringkasan yang dapat dibaca ketika thinking.display diatur ke summarized. Kirimkan kembali blok thinking tanpa perubahan saat melanjutkan percakapan pada model yang sama. Lihat Output thinking pada model Claude Fable dan Claude Mythos.

  5. Pengklasifikasi keamanan dan stop reason refusal (hanya Claude Fable 5): claude-fable-5 menjalankan pengklasifikasi keamanan pada permintaan dan selama pembuatan respons. Claude Mythos 5 tidak menyertakan pengklasifikasi ini. Ketika pengklasifikasi menolak permintaan, Messages API mengembalikan stop_reason: "refusal" sebagai respons HTTP 200 yang berhasil, bukan error. Field stop_details.category melaporkan pengklasifikasi mana yang terpicu, dengan kategori seperti "cyber", "bio", dan "reasoning_extraction", atau null ketika penolakan tidak terpetakan ke kategori bernama apa pun. Lihat tabel kategori penolakan untuk daftar lengkapnya.

    Anda tidak ditagih untuk token input dari permintaan yang ditolak sebelum output apa pun dihasilkan. Ketika pengklasifikasi terpicu di tengah stream, input dan output yang sudah di-stream ditagih; buang output parsial tersebut.

    Untuk menjalankan ulang permintaan yang ditolak pada model lain secara otomatis, kirimkan parameter opt-in fallbacks, yang berstatus beta di Claude API. Parameter ini tidak tersedia di Message Batches API atau di Amazon Bedrock, Google Cloud, dan Microsoft Foundry; pada ketiga platform tersebut, jalankan percobaan ulang di sisi klien atau gunakan middleware refusal-fallback SDK. Lihat Penolakan dan fallback.

  6. Mulai dari effort high: Default parameter effort tetap high. Pada Claude Opus 4.8, rekomendasi untuk pekerjaan coding dan otonomi tinggi adalah mengatur xhigh secara eksplisit. Pada claude-fable-5 dan claude-mythos-5, gunakan high sebagai default untuk sebagian besar tugas dan simpan xhigh untuk beban kerja yang paling sensitif terhadap kemampuan. Pengaturan effort yang lebih rendah tetap berkinerja baik dan sering melampaui kinerja xhigh pada model sebelumnya. Kurangi effort jika suatu tugas selesai tetapi memakan waktu lebih lama dari yang diperlukan. Lihat Prompting Claude Fable 5.

  7. Minimum caching prompt yang lebih rendah: Panjang prompt minimum yang dapat di-cache pada claude-fable-5 dan claude-mythos-5 adalah 512 token, lebih rendah dari 1.024 token pada Claude Opus 4.8. Prompt yang terlalu pendek untuk di-cache pada Claude Opus 4.8 kini dapat membuat entri cache, tanpa perlu perubahan kode. Lihat "Prompt caching" (caching prompt) untuk minimum per model.

Daftar periksa migrasi

  • Jika organisasi Anda memiliki pengaturan zero data retention (ZDR), konfirmasikan kelayakan sebelum bermigrasi. claude-fable-5 dan claude-mythos-5 memerlukan retensi data 30 hari dan tidak tersedia di bawah ZDR kecuali diizinkan secara tegas oleh Anthropic. Di Claude API, permintaan ke claude-fable-5 yang tidak memenuhi persyaratan ini mengembalikan invalid_request_error 400. Claude Opus 4.8 tersedia di bawah ZDR. Lihat Persyaratan retensi data khusus model.
  • Perbarui nama model dari claude-opus-4-8 ke claude-fable-5 (atau claude-mythos-5).
  • Hapus konfigurasi thinking: {type: "disabled"} apa pun. Menonaktifkan thinking mengembalikan error pada claude-fable-5 dan claude-mythos-5, dan permintaan tanpa field thinking berjalan dengan adaptive thinking.
  • Perbarui parsing respons yang membaca konten berdasarkan posisi, seperti content[0].text: dengan adaptive thinking yang selalu aktif, blok thinking tiba sebelum blok text. Pilih blok konten berdasarkan type sebagai gantinya, dan kirimkan kembali blok thinking secara lengkap dan tanpa modifikasi dalam loop penggunaan alat; blok yang dimodifikasi mengembalikan error 400. Lihat Mempertahankan blok thinking.
  • Jika Anda telah menghapus extended thinking manual dan prefill asisten selama migrasi sebelumnya, tidak diperlukan tindakan apa pun: keduanya tetap tidak didukung pada claude-fable-5 dan claude-mythos-5.
  • Verifikasi bahwa kode apa pun yang mem-parsing field thinking memperlakukannya hanya sebagai teks tampilan dan mengirimkan kembali blok thinking tanpa perubahan saat melanjutkan pada model yang sama. thinking.display secara default bernilai "omitted" pada claude-fable-5 dan claude-mythos-5, sama seperti pada Claude Opus 4.8. Atur display: "summarized" untuk menerima ringkasan yang dapat dibaca. Lihat Output thinking pada model Claude Fable dan Claude Mythos.
  • Jika Anda memutar ulang riwayat percakapan pada model yang lebih lama, hapus terlebih dahulu blok thinking dan redacted_thinking dari giliran asisten sebelumnya. Blok thinking dari claude-fable-5 dan claude-mythos-5 hanya dapat dibaca oleh model yang menghasilkannya atau model yang lebih baru: model yang lebih lama mengabaikannya secara diam-diam, sedangkan Claude Fable 5.1 dan Claude Mythos 5.1 membacanya, jadi pertahankan blok tersebut saat Anda memindahkan percakapan ke model-model tersebut (lihat Thinking yang dipertahankan). Penghapusan menjaga permintaan ke model yang lebih lama tetap minimal dan seragam. Pengecualiannya adalah menukarkan kredit fallback, yang mengharuskan body permintaan dikembalikan sesuai aturan persis fitur tersebut.
  • Jika Anda bermigrasi ke Claude Fable 5, tangani stop_reason: "refusal" dan baca field stop_details.category. Untuk menjalankan ulang permintaan yang ditolak pada model lain secara otomatis, pertimbangkan parameter opt-in fallbacks (beta). Lihat Penolakan dan fallback.
  • Evaluasi ulang pengaturan effort Anda. Mulai dari high untuk sebagian besar tugas, termasuk beban kerja yang berjalan pada xhigh di Claude Opus 4.8.
  • Tetapkan ulang baseline biaya dan latensi pada beban kerja Anda sendiri. Jumlah token kurang lebih tidak berubah saat bermigrasi dari claude-opus-4-8; harga per token berbeda, dan token thinking ditagih sebagai token output, sehingga beban kerja yang berjalan tanpa thinking menghasilkan lebih banyak token output per permintaan.

Was this page helpful?