Migrasi ke Claude Fable 5.1 dan Claude Mythos 5.1
Migrasi ke Claude Fable 5.1 dan Claude Mythos 5.1 dari Claude Fable 5, Claude Mythos 5, Claude Opus 5, atau Claude Opus 4.8: ID model, perubahan yang merusak kompatibilitas, dan daftar periksa migrasi.
Claude Fable 5.1 menggantikan Claude Fable 5 dengan harga input dan output yang sama, dengan pembacaan cache seperempat dari biayanya. Model ini tersedia di Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud, dan Microsoft Foundry. Claude Mythos 5.1 memiliki kemampuan yang sama dan hanya ditawarkan kepada pelanggan yang disetujui dalam Project Glasswing. Untuk perbedaan perilaku dan pola prompting, lihat Prompting Claude Fable 5.1.
Pengaturan dasar yang dimiliki bersama oleh claude-fable-5-1 dan claude-mythos-5-1:
- Thinking: Adaptive thinking (pemikiran adaptif) selalu aktif, tidak berubah dari Claude Fable 5. Model memutuskan kapan dan seberapa banyak harus berpikir. Tidak diperlukan konfigurasi
thinking. Baikthinking: {type: "disabled"}maupun "extended thinking" (pemikiran diperpanjang) manual (thinking: {type: "enabled", budget_tokens: N}) mengembalikan error 400. - Prefill: Melakukan prefill pada pesan asisten mengembalikan error 400, tidak berubah dari Claude Fable 5. Gunakan instruksi "system prompt" (prompt sistem) sebagai gantinya.
- Tool choice:
{type: "auto"}(default) dan{type: "none"}didukung. Memaksa pemanggilan alat dengan{type: "any"}atau{type: "tool", name: "..."}mengembalikan error 400. Lihat Perubahan yang merusak kompatibilitas. - Thinking yang dipertahankan lintas model: Claude Fable 5.1 membaca blok thinking dari Claude Opus 5, Claude Fable 5, Claude Mythos 5, dan model Claude sebelumnya. Tidak satu pun dari model tersebut dapat membaca blok milik Claude Fable 5.1. Lihat Perubahan yang merusak kompatibilitas.
- Jendela konteks dan output: "Context window" (jendela konteks) 1M token secara default, dan hingga 128k token output per permintaan.
- Harga: $10 USD per juta token input dan $50 USD per juta token output, sama dengan Claude Fable 5. Pembacaan cache prompt seharga $0,25 USD per juta token, seperempat dari tarif Claude Fable 5. Lihat Harga Claude.
- Retensi data: Kedua model memerlukan retensi data 30 hari, tidak tersedia di bawah pengaturan "zero data retention" (retensi data nol), atau ZDR, kecuali diizinkan secara tegas oleh Anthropic, dan ditetapkan sebagai Covered Models, sama seperti Claude Fable 5 dan Claude Mythos 5. Di Claude API, permintaan dari organisasi atau workspace tanpa retensi 30 hari mengembalikan
invalid_request_error400. Organisasi dengan pengaturan ZDR harus menghubungi tim akun Anthropic mereka, atau mengonfigurasi retensi per workspace. Lihat Persyaratan retensi data khusus model untuk detail per platform.
Di mana kedua model berbeda:
- Ketersediaan: Claude Fable 5.1 tidak memerlukan persetujuan akses. Claude Mythos 5.1 hanya tersedia bagi pelanggan yang disetujui dalam Project Glasswing. Hubungi tim akun Anthropic Anda untuk mendapatkan akses.
- Pengklasifikasi keamanan: Claude Fable 5.1 menjalankan pengklasifikasi keamanan yang mencakup kategori
stop_detailsyang sama dengan Claude Fable 5. Permintaan yang ditolak mengembalikanstop_reason: "refusal"denganstop_details.category, dan dapat beralih ke model lain dengan parameterfallbacksatau percobaan ulang di sisi klien. Lihat Penolakan dan fallback. - Priority Tier: Tidak satu pun dari kedua model didukung di Priority Tier. Claude Fable 5 didukung.
Migrasi ke Claude Fable 5.1 dari Claude Fable 5
Migrasi sebagian besar bersifat drop-in. Permukaan API, batasan, harga per token, tokenizer, adaptive thinking yang selalu aktif, penanganan penolakan, dan kategori stop_details semuanya sama dengan Claude Fable 5. Yang berubah: tool choice paksa mengembalikan error 400, blok thinking hanya dipertahankan untuk model yang menghasilkannya atau model yang lebih baru dan hanya dalam percakapan yang menghasilkannya, pembacaan cache lebih murah, dan perilaku agent-loop berbeda dalam tiga hal. Perubahan yang sama berlaku untuk Claude Mythos 5.1, kecuali pemeriksaan percakapan pada blok thinking, yang tidak dijalankan oleh Claude Mythos 5.1.
Perbarui nama model Anda
model = "claude-fable-5" # Before
model = "claude-fable-5-1" # After
# Atau, untuk model Project Glasswing dengan kemampuan yang sama:
model = "claude-mythos-5-1" # AfterPerubahan yang merusak kompatibilitas
-
Tool choice paksa tidak didukung: Claude Fable 5 menerima
tool_choiceauto,none,any, dantool. Padaclaude-fable-5-1,{type: "any"}dan{type: "tool", name: "..."}mengembalikaninvalid_request_error400:tool_choice: type "tool" and "any" are not supported for this model.Pemeriksaan ini berlaku pada Messages API, Message Batches API, dan endpoint penghitungan token.
Sebelum (Claude Fable 5):
client = anthropic.Anthropic() record_summary_tool = { "name": "record_summary", "description": "Record the structured summary of the document.", "input_schema": { "type": "object", "properties": {"summary": {"type": "string"}}, "required": ["summary"], }, } response = client.messages.create( model="claude-fable-5", max_tokens=16000, tools=[record_summary_tool], tool_choice={"type": "tool", "name": "record_summary"}, messages=[{"role": "user", "content": "Summarize: The meeting moved to Thursday."}], ) print(response.content)Sesudah (Claude Fable 5.1): biarkan
tool_choicepadaauto, sebutkan nama alat dalam instruksi, dan aturstrict: trueagar pemanggilan sesuai dengan skema Anda. (Dalam organisasi CMEK, di mana structured outputs (output terstruktur), termasukstrict: true, tidak tersedia pada model Claude Fable, andalkan instruksi saja.) Sebagai contoh:client = anthropic.Anthropic() record_summary_tool = { "name": "record_summary", "description": "Record the structured summary of the document.", "strict": True, "input_schema": { "type": "object", "properties": {"summary": {"type": "string"}}, "required": ["summary"], "additionalProperties": False, }, } response = client.messages.create( model="claude-fable-5-1", max_tokens=16000, tools=[record_summary_tool], tool_choice={"type": "auto"}, messages=[ { "role": "user", "content": "Summarize: The meeting moved to Thursday. Call the record_summary tool with your result.", } ], ) print(response.content)Lihat Penggunaan alat strict dan Memaksa penggunaan alat. Jika Anda memaksa alat hanya untuk mendapatkan JSON yang sesuai skema, gunakan output JSON (
output_config.format) sebagai gantinya.Jika aplikasi Anda, bukan pengguna, memerlukan pemanggilan alat tertentu pada giliran saat ini dalam percakapan multi-giliran, tambahkan pesan sistem di tengah percakapan setelah giliran
userterakhir. Sebutkan nama alat, nyatakan bahwa pemanggilan tersebut wajib untuk giliran ini, dan minta Claude untuk membuka responsnya dengan pemanggilan itu. Karena pesan ditambahkan di akhir alih-alih ditulis ke dalam promptsystemtingkat atas, giliran sebelumnya tetap identik byte demi byte dan mempertahankan hit cache prompt mereka:client = anthropic.Anthropic() search_help_center_tool = { "name": "search_help_center", "description": "Search the help center for policy and troubleshooting articles.", "strict": True, "input_schema": { "type": "object", "properties": {"query": {"type": "string"}}, "required": ["query"], "additionalProperties": False, }, } response = client.messages.create( model="claude-fable-5-1", max_tokens=16000, system="You are a customer support assistant for an online electronics store.", tools=[search_help_center_tool], messages=[ { "role": "user", "content": "My headphones from order A1234 arrived yesterday.", }, { "role": "assistant", "content": "Thanks for confirming. How can I help with order A1234?", }, {"role": "user", "content": "I opened the box. Can I still return them?"}, # Aplikasi mewajibkan pencarian pusat bantuan sebelum jawaban # kebijakan apa pun. Menambahkan persyaratan sebagai pesan sistem membuat # giliran sebelumnya tidak berubah. { "role": "system", "content": "Tool-use requirement for the current turn: the application requires a call to the search_help_center tool in your response to the user's latest message. Begin your response with the search_help_center tool call. Do not reply with text only.", }, ], ) print(response.content)Pertahankan pesan
role: "system"dalam riwayat pada permintaan berikutnya, seperti giliran lainnya. Pesan sistem di tengah percakapan tidak memerlukan header beta.tool_choice: {"type": "none"}tetap berfungsi untuk giliran yang tidak boleh memanggil alat. -
Blok thinking hanya dipertahankan untuk model yang menghasilkannya, atau model yang lebih baru: Setiap blok
thinkingmencatat model mana yang menghasilkannya. Claude Fable 5.1 membaca bloknya sendiri dan blok dari Claude Mythos 5.1, Claude Opus 5, Claude Fable 5, Claude Mythos 5, dan model Claude sebelumnya. Percakapan yang berpindah keclaude-fable-5-1dari salah satu model tersebut mempertahankan penalaran sebelumnya. Kondisi ini bersifat satu arah: selain Claude Mythos 5.1, tidak satu pun dari model tersebut dapat membaca blok milik Claude Fable 5.1.Percakapan yang berjalan di Claude Fable 5.1 dapat berakhir di model yang lebih lama melalui peralihan router, percobaan ulang di sisi klien, atau fallback penolakan pengklasifikasi, termasuk fallback sisi server. API menghapus blok yang tidak dapat dibaca model tersebut sebelum model melihatnya, permintaan berhasil, dan Anda tidak ditagih untuk token input yang dibuang. Model target merencanakan ulang tanpa penalaran tersebut, yang dapat meningkatkan biaya dan latensi pada giliran pertama setelah peralihan. Untuk melihat apa yang dibuang, kirim header beta
thinking-binding-controls-2026-08-01: respons kemudian membawa arrayinput_transformationsyang menyebutkan setiap blok yang dibuang denganreason: "model_binding_mismatch". Lihat Thinking yang dipertahankan. -
Mengedit giliran sebelumnya membatalkan blok thinking: Setiap blok
thinkingdari Claude Fable 5.1 hanya valid terhadap promptsystem,tools, dan riwayat percakapan yang mendahuluinya. Jika Claude Code, claude.ai, Claude Managed Agents, atau Claude Agent SDK mengelola riwayat percakapan Anda, prefiks tersebut sudah dijaga tetap utuh. Jika kode Anda membangun arraymessagessendiri, butir ini berlaku untuk Anda, dan Thinking yang dipertahankan adalah panduan integrasi lengkapnya. Di mana pemeriksaan ini diberlakukan, permintaan yang mengirim kembali blok tersebut setelah salah satu dari hal-hal itu berubah akan ditolak dengan error 400:messages.5.content.0: Invalid `signature` in `thinking` block. The block is bound to a different conversation. Remove the block, or set `thinking.block_binding.prefix_mismatch_behavior` to "drop_block". That setting requires the `thinking-binding-controls-2026-08-01` value in the `anthropic-beta` header.API memberlakukan pemeriksaan ini untuk akun baru yang dibuat pada atau setelah 31 Agustus 2026. Untuk akun yang dibuat lebih awal, API mencatat ketidakcocokan tetapi tidak menindaklanjutinya kecuali permintaan mengatur
thinking.block_binding.prefix_mismatch_behavior, yang mengaktifkan pemberlakuan. Anthropic berencana memberlakukan pemeriksaan ini untuk setiap akun pada model mendatang, jadi buatlah aplikasi Anda kompatibel sekarang: pola yang sama menjaga cache prompt tetap hangat, dan Anda dapat menguji terhadap pemeriksaan ini dari akun mana pun dengan mengirimprefix_mismatch_behavior. Jika Anda merilis alat atau framework yang dijalankan orang dengan kunci API mereka sendiri, ujilah dengan cara itu sebelum peluncuran: kunci Anda kemungkinan berada di akun yang lebih lama, dan pengguna Anda di akun baru akan terkena pemeriksaan ini sebelum Anda. Untuk melihat apakah akun Anda sendiri diberlakukan secara default, kirim permintaan yang mengedit riwayat tanpa header beta: error 400 yang menyebutkan header tersebut berarti ya.Error ini bersifat permanen untuk body permintaan tersebut: loop percobaan ulang otomatis tidak akan menghilangkannya. Untuk melanjutkan tanpa penalaran yang dibatalkan alih-alih gagal, hapus blok
thinkingdari riwayat dan coba ulang sekali, atau kirim header betathinking-binding-controls-2026-08-01dan aturprefix_mismatch_behaviorke"drop_block"(default-nya adalah"error"). Dengan"drop_block", API membuang blok yang tidak cocok dan setiap blok thinking setelahnya dalam percakapan, dan melaporkan masing-masing denganreason: "prefix_binding_mismatch"dalam arrayinput_transformationspada respons:client = anthropic.Anthropic() response = client.beta.messages.create( model="claude-fable-5-1", max_tokens=16000, thinking={ "type": "adaptive", "block_binding": {"prefix_mismatch_behavior": "drop_block"}, }, messages=[ { "role": "user", "content": "What is the greatest common divisor of 1071 and 462?", } ], betas=["thinking-binding-controls-2026-08-01"], ) for block in response.content: if block.type == "text": print(block.text) print(f"Input transformations: {len(response.input_transformations or [])}")Endpoint penghitungan token menjalankan pemeriksaan yang sama. Lihat Kontrol untuk blok yang tidak dipertahankan (beta) untuk bentuk respons dan penempatan streaming.
Pola yang membatalkan blok thinking berikutnya, dan apa yang harus dilakukan sebagai gantinya:
- Mengedit, mengurutkan ulang, atau menghapus giliran sebelumnya. Ini termasuk menghapus hasil alat lama, memotong giliran dari tengah transkrip, dan compaction sisi klien yang mempertahankan giliran terbaru beserta blok thinking-nya secara verbatim di belakang ringkasan (termasuk compaction latar belakang yang menukar ringkasannya beberapa giliran kemudian). Sebagai gantinya, gunakan compaction sisi server atau context editing (pembersihan hasil alat untuk hasil alat lama), atau salah satu bentuk compaction sisi klien di Pangkas konteks di server.
- Menyisipkan konten yang tidak Anda simpan, misalnya pengingat per giliran yang ditambahkan setelah blok
tool_resultdan dihapus pada permintaan berikutnya. Sebagai gantinya, kirim pengingat sebagai pesan sistem cakupan giliran dan biarkan dalam riwayat. - Membangun ulang prompt
systemtingkat atas atau arraytoolsdi antara permintaan dalam percakapan yang sama, misalnya untuk memperbarui tanggal saat ini atau untuk menambah atau menghapus alat. Sebagai gantinya, tambahkan pesan sistem di tengah percakapan yang membawa instruksi baru ("The current date is 2026-09-14.") atau bloktool_additiondantool_removal. - URL gambar atau dokumen yang menyajikan byte berbeda pada permintaan berikutnya. Pemeriksaan mencakup byte-nya, bukan string URL, jadi signed URL yang berotasi untuk file yang sama tidak masalah. Untuk konten yang Anda referensikan lintas giliran, unggah sekali dengan Files API dan kirim
file_id, atau kirim base64.
Setiap pengganti juga menjaga giliran sebelumnya identik byte demi byte dan mempertahankan hit cache prompt yang akan hilang jika riwayat, prompt
system, atau arraytoolsdiedit.Pola yang tetap berfungsi:
- Riwayat append-only: menambahkan giliran dan mengirim kembali giliran sebelumnya persis seperti yang dikirim dan diterima, termasuk pesan
role: "system"yang ditambahkan. - Menghapus blok thinking dari giliran asisten sebelumnya, dimulai dari yang terlama.
- Mengubah
effort,max_tokens, atau parameter permintaan lain di luarsystem,tools, danmessages, serta menambah atau memindahkan penandacache_control. - Compaction sisi server dan context editing, termasuk pembersihan blok thinking. Keduanya tidak dihitung sebagai pengeditan, karena pemeriksaan membandingkan percakapan sebagaimana Anda mengirimnya.
Untuk memeriksa integrasi yang sudah ada:
- Tangkap body permintaan persis yang dikirimnya selama beberapa giliran normal, termasuk compaction atau perubahan alat jika produk Anda memilikinya. Untuk setiap pasangan permintaan berurutan, bandingkan prompt
system, arraytools, dan prefiks bersama darimessages. Semuanya harus identik byte demi byte hingga giliran yang baru ditambahkan. - Jalankan sesi multi-giliran normal terhadap
claude-fable-5-1dengan header betathinking-binding-controls-2026-08-01danprefix_mismatch_behavior: "drop_block", dan catatinput_transformationspada setiap respons. Array kosong pada setiap giliran berarti riwayat utuh. Entri denganreason: "prefix_binding_mismatch"berarti sesuatu sebelum blok dipathberubah sejak permintaan sebelumnya. Entri denganreason: "model_binding_mismatch"berarti percakapan berpindah model, yang bukan bug dalam kode Anda. Ini berfungsi dari akun mana pun, karena mengatur field tersebut mengaktifkan pemberlakuan untuk permintaan itu. Di CI, atur"error"sebagai gantinya agar pengeditan menggagalkan proses. - Pilih pengaturan produksi. Biarkan default
"error"jika ketidakcocokan prefiks hanya dapat berarti bug dalam kode Anda, atau atur"drop_block"untuk membuang blok yang terpengaruh alih-alih gagal, dan pantau error 400 atau entriinput_transformationsdalam kedua kasus.
Membuang blok thinking sekali, misalnya pada batas compaction, hanya berdampak kecil. Integrasi yang membatalkan thinking sebelumnya pada setiap permintaan memulai ulang cache prompt setiap kali, yang dapat meningkatkan biaya per tugas (lihat Jaga riwayat percakapan tetap append-only).
Perubahan perilaku
-
Lebih sedikit pemanggilan alat paralel dalam agent loop panjang: Dalam loop yang berjalan lama di mana pembacaan independen berikutnya hanya tersirat dari tugas (agen coding kustom, harness bash-dan-editor, computer use), Claude Fable 5.1 mungkin mengeluarkan satu pemanggilan alat per giliran. Setiap giliran tambahan memakan token, satu round trip, dan waktu nyata. Tambahkan instruksi batching satu kalimat setelah setiap pesan pengguna sebagai pesan sistem cakupan giliran (
clear_at: "next_user_message", beta), atau, tanpa beta, dalam blok teks setelah bloktool_result, dan biarkan salinan sebelumnya dalam riwayat pada permintaan berikutnya. Lihat Batch pemanggilan alat independen dalam agent loop. -
Lebih sedikit pesan progres di antara pemanggilan alat: Claude Fable 5.1 menulis lebih sedikit pembaruan status selama urutan alat yang panjang dibandingkan Claude Fable 5, dan ringkasan agentic coding-nya lebih pendek. Jika antarmuka Anda merender pembaruan tersebut, atur
thinking.displayke"updates"(beta) atau"summarized"dan minta secara eksplisit melalui prompt. Lihat Pembaruan progres di antara pemanggilan alat dan Minta pembaruan progres untuk pengguna. -
Lebih sedikit pemanggilan pencarian dan retrieval pada effort rendah: Pada effort
low, Claude Fable 5.1 lebih sering menjawab dari memori dibandingkan Claude Fable 5 alih-alih memanggil alat pencarian atau retrieval. Jika produk Anda mengandalkan retrieval pada effort rendah, naikkan effort untuk permintaan tersebut atau beri tahu model kapan harus mencari. Lihat Pemicuan pencarian pada effort rendah.
Untuk perbedaan dalam kepadatan prosa, pemformatan chat, pengutipan dalam ringkasan, dan pengeditan file, yang tidak memengaruhi integrasi API, lihat Berubah dari Claude Fable 5.
Perubahan yang direkomendasikan
Perubahan ini tidak wajib, tetapi masing-masing menurunkan biaya atau latensi atau menghilangkan mode kegagalan:
-
Ubah effort di tengah percakapan (beta): Pada Claude Fable 5,
output_config.effortberada di tingkat permintaan, dan mengubahnya di antara permintaan membuang prefiks yang di-cache dari giliran sebelumnya. Padaclaude-fable-5-1, pesanrole: "system"yang hanya membawaoutput_configmenaikkan effort untuk langkah yang sulit atau menurunkannya untuk langkah rutin tanpa membatalkan cache prompt:client = anthropic.Anthropic() response = client.beta.messages.create( model="claude-fable-5-1", max_tokens=4096, output_config={"effort": "high"}, messages=[ { "role": "user", "content": "Plan a migration from SQLite to PostgreSQL in three short steps.", }, { "role": "assistant", "content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.", }, # Pesan sistem khusus effort: level baru berlaku mulai giliran pengguna berikutnya. {"role": "system", "content": [], "output_config": {"effort": "low"}}, {"role": "user", "content": "Summarize the plan in one sentence."}, ], betas=["mid-conversation-output-config-2026-07-01"], ) for block in response.content: if block.type == "text": print(block.text)Nilai tersebut berlaku untuk giliran pengguna berikutnya dan setiap giliran setelahnya hingga pesan
role: "system"lain mengubahnya. Hanya level bernama yang diterima (low,medium,high,xhigh,max), dan header betamid-conversation-output-config-2026-07-01diperlukan. Lihat Effort per pesan. -
Ubah instruksi dan alat dengan pesan sistem di tengah percakapan: Untuk mengubah instruksi atau alat di tengah sesi, tambahkan pesan
role: "system", dengan bloktool_additiondantool_removaluntuk perubahan alat (header betamid-conversation-tool-changes-2026-07-01, dengan set alat lengkap dideklarasikan dalamtoolsdi awal sesi). Ini mempertahankan hit cache prompt pada giliran sebelumnya dan menjaga riwayat percakapan tetap append-only. Pesan yang sama menggantikantool_choicepaksa ketika alat tertentu harus dijalankan pada giliran saat ini (lihat Perubahan yang merusak kompatibilitas). Untuk pengingat yang hanya berlaku untuk satu giliran, kirim sebagai pesanrole: "system"terpisah yang hanya berisi teks denganclear_at: "next_user_message"(pesan sistem cakupan giliran, header betamid-conversation-system-clear-at-2026-08-21) dan biarkan dalam riwayat: pesan tersebut berhenti dirender setelah pesan pengguna berikutnya dan tidak memakan token setelah dibersihkan. Pesan yang membawa bloktool_additionatautool_removaltidak dapat dicakup per giliran. -
Gunakan
fallbacks: "default"untuk penolakan: Tetap tanganistop_reason: "refusal"dan bacastop_details.categorysebelum konten respons. Untuk menjalankan ulang permintaan yang ditolak pada model lain secara otomatis, aturfallbacks: "default"(beta, headerserver-side-fallback-2026-07-01)."default"mencoba ulang permintaan yang ditolak pada model yang direkomendasikan Anthropic untuk kategori tersebut. Target fallback yang diizinkan untuk Claude Fable 5.1 adalah Claude Opus 4.8 (claude-opus-4-8) dan Claude Opus 5 (claude-opus-5). Daftarfallbackseksplisit dapat menyebutkan salah satunya. Model fallback tidak menerima blok thinking milik Claude Fable 5.1. Jika Anda membangun percobaan ulang sendiri, kredit fallback berlaku dengan ketentuan yang sama seperti Claude Fable 5. Lihat Penolakan dan fallback. -
Mulai dari effort
highdan lakukan sweep: Default parameter effort adalahhigh, dan kelima level didukung. Pertahankan panduan Claude Fable 5:highuntuk sebagian besar pekerjaan, danmediumsebagai kontrol biaya yang layak diuji. Peningkatan Claude Fable 5.1 dibandingkan Claude Fable 5 paling besar padaxhighdanmax, tetapi level tersebut juga menambah waktu berpikir dan waktu hingga respons pertama, jadi naikkan ke level tersebut untuk tugas yang paling sensitif terhadap kemampuan dan di mana eval Anda menunjukkan peningkatan. Jalankan sweep baru pada eval Anda sendiri alih-alih membawa pengaturan yang disetel untuk Claude Fable 5. Lihat Level effort yang direkomendasikan untuk Claude Fable 5.1. -
Pangkas konteks di server, atau lakukan compaction dalam bentuk yang tidak membawa thinking usang: Jika kode Anda memotong atau meringkas giliran lama di klien, perbaikan paling sederhana adalah memindahkan pekerjaan itu ke compaction sisi server atau context editing. Keduanya tidak dihitung sebagai pengeditan, karena pemeriksaan riwayat membandingkan percakapan sebagaimana Anda mengirimnya, sehingga tidak ada yang dihapusnya membatalkan blok thinking berikutnya, dan parameter
instructionspada compaction menerima prompt peringkasan Anda sendiri. Jika Anda mempertahankan compaction di klien, pilih salah satu dari tiga bentuk:- Compaction sederhana (direkomendasikan): ganti seluruh riwayat dengan satu pesan ringkasan ditambah giliran pengguna baru dan jangan putar ulang apa pun lainnya. Tidak ada blok thinking yang dibawa, sehingga tidak ada yang gagal. Model Claude dilatih pada tugas jangka panjang dengan skema ini, dan kinerjanya sebanding dengan skema yang lebih rumit untuk sebagian besar beban kerja.
- Compaction keep-tail: jika Anda mempertahankan giliran terbaru secara verbatim di belakang ringkasan, hapus blok
thinkingdanredacted_thinkingdari giliran tersebut (teks dan pemanggilan alat boleh tetap ada), atau aturprefix_mismatch_behavior: "drop_block". Thinking-nya dihasilkan terhadap riwayat lengkap dan akan gagal di belakang ringkasan jika tidak. - Compaction latar belakang: jika Anda membangun ringkasan di luar jalur kritis dan menukarnya kemudian, setiap giliran yang dihasilkan sementara itu membawa thinking yang mendahului penukaran. Kirim
"drop_block"pada setiap permintaan yang masih membawa blok thinking yang dihasilkan sebelum penukaran (atau hapus blok tersebut sendiri;input_transformationspada respons pertama setelah penukaran mencantumkan persis blok mana saja), atau lakukan compaction secara sinkron.
Jangan memotong giliran individual dari tengah transkrip: itu membatalkan setiap blok thinking berikutnya dan tidak ada bentuk sisi klien yang menghindarinya. Gunakan pesan sistem di tengah percakapan untuk perubahan instruksi yang Anda buat, atau context editing sisi server untuk penghapusan selektif. Lihat Mengirim kembali blok compaction.
Daftar periksa migrasi
- Perbarui nama model dari
claude-fable-5menjadiclaude-fable-5-1(atauclaude-mythos-5menjadiclaude-mythos-5-1). - Ganti
tool_choicepaksa ({type: "any"}atau{type: "tool", ...}). Ini mengembalikan error 400. Gunakan{type: "auto"}ditambah instruksi eksplisit dan alatstrict: true, atau output JSON. Letakkan instruksi di giliranuser, atau di pesanrole: "system"di tengah percakapan ketika aplikasi Anda mengharuskan pemanggilan tersebut. - Terus kirimkan kembali blok
thinkingtanpa perubahan pada setiap giliran, termasuk yang kosong. Claude Fable 5.1 membaca blok dari Claude Opus 5, Claude Fable 5, Claude Mythos 5, dan model sebelumnya. Memindahkan percakapan dari Claude Fable 5.1 ke model sebelumnya akan membuang bloknya (Claude Mythos 5.1 membacanya). - Jika kode Anda membangun array
messagessendiri, periksa apakah kode tersebut mengedit giliran sebelumnya: jalankan sesi dengan header betathinking-binding-controls-2026-08-01danprefix_mismatch_behavior: "drop_block", catatinput_transformations, dan perbaiki setiapprefix_binding_mismatch. Entrimodel_binding_mismatchsetelah pergantian model adalah hal yang diharapkan. - Jaga riwayat percakapan agar hanya-tambah (append-only): bekukan
systemdantoolspada awal sesi dan pindahkan perubahan di tengah sesi ke pesanrole: "system"serta bloktool_addition/tool_removal, kirim pengingat per giliran sebagai pesan sistem lingkup-giliran yang tidak pernah Anda hapus, pangkas konteks di sisi server atau hapus blok thinking dari giliran mana pun yang Anda bawa melintasi ringkasan sisi klien, dan referensikan file lintas giliran denganfile_id. - Pilih
prefix_mismatch_behaviorproduksi ("error"secara default, atau"drop_block") dan pantau. Jika Anda memelihara alat yang dijalankan orang lain dengan kunci API mereka sendiri, uji dengan field tersebut disetel: akun baru diberlakukan secara default meskipun akun Anda tidak. - Tinjau loop agen untuk perilaku satu-pemanggilan-alat-per-giliran dan tambahkan instruksi batching.
- Jika antarmuka Anda merender teks progres di antara pemanggilan alat, setel
thinking.displayke"updates"(beta) atau"summarized"dan minta pembaruan melalui prompt. - Jika Anda mengubah effort di antara permintaan, pindahkan perubahan tersebut ke pesan
role: "system"effort per pesan (beta) untuk mempertahankan cache hit. - Tangani
stop_reason: "refusal"dan bacastop_details.category. Pertimbangkanfallbacks: "default"(beta). - Evaluasi ulang
effortdengan sapuan baru, dimulai darihigh, dan tetapkan ulang baseline biaya dan latensi pada beban kerja Anda sendiri. Jumlah token kurang lebih tidak berubah. Pembacaan cache prompt berbiaya seperempat dari tarif Claude Fable 5.
Migrasi ke Claude Fable 5.1 dari Claude Opus 5
Claude Fable 5.1 menggunakan pola Messages API dan penggunaan alat yang sama dengan Claude Opus 5. Model ini mempertahankan jendela konteks 1M token secara default, 128k token output maksimum, minimum caching prompt 512 token, dan dukungan pesan sistem di tengah percakapan. Pembatasan prefill, pembatasan parameter sampling, dan default "omitted" untuk thinking.display juga tetap berlaku. Terapkan semua yang ada di Migrasi ke Claude Fable 5.1 dari Claude Fable 5, ditambah hal-hal berikut.
Perbarui nama model Anda
model = "claude-opus-5" # Before
model = "claude-fable-5-1" # After
# Atau, untuk model Project Glasswing dengan kemampuan yang sama:
model = "claude-mythos-5-1" # AfterApa yang berubah
-
Thinking tidak dapat lagi dinonaktifkan: Claude Opus 5 menerima
thinking: {type: "disabled"}pada level efforthighatau lebih rendah. Padaclaude-fable-5-1danclaude-mythos-5-1, adaptive thinking (pemikiran adaptif) selalu aktif, danthinking: {type: "disabled"}mengembalikan error 400 pada level effort apa pun. Hapus field tersebut, kendalikan pengeluaran token dengan level effort yang lebih rendah, dan tinjau kembalimax_tokensuntuk beban kerja yang berjalan dengan thinking dinonaktifkan. -
Pilihan alat paksa tidak didukung: Claude Opus 5 menerima
tool_choiceanydantool.claude-fable-5-1mengembalikan error 400. Lihat Perubahan yang merusak. -
Thinking yang dipertahankan lintas model: Claude Fable 5.1 membaca blok thinking Claude Opus 5: percakapan yang berpindah dari
claude-opus-5keclaude-fable-5-1mempertahankan penalarannya. Claude Opus 5 tidak dapat membaca blok Claude Fable 5.1. Blok Claude Fable 5.1 juga berhenti valid ketika giliran sebelumnya berubah: jika kode Anda mengedit pesan sebelumnya, membangun ulangsystematautools, atau melakukan kompaksi di klien di antara permintaan, Claude Opus 5 tidak keberatan, tetapiclaude-fable-5-1menolak atau membuang setiap blok thinking berikutnya. Jalankan pemeriksaan tiga langkah di bagian tersebut sebelum mengalihkan lalu lintas. Lihat Perubahan yang merusak. -
Teks di antara pemanggilan alat dikembalikan dalam blok thinking: Pada Claude Opus 5, teks yang ditulis model di antara pemanggilan alat dikembalikan sebagai blok
text. Padaclaude-fable-5-1, seperti pada Claude Fable 5, narasi tersebut dikembalikan sebagai blokthinkingpembaruan progres, satu sebelum setiap pemanggilan alat. Di bawahthinking.displaydefault"omitted", blok tersebut tidak membawa teks yang dapat dibaca. Jika antarmuka Anda merender narasi tersebut, seteldisplay: "updates"(beta) untuk menerima pembaruan progres sebagai teks sementara penalaran tetap tersembunyi, atau"summarized"untuk menerima keduanya. Kemudian render blokthinkingyang tidak kosong di antara bloktool_use. Lihat Pembaruan progres di antara pemanggilan alat. -
Pengklasifikasi keamanan dan perutean fallback: Claude Fable 5.1 menjalankan pengklasifikasi keamanan yang mencakup kategori
stop_detailsyang sama dengan Claude Fable 5, kumpulan yang lebih luas daripada pengklasifikasi khusus keamanan siber milik Claude Opus 5. Harapkan nilaistop_details.categorydi luar"cyber", seperti"bio"dan"reasoning_extraction"; lihat tabel kategori penolakan untuk kumpulan lengkapnya. Untuk konfigurasifallbacksdan target yang diizinkan, lihat Gunakanfallbacks: "default"untuk penolakan. -
Harga: $10 USD per juta token input dan $50 USD per juta token output, dibandingkan dengan $5 USD dan $25 USD untuk Claude Opus 5. Pembacaan cache prompt adalah $0,25 USD per juta token, setengah dari tarif Claude Opus 5. Lihat Harga Claude.
-
Retensi data: Claude Fable 5.1 dan Claude Mythos 5.1 memerlukan retensi data 30 hari, tidak tersedia di bawah pengaturan zero data retention (ZDR) kecuali diizinkan secara tegas oleh Anthropic, dan ditetapkan sebagai Covered Models. Claude Opus 5 tersedia di bawah ZDR. Lihat Persyaratan retensi data khusus model.
Daftar periksa migrasi
- Jika organisasi Anda memiliki pengaturan zero data retention (ZDR), konfirmasikan kelayakan terlebih dahulu: model-model ini tidak tersedia di bawah ZDR kecuali diizinkan secara tegas oleh Anthropic. Lihat Persyaratan retensi data khusus model.
- Perbarui nama model dari
claude-opus-5menjadiclaude-fable-5-1(atauclaude-mythos-5-1). - Hapus konfigurasi
thinking: {type: "disabled"}apa pun: ini mengembalikan error 400 padaclaude-fable-5-1. Kendalikan pengeluaran token dengan level effort yang lebih rendah, dan tinjau kembalimax_tokens. - Ganti
tool_choicepaksa (anyatautool) denganautoditambah instruksi eksplisit (giliranuseratau pesan sistem di tengah percakapan) dan alatstrict: true, atau dengan output JSON. - Jika antarmuka Anda merender teks di antara pemanggilan alat, setel
display: "updates"(beta) atau"summarized"dan render blokthinkingyang tidak kosong. - Terapkan item thinking yang dipertahankan, pengeditan riwayat, perilaku, effort, dan fallback dari daftar periksa Claude Fable 5.
- Tetapkan ulang baseline biaya pada beban kerja Anda sendiri. Jumlah token kurang lebih tidak berubah. Harga per token berbeda.
Migrasi ke Claude Fable 5.1 dari Claude Opus 4.8 atau sebelumnya
Pertama terapkan Migrasi ke Claude Mythos 5 dan Claude Fable 5 dari Claude Opus 4.8 untuk perubahan tingkat API dari Claude Opus 4.8. Panduan tersebut mencakup adaptive thinking, output thinking, penolakan, effort, minimum caching, harga, dan retensi data. Kemudian terapkan delta yang tersisa di Migrasi ke Claude Fable 5.1 dari Claude Fable 5. Pada Claude Opus 4.7 atau sebelumnya, mulailah dengan bagian Migrasi ke Claude Opus 5 yang sesuai.
Perbarui nama model Anda
model = "claude-opus-4-8" # Before
model = "claude-fable-5-1" # After
# Atau, untuk model Project Glasswing dengan kemampuan yang sama:
model = "claude-mythos-5-1" # AfterDaftar periksa migrasi
- Jika organisasi Anda memiliki pengaturan zero data retention (ZDR), konfirmasikan kelayakan terlebih dahulu: model-model ini tidak tersedia di bawah ZDR kecuali diizinkan secara tegas oleh Anthropic. Claude Opus 4.8 tersedia di bawah ZDR.
- Perbarui nama model dari
claude-opus-4-8menjadiclaude-fable-5-1(atauclaude-mythos-5-1). - Hapus konfigurasi
thinking: {type: "disabled"}apa pun dan tinjau kembalimax_tokens. Permintaan tanpa fieldthinkingberjalan dengan adaptive thinking. - Ganti
tool_choicepaksa (anyatautool) denganautoditambah instruksi eksplisit (giliranuseratau pesan sistem di tengah percakapan) dan alatstrict: true, atau dengan output JSON. - Kirimkan kembali blok
thinkingtanpa perubahan dan perlakukan teksnya sebagai hanya-untuk-tampilan. Claude Fable 5.1 membaca blok thinking Claude Opus 4.8: percakapan yang berpindah keclaude-fable-5-1mempertahankan penalaran sebelumnya. Claude Opus 4.8 tidak dapat membaca blok Claude Fable 5.1. - Jika kode Anda membangun array
messagessendiri, periksa apakah kode tersebut mengedit giliran sebelumnya. Integrasi yang ditulis untuk Claude Opus 4.8 dan sebelumnya sering memotong giliran lama, menghapus atau membangun ulang pesan sebelumnya, atau menyegarkan promptsystemsetiap permintaan, dan Claude Opus 4.8 tidak pernah keberatan. Padaclaude-fable-5-1masing-masing hal tersebut membuat blok thinking berikutnya tidak valid. - Tangani
stop_reason: "refusal", bacastop_details.category, dan pertimbangkanfallbacks: "default"(beta). - Terapkan item thinking yang dipertahankan, pengeditan riwayat, perilaku, effort per pesan, dan pembaruan progres dari daftar periksa Claude Fable 5.
- Evaluasi ulang
effort(mulai darihigh), tinjau prompt yang mendekati minimum caching 512 token, dan tetapkan ulang baseline biaya dan latensi. Harga per token berbeda.
Migrasi ke Claude Mythos 5.1 dari Claude Mythos 5
Claude Mythos 5.1 adalah pasangan berakses terbatas dari Claude Fable 5.1. Konfirmasikan akses organisasi Anda dengan tim akun Anthropic Anda sebelum mengganti ID model.
Delta tingkat API sama dengan Migrasi ke Claude Fable 5.1 dari Claude Fable 5: pilihan alat paksa mengembalikan error 400, dan blok thinking dipertahankan hanya untuk model yang menghasilkannya atau model yang lebih baru (Claude Mythos 5.1 membaca blok Claude Mythos 5, bukan sebaliknya). Tidak seperti Claude Fable 5.1, Claude Mythos 5.1 tidak menjalankan pemeriksaan percakapan, sehingga mengedit giliran sebelumnya tidak membuat blok thinking tidak valid, meskipun tetap memulai ulang cache prompt.
Perbarui nama model Anda
model = "claude-mythos-5" # Before
model = "claude-mythos-5-1" # AfterDaftar periksa migrasi
- Perbarui nama model dari
claude-mythos-5menjadiclaude-mythos-5-1. - Ganti
tool_choicepaksa (anyatautool) denganautoditambah instruksi eksplisit (giliranuseratau pesan sistem di tengah percakapan) dan alatstrict: true, atau dengan output JSON. - Tangani
stop_reason: "refusal"dan bacastop_details.categorysebelum konten respons. Lihat Penolakan dan fallback. - Terus kirimkan kembali blok
thinkingtanpa perubahan pada setiap giliran, termasuk yang kosong. - Jika kode Anda membangun array
messagessendiri, jaga riwayat percakapan agar hanya-tambah untuk menjaga cache prompt tetap hangat. Claude Mythos 5.1 tidak menjalankan pemeriksaan percakapan, sehingga pengeditan tidak membuat blok thinking-nya tidak valid. - Terapkan perubahan perilaku dan perubahan yang direkomendasikan dari bagian Claude Fable 5, kecuali item pengeditan riwayat, yang tidak berlaku untuk Claude Mythos 5.1.
- Evaluasi ulang
effortdengan sapuan baru dan tetapkan ulang baseline biaya dan latensi. Pembacaan cache prompt berbiaya seperempat dari tarif Claude Mythos 5.
Was this page helpful?