Claude Platform Docs
Model & hargaClaude Fable 5.1

Migrasi ke Claude Fable 5.1 dan Claude Mythos 5.1

Migrasi ke Claude Fable 5.1 dan Claude Mythos 5.1 dari Claude Fable 5, Claude Mythos 5, Claude Opus 5, atau Claude Opus 4.8: ID model, perubahan yang merusak kompatibilitas, dan daftar periksa migrasi.

Claude Fable 5.1 menggantikan Claude Fable 5 dengan harga input dan output yang sama, dengan pembacaan cache seperempat dari biayanya. Model ini tersedia di Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud, dan Microsoft Foundry. Claude Mythos 5.1 memiliki kemampuan yang sama dan hanya ditawarkan kepada pelanggan yang disetujui dalam Project Glasswing. Untuk perbedaan perilaku dan pola prompting, lihat Prompting Claude Fable 5.1.

Pengaturan dasar yang dimiliki bersama oleh claude-fable-5-1 dan claude-mythos-5-1:

  • Thinking: Adaptive thinking (pemikiran adaptif) selalu aktif, tidak berubah dari Claude Fable 5. Model memutuskan kapan dan seberapa banyak harus berpikir. Tidak diperlukan konfigurasi thinking. Baik thinking: {type: "disabled"} maupun "extended thinking" (pemikiran diperpanjang) manual (thinking: {type: "enabled", budget_tokens: N}) mengembalikan error 400.
  • Prefill: Melakukan prefill pada pesan asisten mengembalikan error 400, tidak berubah dari Claude Fable 5. Gunakan instruksi "system prompt" (prompt sistem) sebagai gantinya.
  • Tool choice: {type: "auto"} (default) dan {type: "none"} didukung. Memaksa pemanggilan alat dengan {type: "any"} atau {type: "tool", name: "..."} mengembalikan error 400. Lihat Perubahan yang merusak kompatibilitas.
  • Thinking yang dipertahankan lintas model: Claude Fable 5.1 membaca blok thinking dari Claude Opus 5, Claude Fable 5, Claude Mythos 5, dan model Claude sebelumnya. Tidak satu pun dari model tersebut dapat membaca blok milik Claude Fable 5.1. Lihat Perubahan yang merusak kompatibilitas.
  • Jendela konteks dan output: "Context window" (jendela konteks) 1M token secara default, dan hingga 128k token output per permintaan.
  • Harga: $10 USD per juta token input dan $50 USD per juta token output, sama dengan Claude Fable 5. Pembacaan cache prompt seharga $0,25 USD per juta token, seperempat dari tarif Claude Fable 5. Lihat Harga Claude.
  • Retensi data: Kedua model memerlukan retensi data 30 hari, tidak tersedia di bawah pengaturan "zero data retention" (retensi data nol), atau ZDR, kecuali diizinkan secara tegas oleh Anthropic, dan ditetapkan sebagai Covered Models, sama seperti Claude Fable 5 dan Claude Mythos 5. Di Claude API, permintaan dari organisasi atau workspace tanpa retensi 30 hari mengembalikan invalid_request_error 400. Organisasi dengan pengaturan ZDR harus menghubungi tim akun Anthropic mereka, atau mengonfigurasi retensi per workspace. Lihat Persyaratan retensi data khusus model untuk detail per platform.

Di mana kedua model berbeda:

  • Ketersediaan: Claude Fable 5.1 tidak memerlukan persetujuan akses. Claude Mythos 5.1 hanya tersedia bagi pelanggan yang disetujui dalam Project Glasswing. Hubungi tim akun Anthropic Anda untuk mendapatkan akses.
  • Pengklasifikasi keamanan: Claude Fable 5.1 menjalankan pengklasifikasi keamanan yang mencakup kategori stop_details yang sama dengan Claude Fable 5. Permintaan yang ditolak mengembalikan stop_reason: "refusal" dengan stop_details.category, dan dapat beralih ke model lain dengan parameter fallbacks atau percobaan ulang di sisi klien. Lihat Penolakan dan fallback.
  • Priority Tier: Tidak satu pun dari kedua model didukung di Priority Tier. Claude Fable 5 didukung.

Migrasi ke Claude Fable 5.1 dari Claude Fable 5

Migrasi sebagian besar bersifat drop-in. Permukaan API, batasan, harga per token, tokenizer, adaptive thinking yang selalu aktif, penanganan penolakan, dan kategori stop_details semuanya sama dengan Claude Fable 5. Yang berubah: tool choice paksa mengembalikan error 400, blok thinking hanya dipertahankan untuk model yang menghasilkannya atau model yang lebih baru dan hanya dalam percakapan yang menghasilkannya, pembacaan cache lebih murah, dan perilaku agent-loop berbeda dalam tiga hal. Perubahan yang sama berlaku untuk Claude Mythos 5.1, kecuali pemeriksaan percakapan pada blok thinking, yang tidak dijalankan oleh Claude Mythos 5.1.

Perbarui nama model Anda

model = "claude-fable-5"  # Before
model = "claude-fable-5-1"  # After

# Atau, untuk model Project Glasswing dengan kemampuan yang sama:
model = "claude-mythos-5-1"  # After

Perubahan yang merusak kompatibilitas

  1. Tool choice paksa tidak didukung: Claude Fable 5 menerima tool_choice auto, none, any, dan tool. Pada claude-fable-5-1, {type: "any"} dan {type: "tool", name: "..."} mengembalikan invalid_request_error 400:

    tool_choice: type "tool" and "any" are not supported for this model.

    Pemeriksaan ini berlaku pada Messages API, Message Batches API, dan endpoint penghitungan token.

    Sebelum (Claude Fable 5):

    client = anthropic.Anthropic()
    
    record_summary_tool = {
        "name": "record_summary",
        "description": "Record the structured summary of the document.",
        "input_schema": {
            "type": "object",
            "properties": {"summary": {"type": "string"}},
            "required": ["summary"],
        },
    }
    
    response = client.messages.create(
        model="claude-fable-5",
        max_tokens=16000,
        tools=[record_summary_tool],
        tool_choice={"type": "tool", "name": "record_summary"},
        messages=[{"role": "user", "content": "Summarize: The meeting moved to Thursday."}],
    )
    print(response.content)

    Sesudah (Claude Fable 5.1): biarkan tool_choice pada auto, sebutkan nama alat dalam instruksi, dan atur strict: true agar pemanggilan sesuai dengan skema Anda. (Dalam organisasi CMEK, di mana structured outputs (output terstruktur), termasuk strict: true, tidak tersedia pada model Claude Fable, andalkan instruksi saja.) Sebagai contoh:

    client = anthropic.Anthropic()
    
    record_summary_tool = {
        "name": "record_summary",
        "description": "Record the structured summary of the document.",
        "strict": True,
        "input_schema": {
            "type": "object",
            "properties": {"summary": {"type": "string"}},
            "required": ["summary"],
            "additionalProperties": False,
        },
    }
    
    response = client.messages.create(
        model="claude-fable-5-1",
        max_tokens=16000,
        tools=[record_summary_tool],
        tool_choice={"type": "auto"},
        messages=[
            {
                "role": "user",
                "content": "Summarize: The meeting moved to Thursday. Call the record_summary tool with your result.",
            }
        ],
    )
    print(response.content)

    Lihat Penggunaan alat strict dan Memaksa penggunaan alat. Jika Anda memaksa alat hanya untuk mendapatkan JSON yang sesuai skema, gunakan output JSON (output_config.format) sebagai gantinya.

    Jika aplikasi Anda, bukan pengguna, memerlukan pemanggilan alat tertentu pada giliran saat ini dalam percakapan multi-giliran, tambahkan pesan sistem di tengah percakapan setelah giliran user terakhir. Sebutkan nama alat, nyatakan bahwa pemanggilan tersebut wajib untuk giliran ini, dan minta Claude untuk membuka responsnya dengan pemanggilan itu. Karena pesan ditambahkan di akhir alih-alih ditulis ke dalam prompt system tingkat atas, giliran sebelumnya tetap identik byte demi byte dan mempertahankan hit cache prompt mereka:

    client = anthropic.Anthropic()
    
    search_help_center_tool = {
        "name": "search_help_center",
        "description": "Search the help center for policy and troubleshooting articles.",
        "strict": True,
        "input_schema": {
            "type": "object",
            "properties": {"query": {"type": "string"}},
            "required": ["query"],
            "additionalProperties": False,
        },
    }
    
    response = client.messages.create(
        model="claude-fable-5-1",
        max_tokens=16000,
        system="You are a customer support assistant for an online electronics store.",
        tools=[search_help_center_tool],
        messages=[
            {
                "role": "user",
                "content": "My headphones from order A1234 arrived yesterday.",
            },
            {
                "role": "assistant",
                "content": "Thanks for confirming. How can I help with order A1234?",
            },
            {"role": "user", "content": "I opened the box. Can I still return them?"},
            # Aplikasi mewajibkan pencarian pusat bantuan sebelum jawaban
            # kebijakan apa pun. Menambahkan persyaratan sebagai pesan sistem membuat
            # giliran sebelumnya tidak berubah.
            {
                "role": "system",
                "content": "Tool-use requirement for the current turn: the application requires a call to the search_help_center tool in your response to the user's latest message. Begin your response with the search_help_center tool call. Do not reply with text only.",
            },
        ],
    )
    print(response.content)

    Pertahankan pesan role: "system" dalam riwayat pada permintaan berikutnya, seperti giliran lainnya. Pesan sistem di tengah percakapan tidak memerlukan header beta. tool_choice: {"type": "none"} tetap berfungsi untuk giliran yang tidak boleh memanggil alat.

  2. Blok thinking hanya dipertahankan untuk model yang menghasilkannya, atau model yang lebih baru: Setiap blok thinking mencatat model mana yang menghasilkannya. Claude Fable 5.1 membaca bloknya sendiri dan blok dari Claude Mythos 5.1, Claude Opus 5, Claude Fable 5, Claude Mythos 5, dan model Claude sebelumnya. Percakapan yang berpindah ke claude-fable-5-1 dari salah satu model tersebut mempertahankan penalaran sebelumnya. Kondisi ini bersifat satu arah: selain Claude Mythos 5.1, tidak satu pun dari model tersebut dapat membaca blok milik Claude Fable 5.1.

    Percakapan yang berjalan di Claude Fable 5.1 dapat berakhir di model yang lebih lama melalui peralihan router, percobaan ulang di sisi klien, atau fallback penolakan pengklasifikasi, termasuk fallback sisi server. API menghapus blok yang tidak dapat dibaca model tersebut sebelum model melihatnya, permintaan berhasil, dan Anda tidak ditagih untuk token input yang dibuang. Model target merencanakan ulang tanpa penalaran tersebut, yang dapat meningkatkan biaya dan latensi pada giliran pertama setelah peralihan. Untuk melihat apa yang dibuang, kirim header beta thinking-binding-controls-2026-08-01: respons kemudian membawa array input_transformations yang menyebutkan setiap blok yang dibuang dengan reason: "model_binding_mismatch". Lihat Thinking yang dipertahankan.

  3. Mengedit giliran sebelumnya membatalkan blok thinking: Setiap blok thinking dari Claude Fable 5.1 hanya valid terhadap prompt system, tools, dan riwayat percakapan yang mendahuluinya. Jika Claude Code, claude.ai, Claude Managed Agents, atau Claude Agent SDK mengelola riwayat percakapan Anda, prefiks tersebut sudah dijaga tetap utuh. Jika kode Anda membangun array messages sendiri, butir ini berlaku untuk Anda, dan Thinking yang dipertahankan adalah panduan integrasi lengkapnya. Di mana pemeriksaan ini diberlakukan, permintaan yang mengirim kembali blok tersebut setelah salah satu dari hal-hal itu berubah akan ditolak dengan error 400:

    messages.5.content.0: Invalid `signature` in `thinking` block. The block is bound to a different conversation. Remove the block, or set `thinking.block_binding.prefix_mismatch_behavior` to "drop_block". That setting requires the `thinking-binding-controls-2026-08-01` value in the `anthropic-beta` header.

    API memberlakukan pemeriksaan ini untuk akun baru yang dibuat pada atau setelah 31 Agustus 2026. Untuk akun yang dibuat lebih awal, API mencatat ketidakcocokan tetapi tidak menindaklanjutinya kecuali permintaan mengatur thinking.block_binding.prefix_mismatch_behavior, yang mengaktifkan pemberlakuan. Anthropic berencana memberlakukan pemeriksaan ini untuk setiap akun pada model mendatang, jadi buatlah aplikasi Anda kompatibel sekarang: pola yang sama menjaga cache prompt tetap hangat, dan Anda dapat menguji terhadap pemeriksaan ini dari akun mana pun dengan mengirim prefix_mismatch_behavior. Jika Anda merilis alat atau framework yang dijalankan orang dengan kunci API mereka sendiri, ujilah dengan cara itu sebelum peluncuran: kunci Anda kemungkinan berada di akun yang lebih lama, dan pengguna Anda di akun baru akan terkena pemeriksaan ini sebelum Anda. Untuk melihat apakah akun Anda sendiri diberlakukan secara default, kirim permintaan yang mengedit riwayat tanpa header beta: error 400 yang menyebutkan header tersebut berarti ya.

    Error ini bersifat permanen untuk body permintaan tersebut: loop percobaan ulang otomatis tidak akan menghilangkannya. Untuk melanjutkan tanpa penalaran yang dibatalkan alih-alih gagal, hapus blok thinking dari riwayat dan coba ulang sekali, atau kirim header beta thinking-binding-controls-2026-08-01 dan atur prefix_mismatch_behavior ke "drop_block" (default-nya adalah "error"). Dengan "drop_block", API membuang blok yang tidak cocok dan setiap blok thinking setelahnya dalam percakapan, dan melaporkan masing-masing dengan reason: "prefix_binding_mismatch" dalam array input_transformations pada respons:

    client = anthropic.Anthropic()
    
    response = client.beta.messages.create(
        model="claude-fable-5-1",
        max_tokens=16000,
        thinking={
            "type": "adaptive",
            "block_binding": {"prefix_mismatch_behavior": "drop_block"},
        },
        messages=[
            {
                "role": "user",
                "content": "What is the greatest common divisor of 1071 and 462?",
            }
        ],
        betas=["thinking-binding-controls-2026-08-01"],
    )
    
    for block in response.content:
        if block.type == "text":
            print(block.text)
    
    print(f"Input transformations: {len(response.input_transformations or [])}")

    Endpoint penghitungan token menjalankan pemeriksaan yang sama. Lihat Kontrol untuk blok yang tidak dipertahankan (beta) untuk bentuk respons dan penempatan streaming.

    Pola yang membatalkan blok thinking berikutnya, dan apa yang harus dilakukan sebagai gantinya:

    • Mengedit, mengurutkan ulang, atau menghapus giliran sebelumnya. Ini termasuk menghapus hasil alat lama, memotong giliran dari tengah transkrip, dan compaction sisi klien yang mempertahankan giliran terbaru beserta blok thinking-nya secara verbatim di belakang ringkasan (termasuk compaction latar belakang yang menukar ringkasannya beberapa giliran kemudian). Sebagai gantinya, gunakan compaction sisi server atau context editing (pembersihan hasil alat untuk hasil alat lama), atau salah satu bentuk compaction sisi klien di Pangkas konteks di server.
    • Menyisipkan konten yang tidak Anda simpan, misalnya pengingat per giliran yang ditambahkan setelah blok tool_result dan dihapus pada permintaan berikutnya. Sebagai gantinya, kirim pengingat sebagai pesan sistem cakupan giliran dan biarkan dalam riwayat.
    • Membangun ulang prompt system tingkat atas atau array tools di antara permintaan dalam percakapan yang sama, misalnya untuk memperbarui tanggal saat ini atau untuk menambah atau menghapus alat. Sebagai gantinya, tambahkan pesan sistem di tengah percakapan yang membawa instruksi baru ("The current date is 2026-09-14.") atau blok tool_addition dan tool_removal.
    • URL gambar atau dokumen yang menyajikan byte berbeda pada permintaan berikutnya. Pemeriksaan mencakup byte-nya, bukan string URL, jadi signed URL yang berotasi untuk file yang sama tidak masalah. Untuk konten yang Anda referensikan lintas giliran, unggah sekali dengan Files API dan kirim file_id, atau kirim base64.

    Setiap pengganti juga menjaga giliran sebelumnya identik byte demi byte dan mempertahankan hit cache prompt yang akan hilang jika riwayat, prompt system, atau array tools diedit.

    Pola yang tetap berfungsi:

    • Riwayat append-only: menambahkan giliran dan mengirim kembali giliran sebelumnya persis seperti yang dikirim dan diterima, termasuk pesan role: "system" yang ditambahkan.
    • Menghapus blok thinking dari giliran asisten sebelumnya, dimulai dari yang terlama.
    • Mengubah effort, max_tokens, atau parameter permintaan lain di luar system, tools, dan messages, serta menambah atau memindahkan penanda cache_control.
    • Compaction sisi server dan context editing, termasuk pembersihan blok thinking. Keduanya tidak dihitung sebagai pengeditan, karena pemeriksaan membandingkan percakapan sebagaimana Anda mengirimnya.

    Untuk memeriksa integrasi yang sudah ada:

    1. Tangkap body permintaan persis yang dikirimnya selama beberapa giliran normal, termasuk compaction atau perubahan alat jika produk Anda memilikinya. Untuk setiap pasangan permintaan berurutan, bandingkan prompt system, array tools, dan prefiks bersama dari messages. Semuanya harus identik byte demi byte hingga giliran yang baru ditambahkan.
    2. Jalankan sesi multi-giliran normal terhadap claude-fable-5-1 dengan header beta thinking-binding-controls-2026-08-01 dan prefix_mismatch_behavior: "drop_block", dan catat input_transformations pada setiap respons. Array kosong pada setiap giliran berarti riwayat utuh. Entri dengan reason: "prefix_binding_mismatch" berarti sesuatu sebelum blok di path berubah sejak permintaan sebelumnya. Entri dengan reason: "model_binding_mismatch" berarti percakapan berpindah model, yang bukan bug dalam kode Anda. Ini berfungsi dari akun mana pun, karena mengatur field tersebut mengaktifkan pemberlakuan untuk permintaan itu. Di CI, atur "error" sebagai gantinya agar pengeditan menggagalkan proses.
    3. Pilih pengaturan produksi. Biarkan default "error" jika ketidakcocokan prefiks hanya dapat berarti bug dalam kode Anda, atau atur "drop_block" untuk membuang blok yang terpengaruh alih-alih gagal, dan pantau error 400 atau entri input_transformations dalam kedua kasus.

    Membuang blok thinking sekali, misalnya pada batas compaction, hanya berdampak kecil. Integrasi yang membatalkan thinking sebelumnya pada setiap permintaan memulai ulang cache prompt setiap kali, yang dapat meningkatkan biaya per tugas (lihat Jaga riwayat percakapan tetap append-only).

Perubahan perilaku

  1. Lebih sedikit pemanggilan alat paralel dalam agent loop panjang: Dalam loop yang berjalan lama di mana pembacaan independen berikutnya hanya tersirat dari tugas (agen coding kustom, harness bash-dan-editor, computer use), Claude Fable 5.1 mungkin mengeluarkan satu pemanggilan alat per giliran. Setiap giliran tambahan memakan token, satu round trip, dan waktu nyata. Tambahkan instruksi batching satu kalimat setelah setiap pesan pengguna sebagai pesan sistem cakupan giliran (clear_at: "next_user_message", beta), atau, tanpa beta, dalam blok teks setelah blok tool_result, dan biarkan salinan sebelumnya dalam riwayat pada permintaan berikutnya. Lihat Batch pemanggilan alat independen dalam agent loop.

  2. Lebih sedikit pesan progres di antara pemanggilan alat: Claude Fable 5.1 menulis lebih sedikit pembaruan status selama urutan alat yang panjang dibandingkan Claude Fable 5, dan ringkasan agentic coding-nya lebih pendek. Jika antarmuka Anda merender pembaruan tersebut, atur thinking.display ke "updates" (beta) atau "summarized" dan minta secara eksplisit melalui prompt. Lihat Pembaruan progres di antara pemanggilan alat dan Minta pembaruan progres untuk pengguna.

  3. Lebih sedikit pemanggilan pencarian dan retrieval pada effort rendah: Pada effort low, Claude Fable 5.1 lebih sering menjawab dari memori dibandingkan Claude Fable 5 alih-alih memanggil alat pencarian atau retrieval. Jika produk Anda mengandalkan retrieval pada effort rendah, naikkan effort untuk permintaan tersebut atau beri tahu model kapan harus mencari. Lihat Pemicuan pencarian pada effort rendah.

Untuk perbedaan dalam kepadatan prosa, pemformatan chat, pengutipan dalam ringkasan, dan pengeditan file, yang tidak memengaruhi integrasi API, lihat Berubah dari Claude Fable 5.

Perubahan ini tidak wajib, tetapi masing-masing menurunkan biaya atau latensi atau menghilangkan mode kegagalan:

  1. Ubah effort di tengah percakapan (beta): Pada Claude Fable 5, output_config.effort berada di tingkat permintaan, dan mengubahnya di antara permintaan membuang prefiks yang di-cache dari giliran sebelumnya. Pada claude-fable-5-1, pesan role: "system" yang hanya membawa output_config menaikkan effort untuk langkah yang sulit atau menurunkannya untuk langkah rutin tanpa membatalkan cache prompt:

    client = anthropic.Anthropic()
    
    response = client.beta.messages.create(
        model="claude-fable-5-1",
        max_tokens=4096,
        output_config={"effort": "high"},
        messages=[
            {
                "role": "user",
                "content": "Plan a migration from SQLite to PostgreSQL in three short steps.",
            },
            {
                "role": "assistant",
                "content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.",
            },
            # Pesan sistem khusus effort: level baru berlaku mulai giliran pengguna berikutnya.
            {"role": "system", "content": [], "output_config": {"effort": "low"}},
            {"role": "user", "content": "Summarize the plan in one sentence."},
        ],
        betas=["mid-conversation-output-config-2026-07-01"],
    )
    
    for block in response.content:
        if block.type == "text":
            print(block.text)

    Nilai tersebut berlaku untuk giliran pengguna berikutnya dan setiap giliran setelahnya hingga pesan role: "system" lain mengubahnya. Hanya level bernama yang diterima (low, medium, high, xhigh, max), dan header beta mid-conversation-output-config-2026-07-01 diperlukan. Lihat Effort per pesan.

  2. Ubah instruksi dan alat dengan pesan sistem di tengah percakapan: Untuk mengubah instruksi atau alat di tengah sesi, tambahkan pesan role: "system", dengan blok tool_addition dan tool_removal untuk perubahan alat (header beta mid-conversation-tool-changes-2026-07-01, dengan set alat lengkap dideklarasikan dalam tools di awal sesi). Ini mempertahankan hit cache prompt pada giliran sebelumnya dan menjaga riwayat percakapan tetap append-only. Pesan yang sama menggantikan tool_choice paksa ketika alat tertentu harus dijalankan pada giliran saat ini (lihat Perubahan yang merusak kompatibilitas). Untuk pengingat yang hanya berlaku untuk satu giliran, kirim sebagai pesan role: "system" terpisah yang hanya berisi teks dengan clear_at: "next_user_message" (pesan sistem cakupan giliran, header beta mid-conversation-system-clear-at-2026-08-21) dan biarkan dalam riwayat: pesan tersebut berhenti dirender setelah pesan pengguna berikutnya dan tidak memakan token setelah dibersihkan. Pesan yang membawa blok tool_addition atau tool_removal tidak dapat dicakup per giliran.

  3. Gunakan fallbacks: "default" untuk penolakan: Tetap tangani stop_reason: "refusal" dan baca stop_details.category sebelum konten respons. Untuk menjalankan ulang permintaan yang ditolak pada model lain secara otomatis, atur fallbacks: "default" (beta, header server-side-fallback-2026-07-01). "default" mencoba ulang permintaan yang ditolak pada model yang direkomendasikan Anthropic untuk kategori tersebut. Target fallback yang diizinkan untuk Claude Fable 5.1 adalah Claude Opus 4.8 (claude-opus-4-8) dan Claude Opus 5 (claude-opus-5). Daftar fallbacks eksplisit dapat menyebutkan salah satunya. Model fallback tidak menerima blok thinking milik Claude Fable 5.1. Jika Anda membangun percobaan ulang sendiri, kredit fallback berlaku dengan ketentuan yang sama seperti Claude Fable 5. Lihat Penolakan dan fallback.

  4. Mulai dari effort high dan lakukan sweep: Default parameter effort adalah high, dan kelima level didukung. Pertahankan panduan Claude Fable 5: high untuk sebagian besar pekerjaan, dan medium sebagai kontrol biaya yang layak diuji. Peningkatan Claude Fable 5.1 dibandingkan Claude Fable 5 paling besar pada xhigh dan max, tetapi level tersebut juga menambah waktu berpikir dan waktu hingga respons pertama, jadi naikkan ke level tersebut untuk tugas yang paling sensitif terhadap kemampuan dan di mana eval Anda menunjukkan peningkatan. Jalankan sweep baru pada eval Anda sendiri alih-alih membawa pengaturan yang disetel untuk Claude Fable 5. Lihat Level effort yang direkomendasikan untuk Claude Fable 5.1.

  5. Pangkas konteks di server, atau lakukan compaction dalam bentuk yang tidak membawa thinking usang: Jika kode Anda memotong atau meringkas giliran lama di klien, perbaikan paling sederhana adalah memindahkan pekerjaan itu ke compaction sisi server atau context editing. Keduanya tidak dihitung sebagai pengeditan, karena pemeriksaan riwayat membandingkan percakapan sebagaimana Anda mengirimnya, sehingga tidak ada yang dihapusnya membatalkan blok thinking berikutnya, dan parameter instructions pada compaction menerima prompt peringkasan Anda sendiri. Jika Anda mempertahankan compaction di klien, pilih salah satu dari tiga bentuk:

    • Compaction sederhana (direkomendasikan): ganti seluruh riwayat dengan satu pesan ringkasan ditambah giliran pengguna baru dan jangan putar ulang apa pun lainnya. Tidak ada blok thinking yang dibawa, sehingga tidak ada yang gagal. Model Claude dilatih pada tugas jangka panjang dengan skema ini, dan kinerjanya sebanding dengan skema yang lebih rumit untuk sebagian besar beban kerja.
    • Compaction keep-tail: jika Anda mempertahankan giliran terbaru secara verbatim di belakang ringkasan, hapus blok thinking dan redacted_thinking dari giliran tersebut (teks dan pemanggilan alat boleh tetap ada), atau atur prefix_mismatch_behavior: "drop_block". Thinking-nya dihasilkan terhadap riwayat lengkap dan akan gagal di belakang ringkasan jika tidak.
    • Compaction latar belakang: jika Anda membangun ringkasan di luar jalur kritis dan menukarnya kemudian, setiap giliran yang dihasilkan sementara itu membawa thinking yang mendahului penukaran. Kirim "drop_block" pada setiap permintaan yang masih membawa blok thinking yang dihasilkan sebelum penukaran (atau hapus blok tersebut sendiri; input_transformations pada respons pertama setelah penukaran mencantumkan persis blok mana saja), atau lakukan compaction secara sinkron.

    Jangan memotong giliran individual dari tengah transkrip: itu membatalkan setiap blok thinking berikutnya dan tidak ada bentuk sisi klien yang menghindarinya. Gunakan pesan sistem di tengah percakapan untuk perubahan instruksi yang Anda buat, atau context editing sisi server untuk penghapusan selektif. Lihat Mengirim kembali blok compaction.

Daftar periksa migrasi

  • Perbarui nama model dari claude-fable-5 menjadi claude-fable-5-1 (atau claude-mythos-5 menjadi claude-mythos-5-1).
  • Ganti tool_choice paksa ({type: "any"} atau {type: "tool", ...}). Ini mengembalikan error 400. Gunakan {type: "auto"} ditambah instruksi eksplisit dan alat strict: true, atau output JSON. Letakkan instruksi di giliran user, atau di pesan role: "system" di tengah percakapan ketika aplikasi Anda mengharuskan pemanggilan tersebut.
  • Terus kirimkan kembali blok thinking tanpa perubahan pada setiap giliran, termasuk yang kosong. Claude Fable 5.1 membaca blok dari Claude Opus 5, Claude Fable 5, Claude Mythos 5, dan model sebelumnya. Memindahkan percakapan dari Claude Fable 5.1 ke model sebelumnya akan membuang bloknya (Claude Mythos 5.1 membacanya).
  • Jika kode Anda membangun array messages sendiri, periksa apakah kode tersebut mengedit giliran sebelumnya: jalankan sesi dengan header beta thinking-binding-controls-2026-08-01 dan prefix_mismatch_behavior: "drop_block", catat input_transformations, dan perbaiki setiap prefix_binding_mismatch. Entri model_binding_mismatch setelah pergantian model adalah hal yang diharapkan.
  • Jaga riwayat percakapan agar hanya-tambah (append-only): bekukan system dan tools pada awal sesi dan pindahkan perubahan di tengah sesi ke pesan role: "system" serta blok tool_addition / tool_removal, kirim pengingat per giliran sebagai pesan sistem lingkup-giliran yang tidak pernah Anda hapus, pangkas konteks di sisi server atau hapus blok thinking dari giliran mana pun yang Anda bawa melintasi ringkasan sisi klien, dan referensikan file lintas giliran dengan file_id.
  • Pilih prefix_mismatch_behavior produksi ("error" secara default, atau "drop_block") dan pantau. Jika Anda memelihara alat yang dijalankan orang lain dengan kunci API mereka sendiri, uji dengan field tersebut disetel: akun baru diberlakukan secara default meskipun akun Anda tidak.
  • Tinjau loop agen untuk perilaku satu-pemanggilan-alat-per-giliran dan tambahkan instruksi batching.
  • Jika antarmuka Anda merender teks progres di antara pemanggilan alat, setel thinking.display ke "updates" (beta) atau "summarized" dan minta pembaruan melalui prompt.
  • Jika Anda mengubah effort di antara permintaan, pindahkan perubahan tersebut ke pesan role: "system" effort per pesan (beta) untuk mempertahankan cache hit.
  • Tangani stop_reason: "refusal" dan baca stop_details.category. Pertimbangkan fallbacks: "default" (beta).
  • Evaluasi ulang effort dengan sapuan baru, dimulai dari high, dan tetapkan ulang baseline biaya dan latensi pada beban kerja Anda sendiri. Jumlah token kurang lebih tidak berubah. Pembacaan cache prompt berbiaya seperempat dari tarif Claude Fable 5.

Migrasi ke Claude Fable 5.1 dari Claude Opus 5

Claude Fable 5.1 menggunakan pola Messages API dan penggunaan alat yang sama dengan Claude Opus 5. Model ini mempertahankan jendela konteks 1M token secara default, 128k token output maksimum, minimum caching prompt 512 token, dan dukungan pesan sistem di tengah percakapan. Pembatasan prefill, pembatasan parameter sampling, dan default "omitted" untuk thinking.display juga tetap berlaku. Terapkan semua yang ada di Migrasi ke Claude Fable 5.1 dari Claude Fable 5, ditambah hal-hal berikut.

Perbarui nama model Anda

model = "claude-opus-5"  # Before
model = "claude-fable-5-1"  # After

# Atau, untuk model Project Glasswing dengan kemampuan yang sama:
model = "claude-mythos-5-1"  # After

Apa yang berubah

  1. Thinking tidak dapat lagi dinonaktifkan: Claude Opus 5 menerima thinking: {type: "disabled"} pada level effort high atau lebih rendah. Pada claude-fable-5-1 dan claude-mythos-5-1, adaptive thinking (pemikiran adaptif) selalu aktif, dan thinking: {type: "disabled"} mengembalikan error 400 pada level effort apa pun. Hapus field tersebut, kendalikan pengeluaran token dengan level effort yang lebih rendah, dan tinjau kembali max_tokens untuk beban kerja yang berjalan dengan thinking dinonaktifkan.

  2. Pilihan alat paksa tidak didukung: Claude Opus 5 menerima tool_choice any dan tool. claude-fable-5-1 mengembalikan error 400. Lihat Perubahan yang merusak.

  3. Thinking yang dipertahankan lintas model: Claude Fable 5.1 membaca blok thinking Claude Opus 5: percakapan yang berpindah dari claude-opus-5 ke claude-fable-5-1 mempertahankan penalarannya. Claude Opus 5 tidak dapat membaca blok Claude Fable 5.1. Blok Claude Fable 5.1 juga berhenti valid ketika giliran sebelumnya berubah: jika kode Anda mengedit pesan sebelumnya, membangun ulang system atau tools, atau melakukan kompaksi di klien di antara permintaan, Claude Opus 5 tidak keberatan, tetapi claude-fable-5-1 menolak atau membuang setiap blok thinking berikutnya. Jalankan pemeriksaan tiga langkah di bagian tersebut sebelum mengalihkan lalu lintas. Lihat Perubahan yang merusak.

  4. Teks di antara pemanggilan alat dikembalikan dalam blok thinking: Pada Claude Opus 5, teks yang ditulis model di antara pemanggilan alat dikembalikan sebagai blok text. Pada claude-fable-5-1, seperti pada Claude Fable 5, narasi tersebut dikembalikan sebagai blok thinking pembaruan progres, satu sebelum setiap pemanggilan alat. Di bawah thinking.display default "omitted", blok tersebut tidak membawa teks yang dapat dibaca. Jika antarmuka Anda merender narasi tersebut, setel display: "updates" (beta) untuk menerima pembaruan progres sebagai teks sementara penalaran tetap tersembunyi, atau "summarized" untuk menerima keduanya. Kemudian render blok thinking yang tidak kosong di antara blok tool_use. Lihat Pembaruan progres di antara pemanggilan alat.

  5. Pengklasifikasi keamanan dan perutean fallback: Claude Fable 5.1 menjalankan pengklasifikasi keamanan yang mencakup kategori stop_details yang sama dengan Claude Fable 5, kumpulan yang lebih luas daripada pengklasifikasi khusus keamanan siber milik Claude Opus 5. Harapkan nilai stop_details.category di luar "cyber", seperti "bio" dan "reasoning_extraction"; lihat tabel kategori penolakan untuk kumpulan lengkapnya. Untuk konfigurasi fallbacks dan target yang diizinkan, lihat Gunakan fallbacks: "default" untuk penolakan.

  6. Harga: $10 USD per juta token input dan $50 USD per juta token output, dibandingkan dengan $5 USD dan $25 USD untuk Claude Opus 5. Pembacaan cache prompt adalah $0,25 USD per juta token, setengah dari tarif Claude Opus 5. Lihat Harga Claude.

  7. Retensi data: Claude Fable 5.1 dan Claude Mythos 5.1 memerlukan retensi data 30 hari, tidak tersedia di bawah pengaturan zero data retention (ZDR) kecuali diizinkan secara tegas oleh Anthropic, dan ditetapkan sebagai Covered Models. Claude Opus 5 tersedia di bawah ZDR. Lihat Persyaratan retensi data khusus model.

Daftar periksa migrasi

  • Jika organisasi Anda memiliki pengaturan zero data retention (ZDR), konfirmasikan kelayakan terlebih dahulu: model-model ini tidak tersedia di bawah ZDR kecuali diizinkan secara tegas oleh Anthropic. Lihat Persyaratan retensi data khusus model.
  • Perbarui nama model dari claude-opus-5 menjadi claude-fable-5-1 (atau claude-mythos-5-1).
  • Hapus konfigurasi thinking: {type: "disabled"} apa pun: ini mengembalikan error 400 pada claude-fable-5-1. Kendalikan pengeluaran token dengan level effort yang lebih rendah, dan tinjau kembali max_tokens.
  • Ganti tool_choice paksa (any atau tool) dengan auto ditambah instruksi eksplisit (giliran user atau pesan sistem di tengah percakapan) dan alat strict: true, atau dengan output JSON.
  • Jika antarmuka Anda merender teks di antara pemanggilan alat, setel display: "updates" (beta) atau "summarized" dan render blok thinking yang tidak kosong.
  • Terapkan item thinking yang dipertahankan, pengeditan riwayat, perilaku, effort, dan fallback dari daftar periksa Claude Fable 5.
  • Tetapkan ulang baseline biaya pada beban kerja Anda sendiri. Jumlah token kurang lebih tidak berubah. Harga per token berbeda.

Migrasi ke Claude Fable 5.1 dari Claude Opus 4.8 atau sebelumnya

Pertama terapkan Migrasi ke Claude Mythos 5 dan Claude Fable 5 dari Claude Opus 4.8 untuk perubahan tingkat API dari Claude Opus 4.8. Panduan tersebut mencakup adaptive thinking, output thinking, penolakan, effort, minimum caching, harga, dan retensi data. Kemudian terapkan delta yang tersisa di Migrasi ke Claude Fable 5.1 dari Claude Fable 5. Pada Claude Opus 4.7 atau sebelumnya, mulailah dengan bagian Migrasi ke Claude Opus 5 yang sesuai.

Perbarui nama model Anda

model = "claude-opus-4-8"  # Before
model = "claude-fable-5-1"  # After

# Atau, untuk model Project Glasswing dengan kemampuan yang sama:
model = "claude-mythos-5-1"  # After

Daftar periksa migrasi

  • Jika organisasi Anda memiliki pengaturan zero data retention (ZDR), konfirmasikan kelayakan terlebih dahulu: model-model ini tidak tersedia di bawah ZDR kecuali diizinkan secara tegas oleh Anthropic. Claude Opus 4.8 tersedia di bawah ZDR.
  • Perbarui nama model dari claude-opus-4-8 menjadi claude-fable-5-1 (atau claude-mythos-5-1).
  • Hapus konfigurasi thinking: {type: "disabled"} apa pun dan tinjau kembali max_tokens. Permintaan tanpa field thinking berjalan dengan adaptive thinking.
  • Ganti tool_choice paksa (any atau tool) dengan auto ditambah instruksi eksplisit (giliran user atau pesan sistem di tengah percakapan) dan alat strict: true, atau dengan output JSON.
  • Kirimkan kembali blok thinking tanpa perubahan dan perlakukan teksnya sebagai hanya-untuk-tampilan. Claude Fable 5.1 membaca blok thinking Claude Opus 4.8: percakapan yang berpindah ke claude-fable-5-1 mempertahankan penalaran sebelumnya. Claude Opus 4.8 tidak dapat membaca blok Claude Fable 5.1.
  • Jika kode Anda membangun array messages sendiri, periksa apakah kode tersebut mengedit giliran sebelumnya. Integrasi yang ditulis untuk Claude Opus 4.8 dan sebelumnya sering memotong giliran lama, menghapus atau membangun ulang pesan sebelumnya, atau menyegarkan prompt system setiap permintaan, dan Claude Opus 4.8 tidak pernah keberatan. Pada claude-fable-5-1 masing-masing hal tersebut membuat blok thinking berikutnya tidak valid.
  • Tangani stop_reason: "refusal", baca stop_details.category, dan pertimbangkan fallbacks: "default" (beta).
  • Terapkan item thinking yang dipertahankan, pengeditan riwayat, perilaku, effort per pesan, dan pembaruan progres dari daftar periksa Claude Fable 5.
  • Evaluasi ulang effort (mulai dari high), tinjau prompt yang mendekati minimum caching 512 token, dan tetapkan ulang baseline biaya dan latensi. Harga per token berbeda.

Migrasi ke Claude Mythos 5.1 dari Claude Mythos 5

Claude Mythos 5.1 adalah pasangan berakses terbatas dari Claude Fable 5.1. Konfirmasikan akses organisasi Anda dengan tim akun Anthropic Anda sebelum mengganti ID model.

Delta tingkat API sama dengan Migrasi ke Claude Fable 5.1 dari Claude Fable 5: pilihan alat paksa mengembalikan error 400, dan blok thinking dipertahankan hanya untuk model yang menghasilkannya atau model yang lebih baru (Claude Mythos 5.1 membaca blok Claude Mythos 5, bukan sebaliknya). Tidak seperti Claude Fable 5.1, Claude Mythos 5.1 tidak menjalankan pemeriksaan percakapan, sehingga mengedit giliran sebelumnya tidak membuat blok thinking tidak valid, meskipun tetap memulai ulang cache prompt.

Perbarui nama model Anda

model = "claude-mythos-5"  # Before
model = "claude-mythos-5-1"  # After

Daftar periksa migrasi

  • Perbarui nama model dari claude-mythos-5 menjadi claude-mythos-5-1.
  • Ganti tool_choice paksa (any atau tool) dengan auto ditambah instruksi eksplisit (giliran user atau pesan sistem di tengah percakapan) dan alat strict: true, atau dengan output JSON.
  • Tangani stop_reason: "refusal" dan baca stop_details.category sebelum konten respons. Lihat Penolakan dan fallback.
  • Terus kirimkan kembali blok thinking tanpa perubahan pada setiap giliran, termasuk yang kosong.
  • Jika kode Anda membangun array messages sendiri, jaga riwayat percakapan agar hanya-tambah untuk menjaga cache prompt tetap hangat. Claude Mythos 5.1 tidak menjalankan pemeriksaan percakapan, sehingga pengeditan tidak membuat blok thinking-nya tidak valid.
  • Terapkan perubahan perilaku dan perubahan yang direkomendasikan dari bagian Claude Fable 5, kecuali item pengeditan riwayat, yang tidak berlaku untuk Claude Mythos 5.1.
  • Evaluasi ulang effort dengan sapuan baru dan tetapkan ulang baseline biaya dan latensi. Pembacaan cache prompt berbiaya seperempat dari tarif Claude Mythos 5.

Was this page helpful?