Claude Platform Docs
Модели и ценыClaude Fable 5.1

Миграция на Claude Fable 5.1 и Claude Mythos 5.1

Миграция на Claude Fable 5.1 и Claude Mythos 5.1 с Claude Fable 5, Claude Mythos 5, Claude Opus 5 или Claude Opus 4.8: идентификаторы моделей, критические изменения и контрольные списки миграции.

Claude Fable 5.1 приходит на смену Claude Fable 5 с теми же ценами на входные и выходные токены, при этом чтение из кэша стоит в четыре раза дешевле. Модель доступна в Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry. Claude Mythos 5.1 обладает теми же возможностями и предлагается только одобренным клиентам в рамках Project Glasswing. О поведенческих различиях и шаблонах подсказок см. Составление подсказок для Claude Fable 5.1.

Базовые настройки, общие для claude-fable-5-1 и claude-mythos-5-1:

  • Мышление: Adaptive thinking (адаптивное мышление) всегда включено, без изменений по сравнению с Claude Fable 5. Модель сама решает, когда и сколько думать. Конфигурация thinking не требуется. И thinking: {type: "disabled"}, и ручное «extended thinking» (расширенное мышление) (thinking: {type: "enabled", budget_tokens: N}) возвращают ошибку 400.
  • Предзаполнение: Предзаполнение (prefill) сообщения ассистента возвращает ошибку 400, без изменений по сравнению с Claude Fable 5. Вместо этого используйте инструкции в системной подсказке.
  • Выбор инструмента: Поддерживаются {type: "auto"} (по умолчанию) и {type: "none"}. Принудительный вызов инструмента с помощью {type: "any"} или {type: "tool", name: "..."} возвращает ошибку 400. См. Критические изменения.
  • Сохранённое мышление между моделями: Claude Fable 5.1 читает блоки мышления от Claude Opus 5, Claude Fable 5, Claude Mythos 5 и более ранних моделей Claude. Ни одна из этих моделей не может читать блоки Claude Fable 5.1. См. Критические изменения.
  • Контекстное окно и вывод: «Context window» (контекстное окно) размером 1M токенов по умолчанию и до 128k выходных токенов на запрос.
  • Цены: $10 USD за миллион входных токенов и $50 USD за миллион выходных токенов, как и у Claude Fable 5. Чтение из кэша подсказок стоит $0,25 USD за миллион токенов — четверть тарифа Claude Fable 5. См. Цены на Claude.
  • Хранение данных: Обе модели требуют 30-дневного хранения данных, недоступны в рамках соглашений о нулевом хранении данных (zero data retention, или ZDR), если это прямо не разрешено Anthropic, и отнесены к категории Covered Models, как и Claude Fable 5 и Claude Mythos 5. В Claude API запрос от организации или рабочего пространства без 30-дневного хранения возвращает ошибку 400 invalid_request_error. Организациям с соглашением ZDR следует обратиться к своей команде по работе с клиентами Anthropic или настроить хранение для каждого рабочего пространства отдельно. Подробности по платформам см. в разделе Требования к хранению данных для конкретных моделей.

В чём две модели расходятся:

  • Доступность: Claude Fable 5.1 не требует одобрения доступа. Claude Mythos 5.1 доступна только одобренным клиентам в рамках Project Glasswing. Для получения доступа обратитесь к своей команде по работе с клиентами Anthropic.
  • Классификаторы безопасности: Claude Fable 5.1 использует классификаторы безопасности, охватывающие те же категории stop_details, что и Claude Fable 5. Отклонённый запрос возвращает stop_reason: "refusal" с stop_details.category и может быть перенаправлен на другую модель с помощью параметра fallbacks или повторной попытки на стороне клиента. См. Отказы и резервные модели.
  • Priority Tier: Ни одна из моделей не поддерживается на Priority Tier. Claude Fable 5 поддерживается.

Миграция на Claude Fable 5.1 с Claude Fable 5

Миграция в основном сводится к прямой замене. Поверхность API, лимиты, цены за токен, токенизатор, всегда включённое адаптивное мышление, обработка отказов и категории stop_details — всё совпадает с Claude Fable 5. Что меняется: принудительный выбор инструмента возвращает ошибку 400, блоки мышления сохраняются только для модели, которая их создала, или более новой, и только в том разговоре, в котором они были созданы, чтение из кэша стоит дешевле, а поведение в агентных циклах отличается в трёх аспектах. Те же изменения применяются к Claude Mythos 5.1, за исключением проверки разговора для блоков мышления, которую Claude Mythos 5.1 не выполняет.

Обновите имя модели

model = "claude-fable-5"  # Before
model = "claude-fable-5-1"  # After

# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5-1"  # After

Критические изменения

  1. Принудительный выбор инструмента не поддерживается: Claude Fable 5 принимает значения tool_choice auto, none, any и tool. На claude-fable-5-1 значения {type: "any"} и {type: "tool", name: "..."} возвращают ошибку 400 invalid_request_error:

    tool_choice: type "tool" and "any" are not supported for this model.

    Проверка применяется в Messages API, Message Batches API и на эндпоинте подсчёта токенов.

    До (Claude Fable 5):

    client = anthropic.Anthropic()
    
    record_summary_tool = {
        "name": "record_summary",
        "description": "Record the structured summary of the document.",
        "input_schema": {
            "type": "object",
            "properties": {"summary": {"type": "string"}},
            "required": ["summary"],
        },
    }
    
    response = client.messages.create(
        model="claude-fable-5",
        max_tokens=16000,
        tools=[record_summary_tool],
        tool_choice={"type": "tool", "name": "record_summary"},
        messages=[{"role": "user", "content": "Summarize: The meeting moved to Thursday."}],
    )
    print(response.content)

    После (Claude Fable 5.1): оставьте tool_choice в значении auto, назовите инструмент в инструкции и установите strict: true, чтобы вызов соответствовал вашей схеме. (В организации с CMEK, где структурированные выходные данные, включая strict: true, недоступны для моделей Claude Fable, полагайтесь только на инструкцию.) Например:

    client = anthropic.Anthropic()
    
    record_summary_tool = {
        "name": "record_summary",
        "description": "Record the structured summary of the document.",
        "strict": True,
        "input_schema": {
            "type": "object",
            "properties": {"summary": {"type": "string"}},
            "required": ["summary"],
            "additionalProperties": False,
        },
    }
    
    response = client.messages.create(
        model="claude-fable-5-1",
        max_tokens=16000,
        tools=[record_summary_tool],
        tool_choice={"type": "auto"},
        messages=[
            {
                "role": "user",
                "content": "Summarize: The meeting moved to Thursday. Call the record_summary tool with your result.",
            }
        ],
    )
    print(response.content)

    См. Строгое использование инструментов и Принудительное использование инструментов. Если вы принудительно вызывали инструмент только для получения JSON, соответствующего схеме, используйте вместо этого JSON-вывод (output_config.format).

    Если ваше приложение, а не пользователь, требует вызова конкретного инструмента на текущем ходе многоходового разговора, добавьте системное сообщение в середине разговора после последнего хода user. Назовите инструмент, укажите, что вызов обязателен для этого хода, и попросите Claude начать свой ответ с него. Поскольку сообщение добавляется в конец, а не записывается в системную подсказку верхнего уровня system, более ранние ходы остаются побайтово идентичными и сохраняют попадания в кэш подсказок:

    client = anthropic.Anthropic()
    
    search_help_center_tool = {
        "name": "search_help_center",
        "description": "Search the help center for policy and troubleshooting articles.",
        "strict": True,
        "input_schema": {
            "type": "object",
            "properties": {"query": {"type": "string"}},
            "required": ["query"],
            "additionalProperties": False,
        },
    }
    
    response = client.messages.create(
        model="claude-fable-5-1",
        max_tokens=16000,
        system="You are a customer support assistant for an online electronics store.",
        tools=[search_help_center_tool],
        messages=[
            {
                "role": "user",
                "content": "My headphones from order A1234 arrived yesterday.",
            },
            {
                "role": "assistant",
                "content": "Thanks for confirming. How can I help with order A1234?",
            },
            {"role": "user", "content": "I opened the box. Can I still return them?"},
            # Приложение требует обращения к справочному центру перед любым
            # ответом о политике. Добавление требования как системного сообщения
            # оставляет предыдущие ходы без изменений.
            {
                "role": "system",
                "content": "Tool-use requirement for the current turn: the application requires a call to the search_help_center tool in your response to the user's latest message. Begin your response with the search_help_center tool call. Do not reply with text only.",
            },
        ],
    )
    print(response.content)

    Сохраняйте сообщение role: "system" в истории при последующих запросах, как и любой другой ход. Системные сообщения в середине разговора не требуют бета-заголовка. tool_choice: {"type": "none"} по-прежнему работает для хода, на котором инструменты вызывать нельзя.

  2. Блоки мышления сохраняются только для модели, которая их создала, или более новой: Каждый блок thinking записывает, какая модель его создала. Claude Fable 5.1 читает свои собственные блоки, а также блоки от Claude Mythos 5.1, Claude Opus 5, Claude Fable 5, Claude Mythos 5 и более ранних моделей Claude. Разговор, переходящий на claude-fable-5-1 с любой из них, сохраняет свои предыдущие рассуждения. Условие одностороннее: кроме Claude Mythos 5.1, ни одна из этих моделей не может читать блоки Claude Fable 5.1.

    Разговор, который шёл на Claude Fable 5.1, может попасть на более старую модель через переключение маршрутизатора, повторную попытку на стороне клиента или резервный переход при отказе классификатора, включая резервный переход на стороне сервера. API удаляет блоки, которые эта модель не может прочитать, до того как она их увидит, запрос выполняется успешно, и вам не выставляется счёт за отброшенные входные токены. Целевая модель заново планирует без этих рассуждений, что может увеличить стоимость и задержку на первом ходе после переключения. Чтобы увидеть, что было отброшено, отправьте бета-заголовок thinking-binding-controls-2026-08-01: тогда ответы содержат массив input_transformations, в котором каждый отброшенный блок указан с reason: "model_binding_mismatch". См. Сохранённое мышление.

  3. Редактирование более ранних ходов делает блоки мышления недействительными: Каждый блок thinking от Claude Fable 5.1 действителен только относительно подсказки system, tools и истории разговора, которые ему предшествовали. Если вашей историей разговора управляет Claude Code, claude.ai, Claude Managed Agents или Claude Agent SDK, этот префикс уже сохраняется нетронутым. Если ваш код сам строит массив messages, этот пункт относится к вам, а Сохранённое мышление — полное руководство по интеграции. Там, где проверка применяется принудительно, запрос, отправляющий блок обратно после изменения чего-либо из перечисленного, отклоняется с ошибкой 400:

    messages.5.content.0: Invalid `signature` in `thinking` block. The block is bound to a different conversation. Remove the block, or set `thinking.block_binding.prefix_mismatch_behavior` to "drop_block". That setting requires the `thinking-binding-controls-2026-08-01` value in the `anthropic-beta` header.

    API принудительно применяет проверку для новых аккаунтов, созданных 31 августа 2026 года или позже. Для аккаунтов, созданных ранее, API фиксирует несоответствие, но не предпринимает действий, если только запрос не устанавливает thinking.block_binding.prefix_mismatch_behavior, что включает принудительное применение. Anthropic планирует применять проверку для всех аккаунтов на будущих моделях, поэтому сделайте своё приложение совместимым уже сейчас: те же шаблоны поддерживают кэш подсказок в «тёплом» состоянии, и вы можете протестировать проверку с любого аккаунта, отправив prefix_mismatch_behavior. Если вы поставляете инструмент или фреймворк, который люди запускают со своим собственным ключом API, протестируйте таким образом до запуска: ваш ключ, вероятно, принадлежит более старому аккаунту, а ваши пользователи на новых аккаунтах столкнутся с проверкой раньше вас. Чтобы узнать, применяется ли проверка к вашему собственному аккаунту по умолчанию, отправьте запрос, редактирующий историю, без бета-заголовка: ошибка 400, в которой упоминается заголовок, означает, что применяется.

    Ошибка постоянна для данного тела запроса: автоматический цикл повторных попыток её не устранит. Чтобы продолжить без недействительных рассуждений вместо сбоя, удалите блоки thinking из истории и повторите запрос один раз, либо отправьте бета-заголовок thinking-binding-controls-2026-08-01 и установите prefix_mismatch_behavior в значение "drop_block" (по умолчанию "error"). При "drop_block" API отбрасывает несоответствующий блок и каждый блок мышления после него в разговоре и сообщает о каждом с reason: "prefix_binding_mismatch" в массиве input_transformations ответа:

    client = anthropic.Anthropic()
    
    response = client.beta.messages.create(
        model="claude-fable-5-1",
        max_tokens=16000,
        thinking={
            "type": "adaptive",
            "block_binding": {"prefix_mismatch_behavior": "drop_block"},
        },
        messages=[
            {
                "role": "user",
                "content": "What is the greatest common divisor of 1071 and 462?",
            }
        ],
        betas=["thinking-binding-controls-2026-08-01"],
    )
    
    for block in response.content:
        if block.type == "text":
            print(block.text)
    
    print(f"Input transformations: {len(response.input_transformations or [])}")

    Эндпоинт подсчёта токенов выполняет ту же проверку. Форму ответа и размещение при потоковой передаче см. в разделе Элементы управления для несохраняемых блоков (бета).

    Шаблоны, которые делают последующие блоки мышления недействительными, и что делать вместо них:

    • Редактирование, изменение порядка или удаление более ранних ходов. Сюда входит удаление старых результатов инструментов, вырезание ходов из середины транскрипта и компактизация на стороне клиента, которая сохраняет недавние ходы и их блоки мышления дословно за сводкой (включая фоновую компактизацию, которая подставляет свою сводку несколькими ходами позже). Вместо этого используйте серверную компактизацию или редактирование контекста (очистку результатов инструментов для старых результатов инструментов) либо одну из форм клиентской компактизации из раздела Обрезайте контекст на сервере.
    • Внедрение содержимого, которое вы не сохраняете, например напоминания на каждый ход, добавляемого после блоков tool_result и удаляемого при следующем запросе. Вместо этого отправляйте напоминание как системное сообщение с областью действия в один ход и оставляйте его в истории.
    • Пересборка подсказки верхнего уровня system или массива tools между запросами в одном разговоре, например для обновления текущей даты или добавления либо удаления инструмента. Вместо этого добавьте системное сообщение в середине разговора, содержащее новую инструкцию («The current date is 2026-09-14.») или блоки tool_addition и tool_removal.
    • URL изображения или документа, который при последующем запросе отдаёт другие байты. Проверка охватывает байты, а не строку URL, поэтому ротируемый подписанный URL для того же файла допустим. Для содержимого, на которое вы ссылаетесь на протяжении нескольких ходов, загрузите его один раз через Files API и отправляйте file_id, либо отправляйте base64.

    Каждая замена также сохраняет более ранние ходы побайтово идентичными и сохраняет попадания в кэш подсказок, которые были бы потеряны при редактировании истории, подсказки system или массива tools.

    Шаблоны, которые продолжают работать:

    • Истории только с добавлением: добавление ходов и передача более ранних ходов обратно в точности так, как они были отправлены и получены, включая добавленные сообщения role: "system".
    • Удаление блоков мышления из более ранних ходов ассистента, начиная с самых старых.
    • Изменение effort, max_tokens или любого другого параметра запроса вне system, tools и messages, а также добавление или перемещение маркеров cache_control.
    • Серверная компактизация и редактирование контекста, включая очистку блоков мышления. Они не считаются правками, поскольку проверка сравнивает разговор в том виде, в котором вы его отправили.

    Чтобы проверить существующую интеграцию:

    1. Зафиксируйте точные тела запросов, которые она отправляет на протяжении нескольких обычных ходов, включая компактизацию или изменение инструментов, если они есть в вашем продукте. Для каждой пары последовательных запросов сравните подсказку system, массив tools и общий префикс messages. Они должны быть побайтово идентичны вплоть до вновь добавленных ходов.
    2. Проведите обычную многоходовую сессию с claude-fable-5-1 с бета-заголовком thinking-binding-controls-2026-08-01 и prefix_mismatch_behavior: "drop_block" и логируйте input_transformations в каждом ответе. Пустой массив на каждом ходе означает, что история не нарушена. Запись с reason: "prefix_binding_mismatch" означает, что что-то перед блоком по пути path изменилось с предыдущего запроса. Запись с reason: "model_binding_mismatch" означает, что разговор сменил модель, что не является ошибкой в вашем коде. Это работает с любого аккаунта, поскольку установка поля включает принудительное применение для запроса. В CI вместо этого установите "error", чтобы правка приводила к сбою прогона.
    3. Выберите настройку для продакшена. Оставьте значение по умолчанию "error", если несоответствие префикса может означать только ошибку в вашем коде, или установите "drop_block", чтобы отбрасывать затронутые блоки вместо сбоя, и в любом случае отслеживайте ошибки 400 или записи input_transformations.

    Однократное отбрасывание блоков мышления, например на границе компактизации, мало на что влияет. Интеграция, которая делает предыдущее мышление недействительным при каждом запросе, каждый раз перезапускает кэш подсказок, что может увеличить стоимость задачи (см. Ведите историю разговора только с добавлением).

Изменения в поведении

  1. Меньше параллельных вызовов инструментов в длинных агентных циклах: В длительных циклах, где следующие независимые операции чтения лишь подразумеваются задачей (пользовательские агенты для программирования, обвязки bash-и-редактор, использование компьютера), Claude Fable 5.1 может выполнять один вызов инструмента за ход. Каждый дополнительный ход стоит токенов, сетевого обмена и реального времени. Добавляйте инструкцию о пакетной обработке из одного предложения после каждого сообщения пользователя как системное сообщение с областью действия в один ход (clear_at: "next_user_message", бета) или, без беты, в текстовом блоке после блоков tool_result, и оставляйте более ранние копии в истории при последующих запросах. См. Объединяйте независимые вызовы инструментов в агентных циклах.

  2. Меньше сообщений о прогрессе между вызовами инструментов: Claude Fable 5.1 пишет меньше обновлений статуса во время длинных последовательностей инструментов, чем Claude Fable 5, а её сводки по агентному программированию короче. Если ваш интерфейс отображает эти обновления, установите thinking.display в значение "updates" (бета) или "summarized" и явно запрашивайте их в подсказке. См. Обновления прогресса между вызовами инструментов и Запрашивайте обновления прогресса для пользователя.

  3. Меньше вызовов поиска и извлечения при низком уровне усилий: При уровне усилий low Claude Fable 5.1 чаще, чем Claude Fable 5, отвечает по памяти вместо вызова инструмента поиска или извлечения. Если ваш продукт полагается на извлечение при низком уровне усилий, повысьте уровень усилий для этих запросов или укажите модели, когда искать. См. Запуск поиска при низком уровне усилий.

О различиях в плотности прозы, форматировании чата, цитировании в сводках и правках файлов, которые не влияют на интеграцию с API, см. Изменения по сравнению с Claude Fable 5.

Эти изменения не обязательны, но каждое из них снижает стоимость или задержку либо устраняет один из режимов сбоя:

  1. Изменяйте уровень усилий в середине разговора (бета): На Claude Fable 5 output_config.effort задаётся на уровне запроса, и его изменение между запросами сбрасывает кэшированные префиксы более ранних ходов. На claude-fable-5-1 сообщение role: "system", содержащее только output_config, повышает уровень усилий для сложного шага или понижает для рутинных, не делая недействительным кэш подсказок:

    client = anthropic.Anthropic()
    
    response = client.beta.messages.create(
        model="claude-fable-5-1",
        max_tokens=4096,
        output_config={"effort": "high"},
        messages=[
            {
                "role": "user",
                "content": "Plan a migration from SQLite to PostgreSQL in three short steps.",
            },
            {
                "role": "assistant",
                "content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.",
            },
            # Системное сообщение только с effort: новый уровень вступает в силу со следующего хода пользователя.
            {"role": "system", "content": [], "output_config": {"effort": "low"}},
            {"role": "user", "content": "Summarize the plan in one sentence."},
        ],
        betas=["mid-conversation-output-config-2026-07-01"],
    )
    
    for block in response.content:
        if block.type == "text":
            print(block.text)

    Значение применяется к следующему ходу пользователя и каждому последующему ходу, пока другое сообщение role: "system" его не изменит. Принимаются только именованные уровни (low, medium, high, xhigh, max), и требуется бета-заголовок mid-conversation-output-config-2026-07-01. См. Уровень усилий для отдельного сообщения.

  2. Изменяйте инструкции и инструменты с помощью системных сообщений в середине разговора: Чтобы изменить инструкции или инструменты в ходе сессии, добавьте сообщение role: "system" с блоками tool_addition и tool_removal для изменения инструментов (бета-заголовок mid-conversation-tool-changes-2026-07-01, при этом полный набор инструментов объявляется в tools в начале сессии). Это сохраняет попадания в кэш подсказок на более ранних ходах и поддерживает историю разговора только с добавлением. То же сообщение заменяет принудительный tool_choice, когда на текущем ходе должен быть запущен конкретный инструмент (см. Критические изменения). Для напоминания, которое относится только к одному ходу, отправьте его как отдельное текстовое сообщение role: "system" с clear_at: "next_user_message" (системные сообщения с областью действия в один ход, бета-заголовок mid-conversation-system-clear-at-2026-08-21) и оставьте его в истории: оно перестаёт отображаться после следующего сообщения пользователя и не стоит токенов после очистки. Сообщение, содержащее блоки tool_addition или tool_removal, не может иметь область действия в один ход.

  3. Используйте fallbacks: "default" для отказов: Продолжайте обрабатывать stop_reason: "refusal" и читать stop_details.category перед содержимым ответа. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, установите fallbacks: "default" (бета, заголовок server-side-fallback-2026-07-01). "default" повторяет отклонённый запрос на модели, которую Anthropic рекомендует для данной категории. Допустимые резервные цели для Claude Fable 5.1 — Claude Opus 4.8 (claude-opus-4-8) и Claude Opus 5 (claude-opus-5). Явный список fallbacks может указывать любую из них. Резервная модель не получает блоки мышления Claude Fable 5.1. Если вы реализуете повторную попытку самостоятельно, резервный кредит применяется на тех же условиях, что и для Claude Fable 5. См. Отказы и резервные модели.

  4. Начинайте с уровня усилий high и проводите перебор: Значение параметра effort по умолчанию — high, и поддерживаются все пять уровней. Придерживайтесь рекомендаций для Claude Fable 5: high для большинства задач и medium как средство контроля затрат, которое стоит протестировать. Преимущества Claude Fable 5.1 над Claude Fable 5 наиболее велики на уровнях xhigh и max, но эти уровни также увеличивают время мышления и время до первого ответа, поэтому переходите на них для задач, наиболее чувствительных к возможностям модели, и там, где ваши оценки показывают выигрыш. Проведите новый перебор на собственных оценках, а не переносите настройку, подобранную для Claude Fable 5. См. Рекомендуемые уровни усилий для Claude Fable 5.1.

  5. Обрезайте контекст на сервере или компактизируйте в форме, не несущей устаревшего мышления: Если ваш код усекает или суммирует более старые ходы на клиенте, самое простое решение — перенести эту работу на серверную компактизацию или редактирование контекста. Ни то, ни другое не считается правкой, поскольку проверка истории сравнивает разговор в том виде, в котором вы его отправили, так что ничто из удаляемого ими не делает последующие блоки мышления недействительными, а параметр instructions компактизации принимает вашу собственную подсказку для суммирования. Если вы оставляете компактизацию на клиенте, выберите одну из трёх форм:

    • Простая компактизация (рекомендуется): замените всю историю одним сообщением-сводкой плюс новым ходом пользователя и больше ничего не воспроизводите. Блоки мышления не переносятся, поэтому ничто не даёт сбоя. Модели Claude обучены на долгосрочных задачах с этой схемой, и для большинства рабочих нагрузок она работает сопоставимо с более сложными.
    • Компактизация с сохранением хвоста: если вы сохраняете самые последние ходы дословно за сводкой, удалите блоки thinking и redacted_thinking из этих ходов (текст и вызовы инструментов могут остаться) или установите prefix_mismatch_behavior: "drop_block". Их мышление было создано относительно полной истории и в противном случае даёт сбой за сводкой.
    • Фоновая компактизация: если вы строите сводку вне критического пути и подставляете её позже, каждый ход, созданный за это время, несёт мышление, предшествующее подстановке. Отправляйте "drop_block" в каждом запросе, который всё ещё содержит блоки мышления, созданные до подстановки (или удаляйте эти блоки сами; input_transformations в первом ответе после подстановки перечисляет, какие именно), либо компактизируйте синхронно.

    Не вырезайте отдельные ходы из середины транскрипта: это делает недействительным каждый последующий блок мышления, и никакая клиентская форма этого не избегает. Используйте системное сообщение в середине разговора для изменения инструкции, которое вы вносили, или серверное редактирование контекста для выборочного удаления. См. Передача блоков компактизации обратно.

Контрольный список миграции

  • Обновите имя модели с claude-fable-5 на claude-fable-5-1 (или с claude-mythos-5 на claude-mythos-5-1).
  • Замените принудительный tool_choice ({type: "any"} или {type: "tool", ...}). Он возвращает ошибку 400. Используйте {type: "auto"} вместе с явной инструкцией и инструментами со strict: true либо выходные данные в формате JSON. Поместите инструкцию в ход user или в сообщение role: "system" в середине разговора, если ваше приложение требует этого вызова.
  • Продолжайте передавать блоки thinking обратно без изменений на каждом ходе, включая пустые. Claude Fable 5.1 читает блоки от Claude Opus 5, Claude Fable 5, Claude Mythos 5 и более ранних моделей. При переносе разговора с Claude Fable 5.1 на более раннюю модель её блоки отбрасываются (Claude Mythos 5.1 их читает).
  • Если ваш код сам формирует массив messages, проверьте, не редактирует ли он более ранние ходы: запустите сессию с бета-заголовком thinking-binding-controls-2026-08-01 и prefix_mismatch_behavior: "drop_block", логируйте input_transformations и исправьте каждый prefix_binding_mismatch. Записи model_binding_mismatch после переключения модели ожидаемы.
  • Сохраняйте историю разговора только с добавлением в конец: зафиксируйте system и tools в начале сессии и перенесите изменения в середине сессии в сообщения role: "system" и блоки tool_addition / tool_removal, отправляйте напоминания для каждого хода как системные сообщения с областью действия хода, которые вы никогда не удаляете, обрезайте контекст на стороне сервера или удаляйте блоки мышления из любых ходов, которые вы переносите через сводку на стороне клиента, и ссылайтесь на файлы, используемые в нескольких ходах, по file_id.
  • Выберите prefix_mismatch_behavior для продакшена ("error" по умолчанию или "drop_block") и отслеживайте его. Если вы поддерживаете инструмент, который другие запускают со своим собственным ключом API, протестируйте с установленным полем: для новых аккаунтов проверка применяется по умолчанию, даже если для вашего — нет.
  • Проверьте циклы агентов на поведение «один вызов инструмента за ход» и добавьте инструкцию по пакетной обработке.
  • Если ваш интерфейс отображает текст о ходе выполнения между вызовами инструментов, установите thinking.display в "updates" (бета) или "summarized" и запрашивайте обновления в подсказке.
  • Если вы меняете effort между запросами, перенесите изменение в сообщение role: "system" с effort для отдельного сообщения (бета), чтобы сохранить попадания в кэш.
  • Обрабатывайте stop_reason: "refusal" и читайте stop_details.category. Рассмотрите fallbacks: "default" (бета).
  • Заново оцените effort с помощью нового перебора значений, начиная с high, и заново определите базовые показатели стоимости и задержки на ваших собственных рабочих нагрузках. Количество токенов примерно не изменилось. Чтение из кэша подсказок стоит четверть от тарифа Claude Fable 5.

Миграция на Claude Fable 5.1 с Claude Opus 5

Claude Fable 5.1 использует те же паттерны Messages API и использования инструментов, что и Claude Opus 5. Он сохраняет контекстное окно в 1M токенов по умолчанию, 128k максимальных выходных токенов, минимум в 512 токенов для кэширования подсказок и поддержку системных сообщений в середине разговора. Ограничение на предзаполнение, ограничение на параметры сэмплирования и значение по умолчанию "omitted" для thinking.display также переносятся. Примените всё из раздела Миграция на Claude Fable 5.1 с Claude Fable 5, а также следующее.

Обновите имя модели

model = "claude-opus-5"  # Before
model = "claude-fable-5-1"  # After

# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5-1"  # After

Что изменилось

  1. Мышление больше нельзя отключить: Claude Opus 5 принимает thinking: {type: "disabled"} на уровне effort high или ниже. На claude-fable-5-1 и claude-mythos-5-1 адаптивное мышление всегда включено, и thinking: {type: "disabled"} возвращает ошибку 400 на любом уровне effort. Удалите это поле, управляйте расходом токенов с помощью более низких уровней effort и пересмотрите max_tokens для рабочих нагрузок, которые выполнялись с отключённым мышлением.

  2. Принудительный выбор инструмента не поддерживается: Claude Opus 5 принимает tool_choice any и tool. claude-fable-5-1 возвращает ошибку 400. См. Критические изменения.

  3. Сохранённое мышление между моделями: Claude Fable 5.1 читает блоки мышления Claude Opus 5: разговоры, переходящие с claude-opus-5 на claude-fable-5-1, сохраняют свои рассуждения. Claude Opus 5 не может читать блоки Claude Fable 5.1. Блоки Claude Fable 5.1 также перестают быть действительными при изменении более ранних ходов: если ваш код редактирует более ранние сообщения, пересобирает system или tools либо выполняет сжатие на клиенте между запросами, Claude Opus 5 не возражал, но claude-fable-5-1 отклоняет или отбрасывает каждый последующий блок мышления. Выполните трёхшаговую проверку из того раздела перед переключением трафика. См. Критические изменения.

  4. Текст между вызовами инструментов возвращается в блоках мышления: На Claude Opus 5 текст, который модель пишет между вызовами инструментов, возвращается в виде блоков text. На claude-fable-5-1, как и на Claude Fable 5, это повествование возвращается в виде блоков thinking с обновлениями о ходе выполнения, по одному перед каждым вызовом инструмента. При значении thinking.display по умолчанию "omitted" они не содержат читаемого текста. Если ваш интерфейс отображает это повествование, установите display: "updates" (бета), чтобы получать обновления о ходе выполнения в виде текста, пока рассуждения остаются скрытыми, или "summarized", чтобы получать и то, и другое. Затем отображайте непустые блоки thinking между блоками tool_use. См. Обновления о ходе выполнения между вызовами инструментов.

  5. Классификаторы безопасности и резервная маршрутизация: Claude Fable 5.1 использует классификаторы безопасности, охватывающие те же категории stop_details, что и Claude Fable 5, — более широкий набор, чем классификаторы Claude Opus 5, ограниченные только кибербезопасностью. Ожидайте значения stop_details.category помимо "cyber", такие как "bio" и "reasoning_extraction"; полный набор см. в таблице категорий отказов. О конфигурации fallbacks и разрешённых целевых моделях см. Используйте fallbacks: "default" для отказов.

  6. Цены: $10 USD за миллион входных токенов и $50 USD за миллион выходных токенов по сравнению с $5 USD и $25 USD для Claude Opus 5. Чтение из кэша подсказок стоит $0,25 USD за миллион токенов — половина тарифа Claude Opus 5. См. Цены на Claude.

  7. Хранение данных: Claude Fable 5.1 и Claude Mythos 5.1 требуют 30-дневного хранения данных, недоступны в рамках соглашений о нулевом хранении данных (ZDR), если это явно не разрешено Anthropic, и обозначены как Covered Models. Claude Opus 5 доступен в рамках ZDR. См. Требования к хранению данных для конкретных моделей.

Контрольный список миграции

  • Если у вашей организации есть соглашение о нулевом хранении данных (ZDR), сначала подтвердите право на использование: эти модели недоступны в рамках ZDR, если это явно не разрешено Anthropic. См. Требования к хранению данных для конкретных моделей.
  • Обновите имя модели с claude-opus-5 на claude-fable-5-1 (или claude-mythos-5-1).
  • Удалите любую конфигурацию thinking: {type: "disabled"}: она возвращает ошибку 400 на claude-fable-5-1. Управляйте расходом токенов с помощью более низких уровней effort и пересмотрите max_tokens.
  • Замените принудительный tool_choice (any или tool) на auto вместе с явной инструкцией (ход user или системное сообщение в середине разговора) и инструментами со strict: true либо на выходные данные в формате JSON.
  • Если ваш интерфейс отображает текст между вызовами инструментов, установите display: "updates" (бета) или "summarized" и отображайте непустые блоки thinking.
  • Примените пункты о сохранённом мышлении, редактировании истории, поведении, effort и резервных вариантах из контрольного списка Claude Fable 5.
  • Заново определите базовые показатели стоимости на ваших собственных рабочих нагрузках. Количество токенов примерно не изменилось. Цена за токен отличается.

Миграция на Claude Fable 5.1 с Claude Opus 4.8 или более ранних версий

Сначала примените раздел Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Opus 4.8 для изменений на уровне API относительно Claude Opus 4.8. Он охватывает адаптивное мышление, вывод мышления, отказы, effort, минимум для кэширования, цены и хранение данных. Затем примените оставшуюся разницу из раздела Миграция на Claude Fable 5.1 с Claude Fable 5. На Claude Opus 4.7 или более ранних версиях начните с соответствующего раздела Миграция на Claude Opus 5.

Обновите имя модели

model = "claude-opus-4-8"  # Before
model = "claude-fable-5-1"  # After

# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5-1"  # After

Контрольный список миграции

  • Если у вашей организации есть соглашение о нулевом хранении данных (ZDR), сначала подтвердите право на использование: эти модели недоступны в рамках ZDR, если это явно не разрешено Anthropic. Claude Opus 4.8 доступен в рамках ZDR.
  • Обновите имя модели с claude-opus-4-8 на claude-fable-5-1 (или claude-mythos-5-1).
  • Удалите любую конфигурацию thinking: {type: "disabled"} и пересмотрите max_tokens. Запросы без поля thinking выполняются с адаптивным мышлением.
  • Замените принудительный tool_choice (any или tool) на auto вместе с явной инструкцией (ход user или системное сообщение в середине разговора) и инструментами со strict: true либо на выходные данные в формате JSON.
  • Передавайте блоки thinking обратно без изменений и рассматривайте их текст как предназначенный только для отображения. Claude Fable 5.1 читает блоки мышления Claude Opus 4.8: разговор, который переходит на claude-fable-5-1, сохраняет свои более ранние рассуждения. Claude Opus 4.8 не может читать блоки Claude Fable 5.1.
  • Если ваш код сам формирует массив messages, проверьте, не редактирует ли он более ранние ходы. Интеграции, написанные для Claude Opus 4.8 и более ранних версий, часто обрезают старые ходы, удаляют или пересобирают более ранние сообщения либо обновляют подсказку system при каждом запросе, и Claude Opus 4.8 никогда не возражал. На claude-fable-5-1 каждое из этих действий делает недействительными последующие блоки мышления.
  • Обрабатывайте stop_reason: "refusal", читайте stop_details.category и рассмотрите fallbacks: "default" (бета).
  • Примените пункты о сохранённом мышлении, редактировании истории, поведении, effort для отдельного сообщения и обновлениях о ходе выполнения из контрольного списка Claude Fable 5.
  • Заново оцените effort (начните с high), проверьте подсказки, близкие к минимуму в 512 токенов для кэширования, и заново определите базовые показатели стоимости и задержки. Цена за токен отличается.

Миграция на Claude Mythos 5.1 с Claude Mythos 5

Claude Mythos 5.1 — это аналог Claude Fable 5.1 с ограниченным доступом. Подтвердите доступ вашей организации у вашей команды по работе с клиентами Anthropic перед переключением идентификаторов моделей.

Разница на уровне API совпадает с разделом Миграция на Claude Fable 5.1 с Claude Fable 5: принудительный выбор инструмента возвращает ошибку 400, а блоки мышления сохраняются только для модели, которая их создала, или более новой (Claude Mythos 5.1 читает блоки Claude Mythos 5, но не наоборот). В отличие от Claude Fable 5.1, Claude Mythos 5.1 не выполняет проверку разговора, поэтому редактирование более ранних ходов не делает блоки мышления недействительными, хотя по-прежнему сбрасывает кэш подсказок.

Обновите имя модели

model = "claude-mythos-5"  # Before
model = "claude-mythos-5-1"  # After

Контрольный список миграции

  • Обновите имя модели с claude-mythos-5 на claude-mythos-5-1.
  • Замените принудительный tool_choice (any или tool) на auto вместе с явной инструкцией (ход user или системное сообщение в середине разговора) и инструментами со strict: true либо на выходные данные в формате JSON.
  • Обрабатывайте stop_reason: "refusal" и читайте stop_details.category перед содержимым ответа. См. Отказы и резервные варианты.
  • Продолжайте передавать блоки thinking обратно без изменений на каждом ходе, включая пустые.
  • Если ваш код сам формирует массив messages, сохраняйте историю разговора только с добавлением в конец, чтобы кэш подсказок оставался прогретым. Claude Mythos 5.1 не выполняет проверку разговора, поэтому правки не делают его блоки мышления недействительными.
  • Примените изменения поведения и рекомендуемые изменения из раздела о Claude Fable 5, за исключением пунктов о редактировании истории, которые не применяются к Claude Mythos 5.1.
  • Заново оцените effort с помощью нового перебора значений и заново определите базовые показатели стоимости и задержки. Чтение из кэша подсказок стоит четверть от тарифа Claude Mythos 5.

Was this page helpful?