Claude Platform Docs
Documentation

Миграция на Claude Mythos 5 и Claude Fable 5

Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Mythos Preview, Claude Opus 5 или Claude Opus 4.8: идентификаторы моделей, изменения API и контрольные списки миграции.

Claude Fable 5 создана для сложных рассуждений и долгосрочной агентной работы. Claude Fable 5.1 развивает её возможности. Claude Fable 5 доступна в Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry. Claude Mythos 5 обладает теми же возможностями и предлагается только одобренным клиентам в рамках Project Glasswing.

Базовые настройки, общие для claude-fable-5 и claude-mythos-5:

  • Мышление: Адаптивное мышление (adaptive thinking) всегда включено. Модель сама определяет, когда и сколько думать над каждым запросом, и никакая конфигурация thinking не требуется. Как thinking: {type: "disabled"}, так и ручное «extended thinking» (расширенное мышление) (thinking: {type: "enabled", budget_tokens: N}) возвращают ошибку 400.
  • Предзаполнение: Предзаполнение (prefill) сообщения ассистента возвращает ошибку 400. Вместо этого используйте инструкции в «system prompt» (системной подсказке).
  • Контекстное окно и вывод: Контекстное окно в 1M токенов («context window») по умолчанию и до 128k выходных токенов на запрос.
  • Цены: $10 за миллион входных токенов и $50 за миллион выходных токенов. См. Цены на Claude.
  • Хранение данных: Обе модели требуют 30-дневного хранения данных и недоступны в рамках соглашений о нулевом хранении данных («zero data retention», или ZDR), если это прямо не разрешено Anthropic. Обе модели обозначены как Covered Models. В Claude API запрос к Claude Fable 5 от организации, чья конфигурация хранения данных не соответствует этому требованию, возвращает ошибку 400 invalid_request_error. Организациям с соглашением ZDR следует связаться со своей командой по работе с клиентами Anthropic, чтобы обсудить конфигурацию хранения данных, или настроить хранение данных для каждого рабочего пространства отдельно. Подробности по платформам см. в разделе Требования к хранению данных для конкретных моделей.

В чём две модели различаются:

  • Доступность: Claude Fable 5 не требует одобрения доступа. Claude Mythos 5 доступна только одобренным клиентам в рамках Project Glasswing.
  • Классификаторы безопасности: Claude Fable 5 использует классификаторы безопасности, которые могут отклонять запросы с stop_reason: "refusal". Claude Mythos 5 не включает эти классификаторы. См. Отказы и резервные модели.
  • Priority Tier: Priority Tier поддерживается на Claude Fable 5, но не на Claude Mythos 5.

Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Mythos Preview

Claude Mythos 5 — преемник с ограниченным доступом для Claude Mythos Preview, исследовательской предварительной версии, доступной только по приглашению. Claude Fable 5 предлагает те же возможности и не требует одобрения доступа. Изменения в этом разделе в равной степени применимы к обеим целевым моделям.

Миграция в основном сводится к простой замене. Claude Mythos 5 и Claude Fable 5 используют тот же Messages API и те же паттерны использования инструментов («tool use»), что и Claude Mythos Preview, а количество токенов практически не меняется, поскольку все три модели используют один и тот же токенизатор. Ключевые изменения, которые нужно проверить, — это функции, которые больше недоступны (перечислены в следующем разделе), и вывод мышления. Если вы мигрируете на Claude Fable 5, также учтите отказы классификаторов безопасности, которых нет у Claude Mythos Preview и Claude Mythos 5; см. Отказы и резервные модели.

График вывода Claude Mythos Preview из эксплуатации см. в разделе Устаревание моделей.

Обновите название модели

model = "claude-mythos-preview"  # Before
model = "claude-mythos-5"  # After

# Или для модели с теми же возможностями, но без требования одобрения доступа:
model = "claude-fable-5"  # After

Функции, недоступные на Claude Mythos 5 и Claude Fable 5

  1. Расширенное мышление и бюджеты токенов мышления: Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается на claude-mythos-5 и claude-fable-5 и возвращает ошибку 400. Адаптивное мышление всегда включено: модель сама определяет, когда и сколько думать над каждым запросом, и никакая конфигурация thinking не требуется. thinking: {type: "disabled"} возвращает ошибку. У budget_tokens нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.

    До (Claude Mythos Preview):

    client.messages.create(
        model="claude-mythos-preview",
        max_tokens=16000,
        thinking={"type": "enabled", "budget_tokens": 10000},
        messages=[{"role": "user", "content": "..."}],
    )

    После (Claude Mythos 5):

    client.messages.create(
        model="claude-mythos-5",
        max_tokens=16000,
        messages=[{"role": "user", "content": "..."}],
    )

    Изменение для Claude Fable 5 идентично, с claude-fable-5 в качестве названия модели.

  2. Предзаполнение ассистента: Предзаполнение сообщения ассистента не поддерживается на claude-mythos-5 и claude-fable-5 и возвращает ошибку 400, так же как на Claude Mythos Preview. Вместо этого используйте инструкции в системной подсказке.

  3. Вывод мышления: На claude-mythos-5 и claude-fable-5 исходная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый обобщённый текст, когда thinking.display установлен в summarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления на моделях Claude Fable и Claude Mythos.

Подсчёт токенов и тарификация

claude-mythos-5 и claude-fable-5 используют тот же токенизатор, что и claude-mythos-preview (токенизатор, представленный вместе с Claude Opus 4.7). Количество токенов практически не меняется при миграции с claude-mythos-preview. По сравнению с моделями до Claude Opus 4.7 тот же контент может токенизироваться примерно в на 30% большее количество токенов, в зависимости от контента и характера рабочей нагрузки.

/v1/messages/count_tokens возвращает практически неизменные значения для claude-mythos-5 и claude-fable-5 по сравнению с claude-mythos-preview. Заново определите базовые показатели стоимости и задержки на ваших собственных рабочих нагрузках.

Контрольный список миграции

  • Измените название модели с claude-mythos-preview на claude-mythos-5 или на claude-fable-5, которая предлагает те же возможности и не требует одобрения доступа.
  • Удалите конфигурацию ручного расширенного мышления (thinking: {type: "enabled", budget_tokens: N}). Адаптивное мышление всегда включено, и поле thinking не требуется.
  • Удалите любую конфигурацию thinking: {type: "disabled"}. Отключение мышления возвращает ошибку в claude-mythos-5 и claude-fable-5.
  • Удалите budget_tokens. У этого параметра нет прямой замены: мышление является адаптивным, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.
  • Убедитесь, что любой код, разбирающий поле thinking, рассматривает его только как текст для отображения и передаёт блоки мышления обратно без изменений при продолжении работы на той же модели. По умолчанию thinking.display имеет значение "omitted" в claude-mythos-5 и claude-fable-5, так же как в Claude Mythos Preview. Установите display: "summarized", чтобы получать читаемые сводки. См. Вывод мышления в моделях Claude Fable и Claude Mythos.
  • Если вы воспроизводите историю разговора на более ранней модели, сначала удалите блоки thinking и redacted_thinking из предыдущих ходов ассистента. Блоки мышления от claude-fable-5 и claude-mythos-5 может прочитать только модель, которая их создала, или более новая модель: более ранние модели молча их игнорируют, тогда как Claude Fable 5.1 и Claude Mythos 5.1 их читают, поэтому сохраняйте их при переводе разговора на эти модели (см. Переключение моделей посреди разговора). Удаление блоков делает запросы к более ранним моделям минимальными и единообразными.
  • Если вы переходите на Claude Fable 5, обрабатывайте stop_reason: "refusal" и считывайте поле stop_details.category. Claude Fable 5 использует классификаторы безопасности, которых нет у Claude Mythos Preview и Claude Mythos 5. См. Отказы и резервные модели.
  • Заново определите базовые показатели количества токенов и затрат на собственных рабочих нагрузках. При миграции с claude-mythos-preview количество токенов остаётся примерно неизменным.

Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Opus 5

Claude Fable 5 и Claude Mythos 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Opus 5, с тем же контекстным окном в 1M токенов по умолчанию и тем же максимумом в 128k выходных токенов. Ограничения на предзаполнение и параметры сэмплирования, а также поведение отображения мышления переносятся с Claude Opus 5 без изменений. Изменения, которые нужно проверить, — это всегда включённое мышление, цены, Priority Tier и хранение данных.

Обновите название модели

model = "claude-opus-5"  # Before
model = "claude-fable-5"  # After

# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5"  # After

Что изменилось

  1. Мышление больше нельзя отключить: На Claude Opus 5 мышление включено по умолчанию и может быть отключено с помощью thinking: {type: "disabled"} при уровне effort high или ниже. На claude-fable-5 и claude-mythos-5 адаптивное мышление всегда включено, и thinking: {type: "disabled"} возвращает ошибку 400 при любом уровне effort. Удалите конфигурацию thinking: {type: "disabled"} и вместо этого используйте более низкие уровни effort для управления расходом токенов.

    Если ваши запросы к Claude Opus 5 отключали мышление, форма ответа меняется: ответ может начинаться с одного или нескольких блоков thinking перед первым блоком text, возвращаемых с пустым полем thinking при значении по умолчанию display: "omitted" (то же значение по умолчанию, что и у Claude Opus 5). Код, который читает ответ по позиции, например content[0].text, или обработчик потока, который рассматривает первый блок контента как текст, должен вместо этого выбирать блоки контента по их полю type, а циклы использования инструментов должны передавать блоки thinking обратно полностью и без изменений вместе с результатами инструментов. API отклоняет отредактированные, переупорядоченные или частично удалённые блоки мышления с ошибкой 400 (см. Сохранение блоков мышления). Токены мышления тарифицируются как выходные токены, даже когда текст мышления не возвращается.

  2. Цены: Claude Fable 5 и Claude Mythos 5 стоят $10 за миллион входных токенов и $50 за миллион выходных токенов по сравнению с $5 и $25 для Claude Opus 5. См. Цены на Claude.

  3. Priority Tier: Priority Tier не поддерживается на Claude Opus 5, поэтому существующий трафик не затрагивается. Если у вашей организации есть обязательство по Priority Tier, Claude Fable 5 его поддерживает; Claude Mythos 5 — нет.

  4. Хранение данных: Claude Fable 5 и Claude Mythos 5 требуют 30-дневного хранения данных и недоступны в рамках соглашений о нулевом хранении данных (ZDR), если это прямо не разрешено Anthropic. Обе модели обозначены как Covered Models. См. Требования к хранению данных для конкретных моделей.

Контрольный список миграции

  • Обновите название модели с claude-opus-5 на claude-fable-5 (или claude-mythos-5).
  • Удалите любую конфигурацию thinking: {type: "disabled"}; она возвращает ошибку 400 на claude-fable-5 и claude-mythos-5. Вместо этого используйте более низкие уровни effort для управления расходом токенов и пересмотрите max_tokens для рабочих нагрузок, которые выполнялись с отключённым мышлением на Claude Opus 5.
  • Если эти рабочие нагрузки читают контент по позиции, например content[0].text, обновите их, чтобы выбирать блоки контента по type: блоки thinking теперь приходят перед блоками text. Передавайте блоки thinking обратно полностью и без изменений в циклах использования инструментов; изменённые блоки возвращают ошибку 400.
  • Если у вашей организации есть соглашение о нулевом хранении данных (ZDR), подтвердите право на использование перед миграцией: эти модели недоступны в рамках ZDR, если это прямо не разрешено Anthropic. См. Требования к хранению данных для конкретных моделей.
  • Заново определите базовые показатели стоимости на ваших собственных рабочих нагрузках. Количество токенов практически не меняется; цена за токен отличается, а рабочие нагрузки, которые выполнялись с отключённым мышлением, теперь производят токены мышления, которые тарифицируются как выходные токены.

Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Opus 4.8

Миграция в основном сводится к простой замене. Claude Fable 5 и Claude Mythos 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Opus 4.8, с тем же контекстным окном в 1M токенов по умолчанию и тем же максимумом в 128k выходных токенов. Количество токенов практически не меняется, поскольку модели используют один и тот же токенизатор. Ключевые изменения, которые нужно проверить, — это всегда включённое адаптивное мышление, вывод мышления, отказы классификаторов безопасности (только Claude Fable 5) и цены.

Обновите название модели

model = "claude-opus-4-8"  # Before
model = "claude-fable-5"  # After

# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5"  # After

Что изменилось

Пункты в этом разделе описывают различия в API и поведении, которые стоит проверить после замены идентификатора модели. За исключением отмеченных случаев, они в равной степени применимы к claude-fable-5 и claude-mythos-5.

  1. Адаптивное мышление всегда включено: Адаптивное мышление — единственный режим мышления на claude-fable-5 и claude-mythos-5. Модель сама определяет, когда и сколько думать над каждым запросом, и никакая конфигурация thinking не требуется. thinking: {type: "disabled"} возвращает ошибку. Используйте параметр effort для управления глубиной мышления.

    Изменение поведения, которое нужно проверить: на Claude Opus 4.8 запросы без поля thinking выполняются без мышления; на claude-fable-5 и claude-mythos-5 те же запросы выполняются с адаптивным мышлением. max_tokens остаётся жёстким ограничением на общий вывод — мышление плюс текст ответа, — поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления на Claude Opus 4.8. См. Контроль затрат. Ответы также могут начинаться с одного или нескольких блоков thinking перед первым блоком text, поэтому код, который читает ответ по позиции (например, content[0].text или обработчик потока, который рассматривает первый блок контента как текст), должен вместо этого выбирать блоки контента по их полю type. Токены мышления тарифицируются как выходные токены, даже когда текст мышления вам не возвращается, поэтому рабочая нагрузка, которая выполнялась без мышления на Claude Opus 4.8, производит больше выходных токенов на запрос в дополнение к разнице в цене за токен.

    Если вы запускаете цикл использования инструментов, передавайте блоки thinking из каждого ответа ассистента обратно в API полностью и без изменений при возврате результатов инструментов, включая блоки, у которых поле thinking пустое. Возвращайте сообщение ассистента в том виде, в котором оно получено, а не фильтруйте его блоки контента по типу и не пересобирайте его: API отклоняет отредактированные, переупорядоченные или частично удалённые блоки мышления с ошибкой 400. См. Сохранение блоков мышления.

    До (Claude Opus 4.8):

    client.messages.create(
        model="claude-opus-4-8",
        max_tokens=16000,
        thinking={"type": "adaptive"},
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    После (Claude Fable 5):

    client.messages.create(
        model="claude-fable-5",
        max_tokens=16000,
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    Изменение для Claude Mythos 5 идентично, с claude-mythos-5 в качестве названия модели.

  2. Расширенное мышление и бюджеты мышления (без изменений): Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается на claude-fable-5 и claude-mythos-5 и возвращает ошибку 400, так же как на Claude Opus 4.8. У budget_tokens нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.

  3. Предзаполнение ассистента (без изменений): Предзаполнение сообщения ассистента не поддерживается на claude-fable-5 и claude-mythos-5 и возвращает ошибку 400, так же как на Claude Opus 4.8. Вместо этого используйте инструкции в системной подсказке.

  4. Вывод мышления: На claude-fable-5 и claude-mythos-5 исходная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый обобщённый текст, когда thinking.display установлен в summarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления на моделях Claude Fable и Claude Mythos.

  5. Классификаторы безопасности и причина остановки refusal (только Claude Fable 5): claude-fable-5 запускает классификаторы безопасности для запросов и во время генерации ответа. Claude Mythos 5 не включает эти классификаторы. Когда классификатор отклоняет запрос, Messages API возвращает stop_reason: "refusal" как успешный ответ HTTP 200, а не ошибку. Поле stop_details.category сообщает, какой классификатор сработал, с такими категориями, как "cyber", "bio" и "reasoning_extraction", или null, когда отказ не соответствует ни одной именованной категории. Полный набор см. в таблице категорий отказов.

    С вас не взимается плата за входные токены запроса, отклонённого до генерации какого-либо вывода. Когда классификатор срабатывает в середине потока, входные данные и уже переданные выходные данные тарифицируются; отбросьте частичный вывод.

    Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, передайте опциональный параметр fallbacks, который находится в бета-версии в Claude API. Параметр недоступен в Message Batches API, а также на Amazon Bedrock, Google Cloud и Microsoft Foundry; на этих трёх платформах выполняйте повтор на стороне клиента или используйте промежуточное ПО SDK для резервной обработки отказов. См. Отказы и резервные модели.

  6. Начинайте с effort high: Значение по умолчанию параметра effort остаётся high. На Claude Opus 4.8 для программирования и работы с высокой автономностью рекомендуется явно устанавливать xhigh. На claude-fable-5 и claude-mythos-5 используйте high по умолчанию для большинства задач и оставляйте xhigh для рабочих нагрузок, наиболее чувствительных к возможностям модели. Более низкие настройки effort по-прежнему работают хорошо и часто превосходят производительность xhigh на предыдущих моделях. Снижайте effort, если задача выполняется, но занимает больше времени, чем необходимо. См. Составление подсказок для Claude Fable 5.

  7. Сниженный минимум для кэширования подсказок: Минимальная длина кэшируемой подсказки на claude-fable-5 и claude-mythos-5 составляет 512 токенов, что ниже 1 024 токенов на Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования на Claude Opus 4.8, теперь могут создавать записи кэша без каких-либо изменений кода. Минимумы для каждой модели см. в разделе Кэширование подсказок («prompt caching»).

Контрольный список миграции

  • Если у вашей организации есть соглашение о нулевом хранении данных (ZDR), подтвердите соответствие требованиям перед миграцией. claude-fable-5 и claude-mythos-5 требуют хранения данных в течение 30 дней и недоступны в рамках ZDR, если это прямо не разрешено Anthropic. В Claude API запросы к claude-fable-5, не соответствующие этому требованию, возвращают ошибку 400 invalid_request_error. Claude Opus 4.8 доступна в рамках ZDR. См. Требования к хранению данных для конкретных моделей.
  • Измените название модели с claude-opus-4-8 на claude-fable-5 (или claude-mythos-5).
  • Удалите любую конфигурацию thinking: {type: "disabled"}. Отключение мышления возвращает ошибку в claude-fable-5 и claude-mythos-5, а запросы без поля thinking выполняются с адаптивным мышлением.
  • Обновите разбор ответов, который считывает контент по позиции, например content[0].text: поскольку адаптивное мышление всегда включено, блоки thinking поступают перед блоками text. Вместо этого выбирайте блоки контента по type и передавайте блоки thinking обратно полностью и без изменений в циклах использования инструментов; изменённые блоки возвращают ошибку 400. См. Сохранение блоков мышления.
  • Если вы удалили ручное расширенное мышление и предварительное заполнение ответов ассистента во время предыдущих миграций, никаких действий не требуется: обе функции по-прежнему не поддерживаются в claude-fable-5 и claude-mythos-5.
  • Убедитесь, что любой код, разбирающий поле thinking, рассматривает его только как текст для отображения и передаёт блоки мышления обратно без изменений при продолжении работы на той же модели. По умолчанию thinking.display имеет значение "omitted" в claude-fable-5 и claude-mythos-5, так же как в Claude Opus 4.8. Установите display: "summarized", чтобы получать читаемые сводки. См. Вывод мышления в моделях Claude Fable и Claude Mythos.
  • Если вы воспроизводите историю разговора на более ранней модели, сначала удалите блоки thinking и redacted_thinking из предыдущих ходов ассистента. Блоки мышления от claude-fable-5 и claude-mythos-5 может прочитать только модель, которая их создала, или более новая модель: более ранние модели молча их игнорируют, тогда как Claude Fable 5.1 и Claude Mythos 5.1 их читают, поэтому сохраняйте их при переводе разговора на эти модели (см. Переключение моделей посреди разговора). Удаление блоков делает запросы к более ранним моделям минимальными и единообразными. Исключение составляет погашение «fallback credit» (резервный кредит), для которого требуется тело запроса, возвращённое в точном соответствии с правилами этой функции.
  • Если вы переходите на Claude Fable 5, обрабатывайте stop_reason: "refusal" и считывайте поле stop_details.category. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, рассмотрите возможность использования необязательного параметра fallbacks (бета-версия). См. Отказы и резервные модели.
  • Пересмотрите настройку effort. Начинайте с high для большинства задач, включая рабочие нагрузки, которые выполнялись с xhigh в Claude Opus 4.8.
  • Заново определите базовые показатели стоимости и задержки на собственных рабочих нагрузках. При миграции с claude-opus-4-8 количество токенов остаётся примерно неизменным; цена за токен отличается, а токены мышления оплачиваются как выходные токены, поэтому рабочие нагрузки, которые выполнялись без мышления, генерируют больше выходных токенов на запрос.

Was this page helpful?