Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Mythos Preview, Claude Opus 5 или Claude Opus 4.8: идентификаторы моделей, изменения API и контрольные списки миграции.
Claude Fable 5 — самая мощная широко выпущенная модель Anthropic, доступная в Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry. Claude Mythos 5 обладает теми же возможностями и предлагается только одобренным клиентам в рамках Project Glasswing.
Базовые настройки, общие для claude-fable-5 и claude-mythos-5:
thinking не требуется. И thinking: {type: "disabled"}, и ручное «extended thinking» (расширенное мышление) (thinking: {type: "enabled", budget_tokens: N}) возвращают ошибку 400.invalid_request_error. Организациям с соглашением ZDR следует связаться со своей командой по работе с клиентами Anthropic, чтобы обсудить конфигурацию хранения данных. В качестве альтернативы вы можете настроить хранение данных для каждого рабочего пространства отдельно. Подробности по платформам см. в разделе Требования к хранению данных для конкретных моделей.
В чём две модели различаются:
stop_reason: "refusal". Claude Mythos 5 не включает эти классификаторы. См. Отказы и резервные варианты.Claude Mythos 5 — преемник с ограниченным доступом для Claude Mythos Preview, исследовательской предварительной версии, доступной только по приглашению. Claude Fable 5 предлагает те же возможности и не требует одобрения доступа. Изменения в этом разделе в равной степени применимы к обеим целевым моделям.
Миграция в основном сводится к прямой замене. Claude Mythos 5 и Claude Fable 5 используют тот же Messages API и те же паттерны «tool use» (использование инструментов), что и Claude Mythos Preview, а количество токенов остаётся примерно неизменным, поскольку все три модели используют один и тот же токенизатор. Ключевые изменения, которые следует проверить, — это функции, которые больше недоступны (перечислены в следующем разделе), и вывод мышления. Если вы мигрируете на Claude Fable 5, также учтите отказы классификаторов безопасности, которых нет у Claude Mythos Preview и Claude Mythos 5; см. Отказы и резервные варианты.
График вывода Claude Mythos Preview из эксплуатации см. в разделе Устаревание моделей.
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# Или для модели с теми же возможностями и без требования одобрения доступа:
model = "claude-fable-5" # AfterРасширенное мышление и бюджеты токенов мышления: Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается на claude-mythos-5 и claude-fable-5 и возвращает ошибку 400. Адаптивное мышление всегда включено: модель сама определяет, когда и сколько думать над каждым запросом, и никакая конфигурация thinking не требуется. thinking: {type: "disabled"} возвращает ошибку. У budget_tokens нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.
До (Claude Mythos Preview):
client.messages.create(
model="claude-mythos-preview",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)После (Claude Mythos 5):
client.messages.create(
model="claude-mythos-5",
max_tokens=16000,
messages=[{"role": "user", "content": "..."}],
)Изменение для Claude Fable 5 идентично, с claude-fable-5 в качестве названия модели.
Предзаполнение ассистента: Предзаполнение сообщения ассистента не поддерживается на claude-mythos-5 и claude-fable-5 и возвращает ошибку 400, так же как и на Claude Mythos Preview. Вместо этого используйте инструкции в системной подсказке.
Вывод мышления: На claude-mythos-5 и claude-fable-5 необработанная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый обобщённый текст, когда thinking.display установлен в summarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления на Claude Fable 5 и Claude Mythos 5.
claude-mythos-5 и claude-fable-5 используют тот же токенизатор, что и claude-mythos-preview (токенизатор, представленный вместе с Claude Opus 4.7). Количество токенов остаётся примерно неизменным при миграции с claude-mythos-preview. По сравнению с моделями до Claude Opus 4.7 тот же контент может токенизироваться примерно на 30% большим количеством токенов, в зависимости от содержимого и характера рабочей нагрузки.
/v1/messages/count_tokens возвращает примерно неизменные значения для claude-mythos-5 и claude-fable-5 по сравнению с claude-mythos-preview. Заново определите базовые показатели стоимости и задержки на ваших собственных рабочих нагрузках.
claude-mythos-preview на claude-mythos-5 или на claude-fable-5, которая предлагает те же возможности и не требует одобрения доступа.thinking: {type: "enabled", budget_tokens: N}). Адаптивное мышление всегда включено, и поле thinking не требуется.thinking: {type: "disabled"}. Отключение мышления возвращает ошибку на claude-mythos-5 и claude-fable-5.budget_tokens. У него нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.thinking, рассматривает его только как отображаемый текст и передаёт блоки мышления обратно без изменений при продолжении на той же модели. thinking.display по умолчанию имеет значение "omitted" на claude-mythos-5 и claude-fable-5, так же как и на Claude Mythos Preview; установите display: "summarized", чтобы получать читаемые сводки. См. Вывод мышления на Claude Fable 5 и Claude Mythos 5.
thinking и redacted_thinking из предыдущих ходов ассистента. Блоки мышления от claude-mythos-5 и claude-fable-5 привязаны к модели, которая их создала, и модели, отличные от Claude Fable 5 и Claude Mythos 5, молча игнорируют их. Удаление делает межмодельные запросы минимальными и единообразными.
stop_reason: "refusal" и читайте поле stop_details.category. Claude Fable 5 использует классификаторы безопасности, которых нет у Claude Mythos Preview и Claude Mythos 5. См. Отказы и резервные варианты.claude-mythos-preview.Claude Fable 5 и Claude Mythos 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Opus 5, с тем же контекстным окном на 1M токенов по умолчанию и тем же максимумом в 128k выходных токенов. Ограничения на предзаполнение и параметры сэмплирования, а также поведение отображения мышления переносятся с Claude Opus 5 без изменений. Изменения, которые следует проверить, — это всегда включённое мышление, цены, Priority Tier и хранение данных.
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5" # AfterМышление больше нельзя отключить: На Claude Opus 5 мышление включено по умолчанию и может быть отключено с помощью thinking: {type: "disabled"} при уровне effort high или ниже. На claude-fable-5 и claude-mythos-5 адаптивное мышление всегда включено, и thinking: {type: "disabled"} возвращает ошибку 400 при любом уровне effort. Удалите конфигурацию thinking: {type: "disabled"} и вместо этого используйте более низкие уровни effort для управления расходом токенов.
Если ваши запросы к Claude Opus 5 отключали мышление, форма ответа меняется: ответ может начинаться с одного или нескольких блоков thinking перед первым блоком text, возвращаемых с пустым полем thinking при значении по умолчанию display: "omitted" (то же значение по умолчанию, что и у Claude Opus 5). Код, который читает ответ по позиции, например content[0].text, или обработчик потока, который рассматривает первый блок содержимого как текст, должен вместо этого выбирать блоки содержимого по их полю type, а циклы использования инструментов должны передавать блоки thinking обратно полностью и без изменений вместе с результатами инструментов. API отклоняет отредактированные, переупорядоченные или частично удалённые блоки мышления с ошибкой 400 (см. Сохранение блоков мышления). Токены мышления тарифицируются как выходные токены, даже когда текст мышления не возвращается.
Цены: Claude Fable 5 и Claude Mythos 5 стоят $10 USD за миллион входных токенов и $50 USD за миллион выходных токенов по сравнению с $5 USD и $25 USD для Claude Opus 5. См. Цены на Claude.
Priority Tier: Priority Tier не поддерживается на Claude Opus 5, поэтому существующий трафик не затрагивается. Если у вашей организации есть обязательство по Priority Tier, Claude Fable 5 его поддерживает; Claude Mythos 5 — нет.
Хранение данных: Claude Fable 5 и Claude Mythos 5 требуют 30-дневного хранения данных и недоступны в рамках соглашений о нулевом хранении данных (ZDR); обе модели обозначены как Covered Models. См. Требования к хранению данных для конкретных моделей.
claude-opus-5 на claude-fable-5 (или claude-mythos-5).thinking: {type: "disabled"}; она возвращает ошибку 400 на claude-fable-5 и claude-mythos-5. Вместо этого используйте более низкие уровни effort для управления расходом токенов и пересмотрите max_tokens для рабочих нагрузок, которые выполнялись с отключённым мышлением на Claude Opus 5.content[0].text, обновите их, чтобы выбирать блоки содержимого по type: блоки thinking теперь приходят перед блоками text. Передавайте блоки thinking обратно полностью и без изменений в циклах использования инструментов; изменённые блоки возвращают ошибку 400.Миграция в основном сводится к прямой замене. Claude Fable 5 и Claude Mythos 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Opus 4.8, с тем же контекстным окном на 1M токенов по умолчанию и тем же максимумом в 128k выходных токенов. Количество токенов остаётся примерно неизменным, поскольку модели используют один и тот же токенизатор. Ключевые изменения, которые следует проверить, — это всегда включённое адаптивное мышление, вывод мышления, отказы классификаторов безопасности (только Claude Fable 5) и цены.
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5" # AfterПункты в этом разделе описывают различия в API и поведении, которые стоит проверить после замены идентификатора модели. За исключением отмеченных случаев, они в равной степени применимы к claude-fable-5 и claude-mythos-5.
Адаптивное мышление всегда включено: Адаптивное мышление — единственный режим мышления на claude-fable-5 и claude-mythos-5. Модель сама определяет, когда и сколько думать над каждым запросом, и никакая конфигурация thinking не требуется. thinking: {type: "disabled"} возвращает ошибку. Используйте параметр effort для управления глубиной мышления.
Изменение поведения, которое следует проверить: на Claude Opus 4.8 запросы без поля thinking выполняются без мышления; на claude-fable-5 и claude-mythos-5 те же запросы выполняются с адаптивным мышлением. max_tokens остаётся жёстким ограничением на общий вывод, мышление плюс текст ответа, поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления на Claude Opus 4.8. См. Контроль затрат. Ответы также могут начинаться с одного или нескольких блоков thinking перед первым блоком text, поэтому код, который читает ответ по позиции (например, content[0].text, или обработчик потока, который рассматривает первый блок содержимого как текст), должен вместо этого выбирать блоки содержимого по их полю type. Токены мышления тарифицируются как выходные токены, даже когда текст мышления вам не возвращается, поэтому рабочая нагрузка, которая выполнялась без мышления на Claude Opus 4.8, производит больше выходных токенов на запрос, в дополнение к разнице в цене за токен.
Если вы запускаете цикл использования инструментов, передавайте блоки thinking из каждого ответа ассистента обратно в API полностью и без изменений при возврате результатов инструментов, включая блоки, у которых поле thinking пустое. Возвращайте сообщение ассистента в том виде, в котором оно получено, а не фильтруйте его блоки содержимого по типу и не пересобирайте его: API отклоняет отредактированные, переупорядоченные или частично удалённые блоки мышления с ошибкой 400. См. Сохранение блоков мышления.
До (Claude Opus 4.8):
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)После (Claude Fable 5):
client.messages.create(
model="claude-fable-5",
max_tokens=16000,
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)Изменение для Claude Mythos 5 идентично, с claude-mythos-5 в качестве названия модели.
Расширенное мышление и бюджеты мышления (без изменений): Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается на claude-fable-5 и claude-mythos-5 и возвращает ошибку 400, так же как и на Claude Opus 4.8. У budget_tokens нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.
Предзаполнение ассистента (без изменений): Предзаполнение сообщения ассистента не поддерживается на claude-fable-5 и claude-mythos-5 и возвращает ошибку 400, так же как и на Claude Opus 4.8. Вместо этого используйте инструкции в системной подсказке.
Вывод мышления: На claude-fable-5 и claude-mythos-5 необработанная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый обобщённый текст, когда thinking.display установлен в summarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления на Claude Fable 5 и Claude Mythos 5.
Классификаторы безопасности и причина остановки refusal (только Claude Fable 5): claude-fable-5 запускает классификаторы безопасности для запросов и во время генерации ответа. Claude Mythos 5 не включает эти классификаторы. Когда классификатор отклоняет запрос, Messages API возвращает stop_reason: "refusal" как успешный ответ HTTP 200, а не ошибку. Поле stop_details.category сообщает, какой классификатор сработал, с такими категориями, как "cyber", "bio" и "reasoning_extraction", или null, когда отказ не соответствует ни одной именованной категории. Полный набор см. в таблице категорий отказов.
С вас не взимается плата за входные токены запроса, отклонённого до генерации какого-либо вывода. Когда классификатор срабатывает в середине потока, входные данные и уже переданный вывод тарифицируются; отбросьте частичный вывод.
Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, передайте опциональный параметр fallbacks, который находится в бета-версии в Claude API. Параметр недоступен в Message Batches API, а также в Amazon Bedrock, Google Cloud и Microsoft Foundry; на этих трёх платформах выполняйте повторную попытку на стороне клиента или используйте промежуточное ПО SDK для резервного варианта при отказе. См. Отказы и резервные варианты.
Начинайте с уровня effort high: Значение по умолчанию параметра effort остаётся high. На Claude Opus 4.8 для программирования и работы с высокой автономностью рекомендуется явно устанавливать xhigh. На claude-fable-5 и claude-mythos-5 используйте high по умолчанию для большинства задач и оставляйте xhigh для рабочих нагрузок, наиболее чувствительных к возможностям модели. Более низкие настройки effort по-прежнему работают хорошо и часто превосходят производительность xhigh на предыдущих моделях. Уменьшите effort, если задача выполняется, но занимает больше времени, чем необходимо. См. Составление подсказок для Claude Fable 5.
Более низкий минимум для кэширования подсказок: Минимальная кэшируемая длина подсказки на claude-fable-5 и claude-mythos-5 составляет 512 токенов, что ниже 1 024 токенов на Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования на Claude Opus 4.8, теперь могут создавать записи кэша без каких-либо изменений кода. Минимумы для каждой модели см. в разделе «Prompt caching» (кэширование подсказок).
claude-fable-5 и claude-mythos-5 требуют 30-дневного хранения данных; в Claude API запросы к claude-fable-5, не соответствующие этому требованию, возвращают ошибку 400 invalid_request_error. Claude Opus 4.8 остаётся доступной в рамках ZDR. См. Требования к хранению данных для конкретных моделей.
claude-opus-4-8 на claude-fable-5 (или claude-mythos-5).thinking: {type: "disabled"}. Отключение мышления возвращает ошибку на claude-fable-5 и claude-mythos-5, а запросы без поля thinking выполняются с адаптивным мышлением.content[0].text: при всегда включённом адаптивном мышлении блоки thinking приходят перед блоками text. Вместо этого выбирайте блоки содержимого по type и передавайте блоки thinking обратно полностью и без изменений в циклах использования инструментов; изменённые блоки возвращают ошибку 400. См. Сохранение блоков мышления.claude-fable-5 и claude-mythos-5.thinking, рассматривает его только как отображаемый текст и передаёт блоки мышления обратно без изменений при продолжении на той же модели. thinking.display по умолчанию имеет значение "omitted" на claude-fable-5 и claude-mythos-5, так же как и на Claude Opus 4.8; установите display: "summarized", чтобы получать читаемые сводки. См. Вывод мышления на Claude Fable 5 и Claude Mythos 5.
thinking и redacted_thinking из предыдущих ходов ассистента. Блоки мышления от claude-fable-5 и claude-mythos-5 привязаны к модели, которая их создала, и модели, отличные от Claude Fable 5 и Claude Mythos 5, молча игнорируют их. Удаление делает межмодельные запросы минимальными и единообразными. Исключение — использование резервного кредита, которое требует, чтобы тело запроса было воспроизведено в точном соответствии с правилами этой функции.
stop_reason: "refusal" и читайте поле stop_details.category. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, рассмотрите опциональный параметр fallbacks (бета). См. Отказы и резервные варианты.effort. Начинайте с high для большинства задач, включая рабочие нагрузки, которые выполнялись на xhigh на Claude Opus 4.8.claude-opus-4-8; цена за токен отличается, а токены мышления тарифицируются как выходные токены, поэтому рабочие нагрузки, которые выполнялись без мышления, производят больше выходных токенов на запрос.Was this page helpful?