Миграция на Claude Mythos 5 и Claude Fable 5
Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Mythos Preview, Claude Opus 5 или Claude Opus 4.8: идентификаторы моделей, изменения API и контрольные списки миграции.
Claude Fable 5 создана для сложных рассуждений и долгосрочной агентной работы. Claude Fable 5.1 развивает её возможности. Claude Fable 5 доступна в Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry. Claude Mythos 5 обладает теми же возможностями и предлагается только одобренным клиентам в рамках Project Glasswing.
Базовые настройки, общие для claude-fable-5 и claude-mythos-5:
- Мышление: Адаптивное мышление (adaptive thinking) всегда включено. Модель сама определяет, когда и сколько думать над каждым запросом, и никакая конфигурация
thinkingне требуется. Какthinking: {type: "disabled"}, так и ручное «extended thinking» (расширенное мышление) (thinking: {type: "enabled", budget_tokens: N}) возвращают ошибку 400. - Предзаполнение: Предзаполнение (prefill) сообщения ассистента возвращает ошибку 400. Вместо этого используйте инструкции в «system prompt» (системной подсказке).
- Контекстное окно и вывод: Контекстное окно в 1M токенов («context window») по умолчанию и до 128k выходных токенов на запрос.
- Цены: $10 за миллион входных токенов и $50 за миллион выходных токенов. См. Цены на Claude.
- Хранение данных: Обе модели требуют 30-дневного хранения данных и недоступны в рамках соглашений о нулевом хранении данных («zero data retention», или ZDR), если это прямо не разрешено Anthropic. Обе модели обозначены как Covered Models. В Claude API запрос к Claude Fable 5 от организации, чья конфигурация хранения данных не соответствует этому требованию, возвращает ошибку 400
invalid_request_error. Организациям с соглашением ZDR следует связаться со своей командой по работе с клиентами Anthropic, чтобы обсудить конфигурацию хранения данных, или настроить хранение данных для каждого рабочего пространства отдельно. Подробности по платформам см. в разделе Требования к хранению данных для конкретных моделей.
В чём две модели различаются:
- Доступность: Claude Fable 5 не требует одобрения доступа. Claude Mythos 5 доступна только одобренным клиентам в рамках Project Glasswing.
- Классификаторы безопасности: Claude Fable 5 использует классификаторы безопасности, которые могут отклонять запросы с
stop_reason: "refusal". Claude Mythos 5 не включает эти классификаторы. См. Отказы и резервные модели. - Priority Tier: Priority Tier поддерживается на Claude Fable 5, но не на Claude Mythos 5.
Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Mythos Preview
Claude Mythos 5 — преемник с ограниченным доступом для Claude Mythos Preview, исследовательской предварительной версии, доступной только по приглашению. Claude Fable 5 предлагает те же возможности и не требует одобрения доступа. Изменения в этом разделе в равной степени применимы к обеим целевым моделям.
Миграция в основном сводится к простой замене. Claude Mythos 5 и Claude Fable 5 используют тот же Messages API и те же паттерны использования инструментов («tool use»), что и Claude Mythos Preview, а количество токенов практически не меняется, поскольку все три модели используют один и тот же токенизатор. Ключевые изменения, которые нужно проверить, — это функции, которые больше недоступны (перечислены в следующем разделе), и вывод мышления. Если вы мигрируете на Claude Fable 5, также учтите отказы классификаторов безопасности, которых нет у Claude Mythos Preview и Claude Mythos 5; см. Отказы и резервные модели.
График вывода Claude Mythos Preview из эксплуатации см. в разделе Устаревание моделей.
Обновите название модели
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# Или для модели с теми же возможностями, но без требования одобрения доступа:
model = "claude-fable-5" # AfterФункции, недоступные на Claude Mythos 5 и Claude Fable 5
-
Расширенное мышление и бюджеты токенов мышления: Ручное расширенное мышление (
thinking: {type: "enabled", budget_tokens: N}) не поддерживается наclaude-mythos-5иclaude-fable-5и возвращает ошибку 400. Адаптивное мышление всегда включено: модель сама определяет, когда и сколько думать над каждым запросом, и никакая конфигурацияthinkingне требуется.thinking: {type: "disabled"}возвращает ошибку. Уbudget_tokensнет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.До (Claude Mythos Preview):
client.messages.create( model="claude-mythos-preview", max_tokens=16000, thinking={"type": "enabled", "budget_tokens": 10000}, messages=[{"role": "user", "content": "..."}], )После (Claude Mythos 5):
client.messages.create( model="claude-mythos-5", max_tokens=16000, messages=[{"role": "user", "content": "..."}], )Изменение для Claude Fable 5 идентично, с
claude-fable-5в качестве названия модели. -
Предзаполнение ассистента: Предзаполнение сообщения ассистента не поддерживается на
claude-mythos-5иclaude-fable-5и возвращает ошибку 400, так же как на Claude Mythos Preview. Вместо этого используйте инструкции в системной подсказке. -
Вывод мышления: На
claude-mythos-5иclaude-fable-5исходная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый обобщённый текст, когдаthinking.displayустановлен вsummarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления на моделях Claude Fable и Claude Mythos.
Подсчёт токенов и тарификация
claude-mythos-5 и claude-fable-5 используют тот же токенизатор, что и claude-mythos-preview (токенизатор, представленный вместе с Claude Opus 4.7). Количество токенов практически не меняется при миграции с claude-mythos-preview. По сравнению с моделями до Claude Opus 4.7 тот же контент может токенизироваться примерно в на 30% большее количество токенов, в зависимости от контента и характера рабочей нагрузки.
/v1/messages/count_tokens возвращает практически неизменные значения для claude-mythos-5 и claude-fable-5 по сравнению с claude-mythos-preview. Заново определите базовые показатели стоимости и задержки на ваших собственных рабочих нагрузках.
Контрольный список миграции
- Измените название модели с
claude-mythos-previewнаclaude-mythos-5или наclaude-fable-5, которая предлагает те же возможности и не требует одобрения доступа. - Удалите конфигурацию ручного расширенного мышления (
thinking: {type: "enabled", budget_tokens: N}). Адаптивное мышление всегда включено, и полеthinkingне требуется. - Удалите любую конфигурацию
thinking: {type: "disabled"}. Отключение мышления возвращает ошибку вclaude-mythos-5иclaude-fable-5. - Удалите
budget_tokens. У этого параметра нет прямой замены: мышление является адаптивным, а параметрeffort— это отдельный элемент управления на уровне вывода, а не бюджет мышления. - Убедитесь, что любой код, разбирающий поле
thinking, рассматривает его только как текст для отображения и передаёт блоки мышления обратно без изменений при продолжении работы на той же модели. По умолчаниюthinking.displayимеет значение"omitted"вclaude-mythos-5иclaude-fable-5, так же как в Claude Mythos Preview. Установитеdisplay: "summarized", чтобы получать читаемые сводки. См. Вывод мышления в моделях Claude Fable и Claude Mythos. - Если вы воспроизводите историю разговора на более ранней модели, сначала удалите блоки
thinkingиredacted_thinkingиз предыдущих ходов ассистента. Блоки мышления отclaude-fable-5иclaude-mythos-5может прочитать только модель, которая их создала, или более новая модель: более ранние модели молча их игнорируют, тогда как Claude Fable 5.1 и Claude Mythos 5.1 их читают, поэтому сохраняйте их при переводе разговора на эти модели (см. Переключение моделей посреди разговора). Удаление блоков делает запросы к более ранним моделям минимальными и единообразными. - Если вы переходите на Claude Fable 5, обрабатывайте
stop_reason: "refusal"и считывайте полеstop_details.category. Claude Fable 5 использует классификаторы безопасности, которых нет у Claude Mythos Preview и Claude Mythos 5. См. Отказы и резервные модели. - Заново определите базовые показатели количества токенов и затрат на собственных рабочих нагрузках. При миграции с
claude-mythos-previewколичество токенов остаётся примерно неизменным.
Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Opus 5
Claude Fable 5 и Claude Mythos 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Opus 5, с тем же контекстным окном в 1M токенов по умолчанию и тем же максимумом в 128k выходных токенов. Ограничения на предзаполнение и параметры сэмплирования, а также поведение отображения мышления переносятся с Claude Opus 5 без изменений. Изменения, которые нужно проверить, — это всегда включённое мышление, цены, Priority Tier и хранение данных.
Обновите название модели
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5" # AfterЧто изменилось
-
Мышление больше нельзя отключить: На Claude Opus 5 мышление включено по умолчанию и может быть отключено с помощью
thinking: {type: "disabled"}при уровне efforthighили ниже. Наclaude-fable-5иclaude-mythos-5адаптивное мышление всегда включено, иthinking: {type: "disabled"}возвращает ошибку 400 при любом уровне effort. Удалите конфигурациюthinking: {type: "disabled"}и вместо этого используйте более низкие уровни effort для управления расходом токенов.Если ваши запросы к Claude Opus 5 отключали мышление, форма ответа меняется: ответ может начинаться с одного или нескольких блоков
thinkingперед первым блокомtext, возвращаемых с пустым полемthinkingпри значении по умолчаниюdisplay: "omitted"(то же значение по умолчанию, что и у Claude Opus 5). Код, который читает ответ по позиции, напримерcontent[0].text, или обработчик потока, который рассматривает первый блок контента как текст, должен вместо этого выбирать блоки контента по их полюtype, а циклы использования инструментов должны передавать блокиthinkingобратно полностью и без изменений вместе с результатами инструментов. API отклоняет отредактированные, переупорядоченные или частично удалённые блоки мышления с ошибкой 400 (см. Сохранение блоков мышления). Токены мышления тарифицируются как выходные токены, даже когда текст мышления не возвращается. -
Цены: Claude Fable 5 и Claude Mythos 5 стоят $10 за миллион входных токенов и $50 за миллион выходных токенов по сравнению с $5 и $25 для Claude Opus 5. См. Цены на Claude.
-
Priority Tier: Priority Tier не поддерживается на Claude Opus 5, поэтому существующий трафик не затрагивается. Если у вашей организации есть обязательство по Priority Tier, Claude Fable 5 его поддерживает; Claude Mythos 5 — нет.
-
Хранение данных: Claude Fable 5 и Claude Mythos 5 требуют 30-дневного хранения данных и недоступны в рамках соглашений о нулевом хранении данных (ZDR), если это прямо не разрешено Anthropic. Обе модели обозначены как Covered Models. См. Требования к хранению данных для конкретных моделей.
Контрольный список миграции
- Обновите название модели с
claude-opus-5наclaude-fable-5(илиclaude-mythos-5). - Удалите любую конфигурацию
thinking: {type: "disabled"}; она возвращает ошибку 400 наclaude-fable-5иclaude-mythos-5. Вместо этого используйте более низкие уровни effort для управления расходом токенов и пересмотритеmax_tokensдля рабочих нагрузок, которые выполнялись с отключённым мышлением на Claude Opus 5. - Если эти рабочие нагрузки читают контент по позиции, например
content[0].text, обновите их, чтобы выбирать блоки контента поtype: блокиthinkingтеперь приходят перед блокамиtext. Передавайте блокиthinkingобратно полностью и без изменений в циклах использования инструментов; изменённые блоки возвращают ошибку 400. - Если у вашей организации есть соглашение о нулевом хранении данных (ZDR), подтвердите право на использование перед миграцией: эти модели недоступны в рамках ZDR, если это прямо не разрешено Anthropic. См. Требования к хранению данных для конкретных моделей.
- Заново определите базовые показатели стоимости на ваших собственных рабочих нагрузках. Количество токенов практически не меняется; цена за токен отличается, а рабочие нагрузки, которые выполнялись с отключённым мышлением, теперь производят токены мышления, которые тарифицируются как выходные токены.
Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Opus 4.8
Миграция в основном сводится к простой замене. Claude Fable 5 и Claude Mythos 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Opus 4.8, с тем же контекстным окном в 1M токенов по умолчанию и тем же максимумом в 128k выходных токенов. Количество токенов практически не меняется, поскольку модели используют один и тот же токенизатор. Ключевые изменения, которые нужно проверить, — это всегда включённое адаптивное мышление, вывод мышления, отказы классификаторов безопасности (только Claude Fable 5) и цены.
Обновите название модели
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5" # AfterЧто изменилось
Пункты в этом разделе описывают различия в API и поведении, которые стоит проверить после замены идентификатора модели. За исключением отмеченных случаев, они в равной степени применимы к claude-fable-5 и claude-mythos-5.
-
Адаптивное мышление всегда включено: Адаптивное мышление — единственный режим мышления на
claude-fable-5иclaude-mythos-5. Модель сама определяет, когда и сколько думать над каждым запросом, и никакая конфигурацияthinkingне требуется.thinking: {type: "disabled"}возвращает ошибку. Используйте параметр effort для управления глубиной мышления.Изменение поведения, которое нужно проверить: на Claude Opus 4.8 запросы без поля
thinkingвыполняются без мышления; наclaude-fable-5иclaude-mythos-5те же запросы выполняются с адаптивным мышлением.max_tokensостаётся жёстким ограничением на общий вывод — мышление плюс текст ответа, — поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления на Claude Opus 4.8. См. Контроль затрат. Ответы также могут начинаться с одного или нескольких блоковthinkingперед первым блокомtext, поэтому код, который читает ответ по позиции (например,content[0].textили обработчик потока, который рассматривает первый блок контента как текст), должен вместо этого выбирать блоки контента по их полюtype. Токены мышления тарифицируются как выходные токены, даже когда текст мышления вам не возвращается, поэтому рабочая нагрузка, которая выполнялась без мышления на Claude Opus 4.8, производит больше выходных токенов на запрос в дополнение к разнице в цене за токен.Если вы запускаете цикл использования инструментов, передавайте блоки
thinkingиз каждого ответа ассистента обратно в API полностью и без изменений при возврате результатов инструментов, включая блоки, у которых полеthinkingпустое. Возвращайте сообщение ассистента в том виде, в котором оно получено, а не фильтруйте его блоки контента по типу и не пересобирайте его: API отклоняет отредактированные, переупорядоченные или частично удалённые блоки мышления с ошибкой 400. См. Сохранение блоков мышления.До (Claude Opus 4.8):
client.messages.create( model="claude-opus-4-8", max_tokens=16000, thinking={"type": "adaptive"}, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )После (Claude Fable 5):
client.messages.create( model="claude-fable-5", max_tokens=16000, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )Изменение для Claude Mythos 5 идентично, с
claude-mythos-5в качестве названия модели. -
Расширенное мышление и бюджеты мышления (без изменений): Ручное расширенное мышление (
thinking: {type: "enabled", budget_tokens: N}) не поддерживается наclaude-fable-5иclaude-mythos-5и возвращает ошибку 400, так же как на Claude Opus 4.8. Уbudget_tokensнет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления. -
Предзаполнение ассистента (без изменений): Предзаполнение сообщения ассистента не поддерживается на
claude-fable-5иclaude-mythos-5и возвращает ошибку 400, так же как на Claude Opus 4.8. Вместо этого используйте инструкции в системной подсказке. -
Вывод мышления: На
claude-fable-5иclaude-mythos-5исходная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый обобщённый текст, когдаthinking.displayустановлен вsummarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления на моделях Claude Fable и Claude Mythos. -
Классификаторы безопасности и причина остановки
refusal(только Claude Fable 5):claude-fable-5запускает классификаторы безопасности для запросов и во время генерации ответа. Claude Mythos 5 не включает эти классификаторы. Когда классификатор отклоняет запрос, Messages API возвращаетstop_reason: "refusal"как успешный ответ HTTP 200, а не ошибку. Полеstop_details.categoryсообщает, какой классификатор сработал, с такими категориями, как"cyber","bio"и"reasoning_extraction", илиnull, когда отказ не соответствует ни одной именованной категории. Полный набор см. в таблице категорий отказов.С вас не взимается плата за входные токены запроса, отклонённого до генерации какого-либо вывода. Когда классификатор срабатывает в середине потока, входные данные и уже переданные выходные данные тарифицируются; отбросьте частичный вывод.
Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, передайте опциональный параметр
fallbacks, который находится в бета-версии в Claude API. Параметр недоступен в Message Batches API, а также на Amazon Bedrock, Google Cloud и Microsoft Foundry; на этих трёх платформах выполняйте повтор на стороне клиента или используйте промежуточное ПО SDK для резервной обработки отказов. См. Отказы и резервные модели. -
Начинайте с effort
high: Значение по умолчанию параметра effort остаётсяhigh. На Claude Opus 4.8 для программирования и работы с высокой автономностью рекомендуется явно устанавливатьxhigh. Наclaude-fable-5иclaude-mythos-5используйтеhighпо умолчанию для большинства задач и оставляйтеxhighдля рабочих нагрузок, наиболее чувствительных к возможностям модели. Более низкие настройки effort по-прежнему работают хорошо и часто превосходят производительностьxhighна предыдущих моделях. Снижайте effort, если задача выполняется, но занимает больше времени, чем необходимо. См. Составление подсказок для Claude Fable 5. -
Сниженный минимум для кэширования подсказок: Минимальная длина кэшируемой подсказки на
claude-fable-5иclaude-mythos-5составляет 512 токенов, что ниже 1 024 токенов на Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования на Claude Opus 4.8, теперь могут создавать записи кэша без каких-либо изменений кода. Минимумы для каждой модели см. в разделе Кэширование подсказок («prompt caching»).
Контрольный список миграции
- Если у вашей организации есть соглашение о нулевом хранении данных (ZDR), подтвердите соответствие требованиям перед миграцией.
claude-fable-5иclaude-mythos-5требуют хранения данных в течение 30 дней и недоступны в рамках ZDR, если это прямо не разрешено Anthropic. В Claude API запросы кclaude-fable-5, не соответствующие этому требованию, возвращают ошибку 400invalid_request_error. Claude Opus 4.8 доступна в рамках ZDR. См. Требования к хранению данных для конкретных моделей. - Измените название модели с
claude-opus-4-8наclaude-fable-5(илиclaude-mythos-5). - Удалите любую конфигурацию
thinking: {type: "disabled"}. Отключение мышления возвращает ошибку вclaude-fable-5иclaude-mythos-5, а запросы без поляthinkingвыполняются с адаптивным мышлением. - Обновите разбор ответов, который считывает контент по позиции, например
content[0].text: поскольку адаптивное мышление всегда включено, блокиthinkingпоступают перед блокамиtext. Вместо этого выбирайте блоки контента поtypeи передавайте блокиthinkingобратно полностью и без изменений в циклах использования инструментов; изменённые блоки возвращают ошибку 400. См. Сохранение блоков мышления. - Если вы удалили ручное расширенное мышление и предварительное заполнение ответов ассистента во время предыдущих миграций, никаких действий не требуется: обе функции по-прежнему не поддерживаются в
claude-fable-5иclaude-mythos-5. - Убедитесь, что любой код, разбирающий поле
thinking, рассматривает его только как текст для отображения и передаёт блоки мышления обратно без изменений при продолжении работы на той же модели. По умолчаниюthinking.displayимеет значение"omitted"вclaude-fable-5иclaude-mythos-5, так же как в Claude Opus 4.8. Установитеdisplay: "summarized", чтобы получать читаемые сводки. См. Вывод мышления в моделях Claude Fable и Claude Mythos. - Если вы воспроизводите историю разговора на более ранней модели, сначала удалите блоки
thinkingиredacted_thinkingиз предыдущих ходов ассистента. Блоки мышления отclaude-fable-5иclaude-mythos-5может прочитать только модель, которая их создала, или более новая модель: более ранние модели молча их игнорируют, тогда как Claude Fable 5.1 и Claude Mythos 5.1 их читают, поэтому сохраняйте их при переводе разговора на эти модели (см. Переключение моделей посреди разговора). Удаление блоков делает запросы к более ранним моделям минимальными и единообразными. Исключение составляет погашение «fallback credit» (резервный кредит), для которого требуется тело запроса, возвращённое в точном соответствии с правилами этой функции. - Если вы переходите на Claude Fable 5, обрабатывайте
stop_reason: "refusal"и считывайте полеstop_details.category. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, рассмотрите возможность использования необязательного параметраfallbacks(бета-версия). См. Отказы и резервные модели. - Пересмотрите настройку
effort. Начинайте сhighдля большинства задач, включая рабочие нагрузки, которые выполнялись сxhighв Claude Opus 4.8. - Заново определите базовые показатели стоимости и задержки на собственных рабочих нагрузках. При миграции с
claude-opus-4-8количество токенов остаётся примерно неизменным; цена за токен отличается, а токены мышления оплачиваются как выходные токены, поэтому рабочие нагрузки, которые выполнялись без мышления, генерируют больше выходных токенов на запрос.
Was this page helpful?