Миграция на Claude Fable 5.1 и Claude Mythos 5.1
Миграция на Claude Fable 5.1 и Claude Mythos 5.1 с Claude Fable 5, Claude Mythos 5, Claude Opus 5 или Claude Opus 4.8: идентификаторы моделей, критические изменения и контрольные списки миграции.
Claude Fable 5.1 приходит на смену Claude Fable 5 с теми же ценами на входные и выходные токены, при этом чтение из кэша стоит в четыре раза дешевле. Модель доступна в Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry. Claude Mythos 5.1 обладает теми же возможностями и предлагается только одобренным клиентам в рамках Project Glasswing. О поведенческих различиях и шаблонах подсказок см. Составление подсказок для Claude Fable 5.1.
Базовые настройки, общие для claude-fable-5-1 и claude-mythos-5-1:
- Мышление: Adaptive thinking (адаптивное мышление) всегда включено, без изменений по сравнению с Claude Fable 5. Модель сама решает, когда и сколько думать. Конфигурация
thinkingне требуется. Иthinking: {type: "disabled"}, и ручное «extended thinking» (расширенное мышление) (thinking: {type: "enabled", budget_tokens: N}) возвращают ошибку 400. - Предзаполнение: Предзаполнение (prefill) сообщения ассистента возвращает ошибку 400, без изменений по сравнению с Claude Fable 5. Вместо этого используйте инструкции в системной подсказке.
- Выбор инструмента: Поддерживаются
{type: "auto"}(по умолчанию) и{type: "none"}. Принудительный вызов инструмента с помощью{type: "any"}или{type: "tool", name: "..."}возвращает ошибку 400. См. Критические изменения. - Сохранённое мышление между моделями: Claude Fable 5.1 читает блоки мышления от Claude Opus 5, Claude Fable 5, Claude Mythos 5 и более ранних моделей Claude. Ни одна из этих моделей не может читать блоки Claude Fable 5.1. См. Критические изменения.
- Контекстное окно и вывод: «Context window» (контекстное окно) размером 1M токенов по умолчанию и до 128k выходных токенов на запрос.
- Цены: $10 USD за миллион входных токенов и $50 USD за миллион выходных токенов, как и у Claude Fable 5. Чтение из кэша подсказок стоит $0,25 USD за миллион токенов — четверть тарифа Claude Fable 5. См. Цены на Claude.
- Хранение данных: Обе модели требуют 30-дневного хранения данных, недоступны в рамках соглашений о нулевом хранении данных (zero data retention, или ZDR), если это прямо не разрешено Anthropic, и отнесены к категории Covered Models, как и Claude Fable 5 и Claude Mythos 5. В Claude API запрос от организации или рабочего пространства без 30-дневного хранения возвращает ошибку 400
invalid_request_error. Организациям с соглашением ZDR следует обратиться к своей команде по работе с клиентами Anthropic или настроить хранение для каждого рабочего пространства отдельно. Подробности по платформам см. в разделе Требования к хранению данных для конкретных моделей.
В чём две модели расходятся:
- Доступность: Claude Fable 5.1 не требует одобрения доступа. Claude Mythos 5.1 доступна только одобренным клиентам в рамках Project Glasswing. Для получения доступа обратитесь к своей команде по работе с клиентами Anthropic.
- Классификаторы безопасности: Claude Fable 5.1 использует классификаторы безопасности, охватывающие те же категории
stop_details, что и Claude Fable 5. Отклонённый запрос возвращаетstop_reason: "refusal"сstop_details.categoryи может быть перенаправлен на другую модель с помощью параметраfallbacksили повторной попытки на стороне клиента. См. Отказы и резервные модели. - Priority Tier: Ни одна из моделей не поддерживается на Priority Tier. Claude Fable 5 поддерживается.
Миграция на Claude Fable 5.1 с Claude Fable 5
Миграция в основном сводится к прямой замене. Поверхность API, лимиты, цены за токен, токенизатор, всегда включённое адаптивное мышление, обработка отказов и категории stop_details — всё совпадает с Claude Fable 5. Что меняется: принудительный выбор инструмента возвращает ошибку 400, блоки мышления сохраняются только для модели, которая их создала, или более новой, и только в том разговоре, в котором они были созданы, чтение из кэша стоит дешевле, а поведение в агентных циклах отличается в трёх аспектах. Те же изменения применяются к Claude Mythos 5.1, за исключением проверки разговора для блоков мышления, которую Claude Mythos 5.1 не выполняет.
Обновите имя модели
model = "claude-fable-5" # Before
model = "claude-fable-5-1" # After
# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5-1" # AfterКритические изменения
-
Принудительный выбор инструмента не поддерживается: Claude Fable 5 принимает значения
tool_choiceauto,none,anyиtool. Наclaude-fable-5-1значения{type: "any"}и{type: "tool", name: "..."}возвращают ошибку 400invalid_request_error:tool_choice: type "tool" and "any" are not supported for this model.Проверка применяется в Messages API, Message Batches API и на эндпоинте подсчёта токенов.
До (Claude Fable 5):
client = anthropic.Anthropic() record_summary_tool = { "name": "record_summary", "description": "Record the structured summary of the document.", "input_schema": { "type": "object", "properties": {"summary": {"type": "string"}}, "required": ["summary"], }, } response = client.messages.create( model="claude-fable-5", max_tokens=16000, tools=[record_summary_tool], tool_choice={"type": "tool", "name": "record_summary"}, messages=[{"role": "user", "content": "Summarize: The meeting moved to Thursday."}], ) print(response.content)После (Claude Fable 5.1): оставьте
tool_choiceв значенииauto, назовите инструмент в инструкции и установитеstrict: true, чтобы вызов соответствовал вашей схеме. (В организации с CMEK, где структурированные выходные данные, включаяstrict: true, недоступны для моделей Claude Fable, полагайтесь только на инструкцию.) Например:client = anthropic.Anthropic() record_summary_tool = { "name": "record_summary", "description": "Record the structured summary of the document.", "strict": True, "input_schema": { "type": "object", "properties": {"summary": {"type": "string"}}, "required": ["summary"], "additionalProperties": False, }, } response = client.messages.create( model="claude-fable-5-1", max_tokens=16000, tools=[record_summary_tool], tool_choice={"type": "auto"}, messages=[ { "role": "user", "content": "Summarize: The meeting moved to Thursday. Call the record_summary tool with your result.", } ], ) print(response.content)См. Строгое использование инструментов и Принудительное использование инструментов. Если вы принудительно вызывали инструмент только для получения JSON, соответствующего схеме, используйте вместо этого JSON-вывод (
output_config.format).Если ваше приложение, а не пользователь, требует вызова конкретного инструмента на текущем ходе многоходового разговора, добавьте системное сообщение в середине разговора после последнего хода
user. Назовите инструмент, укажите, что вызов обязателен для этого хода, и попросите Claude начать свой ответ с него. Поскольку сообщение добавляется в конец, а не записывается в системную подсказку верхнего уровняsystem, более ранние ходы остаются побайтово идентичными и сохраняют попадания в кэш подсказок:client = anthropic.Anthropic() search_help_center_tool = { "name": "search_help_center", "description": "Search the help center for policy and troubleshooting articles.", "strict": True, "input_schema": { "type": "object", "properties": {"query": {"type": "string"}}, "required": ["query"], "additionalProperties": False, }, } response = client.messages.create( model="claude-fable-5-1", max_tokens=16000, system="You are a customer support assistant for an online electronics store.", tools=[search_help_center_tool], messages=[ { "role": "user", "content": "My headphones from order A1234 arrived yesterday.", }, { "role": "assistant", "content": "Thanks for confirming. How can I help with order A1234?", }, {"role": "user", "content": "I opened the box. Can I still return them?"}, # Приложение требует обращения к справочному центру перед любым # ответом о политике. Добавление требования как системного сообщения # оставляет предыдущие ходы без изменений. { "role": "system", "content": "Tool-use requirement for the current turn: the application requires a call to the search_help_center tool in your response to the user's latest message. Begin your response with the search_help_center tool call. Do not reply with text only.", }, ], ) print(response.content)Сохраняйте сообщение
role: "system"в истории при последующих запросах, как и любой другой ход. Системные сообщения в середине разговора не требуют бета-заголовка.tool_choice: {"type": "none"}по-прежнему работает для хода, на котором инструменты вызывать нельзя. -
Блоки мышления сохраняются только для модели, которая их создала, или более новой: Каждый блок
thinkingзаписывает, какая модель его создала. Claude Fable 5.1 читает свои собственные блоки, а также блоки от Claude Mythos 5.1, Claude Opus 5, Claude Fable 5, Claude Mythos 5 и более ранних моделей Claude. Разговор, переходящий наclaude-fable-5-1с любой из них, сохраняет свои предыдущие рассуждения. Условие одностороннее: кроме Claude Mythos 5.1, ни одна из этих моделей не может читать блоки Claude Fable 5.1.Разговор, который шёл на Claude Fable 5.1, может попасть на более старую модель через переключение маршрутизатора, повторную попытку на стороне клиента или резервный переход при отказе классификатора, включая резервный переход на стороне сервера. API удаляет блоки, которые эта модель не может прочитать, до того как она их увидит, запрос выполняется успешно, и вам не выставляется счёт за отброшенные входные токены. Целевая модель заново планирует без этих рассуждений, что может увеличить стоимость и задержку на первом ходе после переключения. Чтобы увидеть, что было отброшено, отправьте бета-заголовок
thinking-binding-controls-2026-08-01: тогда ответы содержат массивinput_transformations, в котором каждый отброшенный блок указан сreason: "model_binding_mismatch". См. Сохранённое мышление. -
Редактирование более ранних ходов делает блоки мышления недействительными: Каждый блок
thinkingот Claude Fable 5.1 действителен только относительно подсказкиsystem,toolsи истории разговора, которые ему предшествовали. Если вашей историей разговора управляет Claude Code, claude.ai, Claude Managed Agents или Claude Agent SDK, этот префикс уже сохраняется нетронутым. Если ваш код сам строит массивmessages, этот пункт относится к вам, а Сохранённое мышление — полное руководство по интеграции. Там, где проверка применяется принудительно, запрос, отправляющий блок обратно после изменения чего-либо из перечисленного, отклоняется с ошибкой 400:messages.5.content.0: Invalid `signature` in `thinking` block. The block is bound to a different conversation. Remove the block, or set `thinking.block_binding.prefix_mismatch_behavior` to "drop_block". That setting requires the `thinking-binding-controls-2026-08-01` value in the `anthropic-beta` header.API принудительно применяет проверку для новых аккаунтов, созданных 31 августа 2026 года или позже. Для аккаунтов, созданных ранее, API фиксирует несоответствие, но не предпринимает действий, если только запрос не устанавливает
thinking.block_binding.prefix_mismatch_behavior, что включает принудительное применение. Anthropic планирует применять проверку для всех аккаунтов на будущих моделях, поэтому сделайте своё приложение совместимым уже сейчас: те же шаблоны поддерживают кэш подсказок в «тёплом» состоянии, и вы можете протестировать проверку с любого аккаунта, отправивprefix_mismatch_behavior. Если вы поставляете инструмент или фреймворк, который люди запускают со своим собственным ключом API, протестируйте таким образом до запуска: ваш ключ, вероятно, принадлежит более старому аккаунту, а ваши пользователи на новых аккаунтах столкнутся с проверкой раньше вас. Чтобы узнать, применяется ли проверка к вашему собственному аккаунту по умолчанию, отправьте запрос, редактирующий историю, без бета-заголовка: ошибка 400, в которой упоминается заголовок, означает, что применяется.Ошибка постоянна для данного тела запроса: автоматический цикл повторных попыток её не устранит. Чтобы продолжить без недействительных рассуждений вместо сбоя, удалите блоки
thinkingиз истории и повторите запрос один раз, либо отправьте бета-заголовокthinking-binding-controls-2026-08-01и установитеprefix_mismatch_behaviorв значение"drop_block"(по умолчанию"error"). При"drop_block"API отбрасывает несоответствующий блок и каждый блок мышления после него в разговоре и сообщает о каждом сreason: "prefix_binding_mismatch"в массивеinput_transformationsответа:client = anthropic.Anthropic() response = client.beta.messages.create( model="claude-fable-5-1", max_tokens=16000, thinking={ "type": "adaptive", "block_binding": {"prefix_mismatch_behavior": "drop_block"}, }, messages=[ { "role": "user", "content": "What is the greatest common divisor of 1071 and 462?", } ], betas=["thinking-binding-controls-2026-08-01"], ) for block in response.content: if block.type == "text": print(block.text) print(f"Input transformations: {len(response.input_transformations or [])}")Эндпоинт подсчёта токенов выполняет ту же проверку. Форму ответа и размещение при потоковой передаче см. в разделе Элементы управления для несохраняемых блоков (бета).
Шаблоны, которые делают последующие блоки мышления недействительными, и что делать вместо них:
- Редактирование, изменение порядка или удаление более ранних ходов. Сюда входит удаление старых результатов инструментов, вырезание ходов из середины транскрипта и компактизация на стороне клиента, которая сохраняет недавние ходы и их блоки мышления дословно за сводкой (включая фоновую компактизацию, которая подставляет свою сводку несколькими ходами позже). Вместо этого используйте серверную компактизацию или редактирование контекста (очистку результатов инструментов для старых результатов инструментов) либо одну из форм клиентской компактизации из раздела Обрезайте контекст на сервере.
- Внедрение содержимого, которое вы не сохраняете, например напоминания на каждый ход, добавляемого после блоков
tool_resultи удаляемого при следующем запросе. Вместо этого отправляйте напоминание как системное сообщение с областью действия в один ход и оставляйте его в истории. - Пересборка подсказки верхнего уровня
systemили массиваtoolsмежду запросами в одном разговоре, например для обновления текущей даты или добавления либо удаления инструмента. Вместо этого добавьте системное сообщение в середине разговора, содержащее новую инструкцию («The current date is 2026-09-14.») или блокиtool_additionиtool_removal. - URL изображения или документа, который при последующем запросе отдаёт другие байты. Проверка охватывает байты, а не строку URL, поэтому ротируемый подписанный URL для того же файла допустим. Для содержимого, на которое вы ссылаетесь на протяжении нескольких ходов, загрузите его один раз через Files API и отправляйте
file_id, либо отправляйте base64.
Каждая замена также сохраняет более ранние ходы побайтово идентичными и сохраняет попадания в кэш подсказок, которые были бы потеряны при редактировании истории, подсказки
systemили массиваtools.Шаблоны, которые продолжают работать:
- Истории только с добавлением: добавление ходов и передача более ранних ходов обратно в точности так, как они были отправлены и получены, включая добавленные сообщения
role: "system". - Удаление блоков мышления из более ранних ходов ассистента, начиная с самых старых.
- Изменение
effort,max_tokensили любого другого параметра запроса внеsystem,toolsиmessages, а также добавление или перемещение маркеровcache_control. - Серверная компактизация и редактирование контекста, включая очистку блоков мышления. Они не считаются правками, поскольку проверка сравнивает разговор в том виде, в котором вы его отправили.
Чтобы проверить существующую интеграцию:
- Зафиксируйте точные тела запросов, которые она отправляет на протяжении нескольких обычных ходов, включая компактизацию или изменение инструментов, если они есть в вашем продукте. Для каждой пары последовательных запросов сравните подсказку
system, массивtoolsи общий префиксmessages. Они должны быть побайтово идентичны вплоть до вновь добавленных ходов. - Проведите обычную многоходовую сессию с
claude-fable-5-1с бета-заголовкомthinking-binding-controls-2026-08-01иprefix_mismatch_behavior: "drop_block"и логируйтеinput_transformationsв каждом ответе. Пустой массив на каждом ходе означает, что история не нарушена. Запись сreason: "prefix_binding_mismatch"означает, что что-то перед блоком по путиpathизменилось с предыдущего запроса. Запись сreason: "model_binding_mismatch"означает, что разговор сменил модель, что не является ошибкой в вашем коде. Это работает с любого аккаунта, поскольку установка поля включает принудительное применение для запроса. В CI вместо этого установите"error", чтобы правка приводила к сбою прогона. - Выберите настройку для продакшена. Оставьте значение по умолчанию
"error", если несоответствие префикса может означать только ошибку в вашем коде, или установите"drop_block", чтобы отбрасывать затронутые блоки вместо сбоя, и в любом случае отслеживайте ошибки 400 или записиinput_transformations.
Однократное отбрасывание блоков мышления, например на границе компактизации, мало на что влияет. Интеграция, которая делает предыдущее мышление недействительным при каждом запросе, каждый раз перезапускает кэш подсказок, что может увеличить стоимость задачи (см. Ведите историю разговора только с добавлением).
Изменения в поведении
-
Меньше параллельных вызовов инструментов в длинных агентных циклах: В длительных циклах, где следующие независимые операции чтения лишь подразумеваются задачей (пользовательские агенты для программирования, обвязки bash-и-редактор, использование компьютера), Claude Fable 5.1 может выполнять один вызов инструмента за ход. Каждый дополнительный ход стоит токенов, сетевого обмена и реального времени. Добавляйте инструкцию о пакетной обработке из одного предложения после каждого сообщения пользователя как системное сообщение с областью действия в один ход (
clear_at: "next_user_message", бета) или, без беты, в текстовом блоке после блоковtool_result, и оставляйте более ранние копии в истории при последующих запросах. См. Объединяйте независимые вызовы инструментов в агентных циклах. -
Меньше сообщений о прогрессе между вызовами инструментов: Claude Fable 5.1 пишет меньше обновлений статуса во время длинных последовательностей инструментов, чем Claude Fable 5, а её сводки по агентному программированию короче. Если ваш интерфейс отображает эти обновления, установите
thinking.displayв значение"updates"(бета) или"summarized"и явно запрашивайте их в подсказке. См. Обновления прогресса между вызовами инструментов и Запрашивайте обновления прогресса для пользователя. -
Меньше вызовов поиска и извлечения при низком уровне усилий: При уровне усилий
lowClaude Fable 5.1 чаще, чем Claude Fable 5, отвечает по памяти вместо вызова инструмента поиска или извлечения. Если ваш продукт полагается на извлечение при низком уровне усилий, повысьте уровень усилий для этих запросов или укажите модели, когда искать. См. Запуск поиска при низком уровне усилий.
О различиях в плотности прозы, форматировании чата, цитировании в сводках и правках файлов, которые не влияют на интеграцию с API, см. Изменения по сравнению с Claude Fable 5.
Рекомендуемые изменения
Эти изменения не обязательны, но каждое из них снижает стоимость или задержку либо устраняет один из режимов сбоя:
-
Изменяйте уровень усилий в середине разговора (бета): На Claude Fable 5
output_config.effortзадаётся на уровне запроса, и его изменение между запросами сбрасывает кэшированные префиксы более ранних ходов. Наclaude-fable-5-1сообщениеrole: "system", содержащее толькоoutput_config, повышает уровень усилий для сложного шага или понижает для рутинных, не делая недействительным кэш подсказок:client = anthropic.Anthropic() response = client.beta.messages.create( model="claude-fable-5-1", max_tokens=4096, output_config={"effort": "high"}, messages=[ { "role": "user", "content": "Plan a migration from SQLite to PostgreSQL in three short steps.", }, { "role": "assistant", "content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.", }, # Системное сообщение только с effort: новый уровень вступает в силу со следующего хода пользователя. {"role": "system", "content": [], "output_config": {"effort": "low"}}, {"role": "user", "content": "Summarize the plan in one sentence."}, ], betas=["mid-conversation-output-config-2026-07-01"], ) for block in response.content: if block.type == "text": print(block.text)Значение применяется к следующему ходу пользователя и каждому последующему ходу, пока другое сообщение
role: "system"его не изменит. Принимаются только именованные уровни (low,medium,high,xhigh,max), и требуется бета-заголовокmid-conversation-output-config-2026-07-01. См. Уровень усилий для отдельного сообщения. -
Изменяйте инструкции и инструменты с помощью системных сообщений в середине разговора: Чтобы изменить инструкции или инструменты в ходе сессии, добавьте сообщение
role: "system"с блокамиtool_additionиtool_removalдля изменения инструментов (бета-заголовокmid-conversation-tool-changes-2026-07-01, при этом полный набор инструментов объявляется вtoolsв начале сессии). Это сохраняет попадания в кэш подсказок на более ранних ходах и поддерживает историю разговора только с добавлением. То же сообщение заменяет принудительныйtool_choice, когда на текущем ходе должен быть запущен конкретный инструмент (см. Критические изменения). Для напоминания, которое относится только к одному ходу, отправьте его как отдельное текстовое сообщениеrole: "system"сclear_at: "next_user_message"(системные сообщения с областью действия в один ход, бета-заголовокmid-conversation-system-clear-at-2026-08-21) и оставьте его в истории: оно перестаёт отображаться после следующего сообщения пользователя и не стоит токенов после очистки. Сообщение, содержащее блокиtool_additionилиtool_removal, не может иметь область действия в один ход. -
Используйте
fallbacks: "default"для отказов: Продолжайте обрабатыватьstop_reason: "refusal"и читатьstop_details.categoryперед содержимым ответа. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, установитеfallbacks: "default"(бета, заголовокserver-side-fallback-2026-07-01)."default"повторяет отклонённый запрос на модели, которую Anthropic рекомендует для данной категории. Допустимые резервные цели для Claude Fable 5.1 — Claude Opus 4.8 (claude-opus-4-8) и Claude Opus 5 (claude-opus-5). Явный списокfallbacksможет указывать любую из них. Резервная модель не получает блоки мышления Claude Fable 5.1. Если вы реализуете повторную попытку самостоятельно, резервный кредит применяется на тех же условиях, что и для Claude Fable 5. См. Отказы и резервные модели. -
Начинайте с уровня усилий
highи проводите перебор: Значение параметра effort по умолчанию —high, и поддерживаются все пять уровней. Придерживайтесь рекомендаций для Claude Fable 5:highдля большинства задач иmediumкак средство контроля затрат, которое стоит протестировать. Преимущества Claude Fable 5.1 над Claude Fable 5 наиболее велики на уровняхxhighиmax, но эти уровни также увеличивают время мышления и время до первого ответа, поэтому переходите на них для задач, наиболее чувствительных к возможностям модели, и там, где ваши оценки показывают выигрыш. Проведите новый перебор на собственных оценках, а не переносите настройку, подобранную для Claude Fable 5. См. Рекомендуемые уровни усилий для Claude Fable 5.1. -
Обрезайте контекст на сервере или компактизируйте в форме, не несущей устаревшего мышления: Если ваш код усекает или суммирует более старые ходы на клиенте, самое простое решение — перенести эту работу на серверную компактизацию или редактирование контекста. Ни то, ни другое не считается правкой, поскольку проверка истории сравнивает разговор в том виде, в котором вы его отправили, так что ничто из удаляемого ими не делает последующие блоки мышления недействительными, а параметр
instructionsкомпактизации принимает вашу собственную подсказку для суммирования. Если вы оставляете компактизацию на клиенте, выберите одну из трёх форм:- Простая компактизация (рекомендуется): замените всю историю одним сообщением-сводкой плюс новым ходом пользователя и больше ничего не воспроизводите. Блоки мышления не переносятся, поэтому ничто не даёт сбоя. Модели Claude обучены на долгосрочных задачах с этой схемой, и для большинства рабочих нагрузок она работает сопоставимо с более сложными.
- Компактизация с сохранением хвоста: если вы сохраняете самые последние ходы дословно за сводкой, удалите блоки
thinkingиredacted_thinkingиз этих ходов (текст и вызовы инструментов могут остаться) или установитеprefix_mismatch_behavior: "drop_block". Их мышление было создано относительно полной истории и в противном случае даёт сбой за сводкой. - Фоновая компактизация: если вы строите сводку вне критического пути и подставляете её позже, каждый ход, созданный за это время, несёт мышление, предшествующее подстановке. Отправляйте
"drop_block"в каждом запросе, который всё ещё содержит блоки мышления, созданные до подстановки (или удаляйте эти блоки сами;input_transformationsв первом ответе после подстановки перечисляет, какие именно), либо компактизируйте синхронно.
Не вырезайте отдельные ходы из середины транскрипта: это делает недействительным каждый последующий блок мышления, и никакая клиентская форма этого не избегает. Используйте системное сообщение в середине разговора для изменения инструкции, которое вы вносили, или серверное редактирование контекста для выборочного удаления. См. Передача блоков компактизации обратно.
Контрольный список миграции
- Обновите имя модели с
claude-fable-5наclaude-fable-5-1(или сclaude-mythos-5наclaude-mythos-5-1). - Замените принудительный
tool_choice({type: "any"}или{type: "tool", ...}). Он возвращает ошибку 400. Используйте{type: "auto"}вместе с явной инструкцией и инструментами соstrict: trueлибо выходные данные в формате JSON. Поместите инструкцию в ходuserили в сообщениеrole: "system"в середине разговора, если ваше приложение требует этого вызова. - Продолжайте передавать блоки
thinkingобратно без изменений на каждом ходе, включая пустые. Claude Fable 5.1 читает блоки от Claude Opus 5, Claude Fable 5, Claude Mythos 5 и более ранних моделей. При переносе разговора с Claude Fable 5.1 на более раннюю модель её блоки отбрасываются (Claude Mythos 5.1 их читает). - Если ваш код сам формирует массив
messages, проверьте, не редактирует ли он более ранние ходы: запустите сессию с бета-заголовкомthinking-binding-controls-2026-08-01иprefix_mismatch_behavior: "drop_block", логируйтеinput_transformationsи исправьте каждыйprefix_binding_mismatch. Записиmodel_binding_mismatchпосле переключения модели ожидаемы. - Сохраняйте историю разговора только с добавлением в конец: зафиксируйте
systemиtoolsв начале сессии и перенесите изменения в середине сессии в сообщенияrole: "system"и блокиtool_addition/tool_removal, отправляйте напоминания для каждого хода как системные сообщения с областью действия хода, которые вы никогда не удаляете, обрезайте контекст на стороне сервера или удаляйте блоки мышления из любых ходов, которые вы переносите через сводку на стороне клиента, и ссылайтесь на файлы, используемые в нескольких ходах, поfile_id. - Выберите
prefix_mismatch_behaviorдля продакшена ("error"по умолчанию или"drop_block") и отслеживайте его. Если вы поддерживаете инструмент, который другие запускают со своим собственным ключом API, протестируйте с установленным полем: для новых аккаунтов проверка применяется по умолчанию, даже если для вашего — нет. - Проверьте циклы агентов на поведение «один вызов инструмента за ход» и добавьте инструкцию по пакетной обработке.
- Если ваш интерфейс отображает текст о ходе выполнения между вызовами инструментов, установите
thinking.displayв"updates"(бета) или"summarized"и запрашивайте обновления в подсказке. - Если вы меняете effort между запросами, перенесите изменение в сообщение
role: "system"с effort для отдельного сообщения (бета), чтобы сохранить попадания в кэш. - Обрабатывайте
stop_reason: "refusal"и читайтеstop_details.category. Рассмотритеfallbacks: "default"(бета). - Заново оцените
effortс помощью нового перебора значений, начиная сhigh, и заново определите базовые показатели стоимости и задержки на ваших собственных рабочих нагрузках. Количество токенов примерно не изменилось. Чтение из кэша подсказок стоит четверть от тарифа Claude Fable 5.
Миграция на Claude Fable 5.1 с Claude Opus 5
Claude Fable 5.1 использует те же паттерны Messages API и использования инструментов, что и Claude Opus 5. Он сохраняет контекстное окно в 1M токенов по умолчанию, 128k максимальных выходных токенов, минимум в 512 токенов для кэширования подсказок и поддержку системных сообщений в середине разговора. Ограничение на предзаполнение, ограничение на параметры сэмплирования и значение по умолчанию "omitted" для thinking.display также переносятся. Примените всё из раздела Миграция на Claude Fable 5.1 с Claude Fable 5, а также следующее.
Обновите имя модели
model = "claude-opus-5" # Before
model = "claude-fable-5-1" # After
# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5-1" # AfterЧто изменилось
-
Мышление больше нельзя отключить: Claude Opus 5 принимает
thinking: {type: "disabled"}на уровне efforthighили ниже. Наclaude-fable-5-1иclaude-mythos-5-1адаптивное мышление всегда включено, иthinking: {type: "disabled"}возвращает ошибку 400 на любом уровне effort. Удалите это поле, управляйте расходом токенов с помощью более низких уровней effort и пересмотритеmax_tokensдля рабочих нагрузок, которые выполнялись с отключённым мышлением. -
Принудительный выбор инструмента не поддерживается: Claude Opus 5 принимает
tool_choiceanyиtool.claude-fable-5-1возвращает ошибку 400. См. Критические изменения. -
Сохранённое мышление между моделями: Claude Fable 5.1 читает блоки мышления Claude Opus 5: разговоры, переходящие с
claude-opus-5наclaude-fable-5-1, сохраняют свои рассуждения. Claude Opus 5 не может читать блоки Claude Fable 5.1. Блоки Claude Fable 5.1 также перестают быть действительными при изменении более ранних ходов: если ваш код редактирует более ранние сообщения, пересобираетsystemилиtoolsлибо выполняет сжатие на клиенте между запросами, Claude Opus 5 не возражал, ноclaude-fable-5-1отклоняет или отбрасывает каждый последующий блок мышления. Выполните трёхшаговую проверку из того раздела перед переключением трафика. См. Критические изменения. -
Текст между вызовами инструментов возвращается в блоках мышления: На Claude Opus 5 текст, который модель пишет между вызовами инструментов, возвращается в виде блоков
text. Наclaude-fable-5-1, как и на Claude Fable 5, это повествование возвращается в виде блоковthinkingс обновлениями о ходе выполнения, по одному перед каждым вызовом инструмента. При значенииthinking.displayпо умолчанию"omitted"они не содержат читаемого текста. Если ваш интерфейс отображает это повествование, установитеdisplay: "updates"(бета), чтобы получать обновления о ходе выполнения в виде текста, пока рассуждения остаются скрытыми, или"summarized", чтобы получать и то, и другое. Затем отображайте непустые блокиthinkingмежду блокамиtool_use. См. Обновления о ходе выполнения между вызовами инструментов. -
Классификаторы безопасности и резервная маршрутизация: Claude Fable 5.1 использует классификаторы безопасности, охватывающие те же категории
stop_details, что и Claude Fable 5, — более широкий набор, чем классификаторы Claude Opus 5, ограниченные только кибербезопасностью. Ожидайте значенияstop_details.categoryпомимо"cyber", такие как"bio"и"reasoning_extraction"; полный набор см. в таблице категорий отказов. О конфигурацииfallbacksи разрешённых целевых моделях см. Используйтеfallbacks: "default"для отказов. -
Цены: $10 USD за миллион входных токенов и $50 USD за миллион выходных токенов по сравнению с $5 USD и $25 USD для Claude Opus 5. Чтение из кэша подсказок стоит $0,25 USD за миллион токенов — половина тарифа Claude Opus 5. См. Цены на Claude.
-
Хранение данных: Claude Fable 5.1 и Claude Mythos 5.1 требуют 30-дневного хранения данных, недоступны в рамках соглашений о нулевом хранении данных (ZDR), если это явно не разрешено Anthropic, и обозначены как Covered Models. Claude Opus 5 доступен в рамках ZDR. См. Требования к хранению данных для конкретных моделей.
Контрольный список миграции
- Если у вашей организации есть соглашение о нулевом хранении данных (ZDR), сначала подтвердите право на использование: эти модели недоступны в рамках ZDR, если это явно не разрешено Anthropic. См. Требования к хранению данных для конкретных моделей.
- Обновите имя модели с
claude-opus-5наclaude-fable-5-1(илиclaude-mythos-5-1). - Удалите любую конфигурацию
thinking: {type: "disabled"}: она возвращает ошибку 400 наclaude-fable-5-1. Управляйте расходом токенов с помощью более низких уровней effort и пересмотритеmax_tokens. - Замените принудительный
tool_choice(anyилиtool) наautoвместе с явной инструкцией (ходuserили системное сообщение в середине разговора) и инструментами соstrict: trueлибо на выходные данные в формате JSON. - Если ваш интерфейс отображает текст между вызовами инструментов, установите
display: "updates"(бета) или"summarized"и отображайте непустые блокиthinking. - Примените пункты о сохранённом мышлении, редактировании истории, поведении, effort и резервных вариантах из контрольного списка Claude Fable 5.
- Заново определите базовые показатели стоимости на ваших собственных рабочих нагрузках. Количество токенов примерно не изменилось. Цена за токен отличается.
Миграция на Claude Fable 5.1 с Claude Opus 4.8 или более ранних версий
Сначала примените раздел Миграция на Claude Mythos 5 и Claude Fable 5 с Claude Opus 4.8 для изменений на уровне API относительно Claude Opus 4.8. Он охватывает адаптивное мышление, вывод мышления, отказы, effort, минимум для кэширования, цены и хранение данных. Затем примените оставшуюся разницу из раздела Миграция на Claude Fable 5.1 с Claude Fable 5. На Claude Opus 4.7 или более ранних версиях начните с соответствующего раздела Миграция на Claude Opus 5.
Обновите имя модели
model = "claude-opus-4-8" # Before
model = "claude-fable-5-1" # After
# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5-1" # AfterКонтрольный список миграции
- Если у вашей организации есть соглашение о нулевом хранении данных (ZDR), сначала подтвердите право на использование: эти модели недоступны в рамках ZDR, если это явно не разрешено Anthropic. Claude Opus 4.8 доступен в рамках ZDR.
- Обновите имя модели с
claude-opus-4-8наclaude-fable-5-1(илиclaude-mythos-5-1). - Удалите любую конфигурацию
thinking: {type: "disabled"}и пересмотритеmax_tokens. Запросы без поляthinkingвыполняются с адаптивным мышлением. - Замените принудительный
tool_choice(anyилиtool) наautoвместе с явной инструкцией (ходuserили системное сообщение в середине разговора) и инструментами соstrict: trueлибо на выходные данные в формате JSON. - Передавайте блоки
thinkingобратно без изменений и рассматривайте их текст как предназначенный только для отображения. Claude Fable 5.1 читает блоки мышления Claude Opus 4.8: разговор, который переходит наclaude-fable-5-1, сохраняет свои более ранние рассуждения. Claude Opus 4.8 не может читать блоки Claude Fable 5.1. - Если ваш код сам формирует массив
messages, проверьте, не редактирует ли он более ранние ходы. Интеграции, написанные для Claude Opus 4.8 и более ранних версий, часто обрезают старые ходы, удаляют или пересобирают более ранние сообщения либо обновляют подсказкуsystemпри каждом запросе, и Claude Opus 4.8 никогда не возражал. Наclaude-fable-5-1каждое из этих действий делает недействительными последующие блоки мышления. - Обрабатывайте
stop_reason: "refusal", читайтеstop_details.categoryи рассмотритеfallbacks: "default"(бета). - Примените пункты о сохранённом мышлении, редактировании истории, поведении, effort для отдельного сообщения и обновлениях о ходе выполнения из контрольного списка Claude Fable 5.
- Заново оцените
effort(начните сhigh), проверьте подсказки, близкие к минимуму в 512 токенов для кэширования, и заново определите базовые показатели стоимости и задержки. Цена за токен отличается.
Миграция на Claude Mythos 5.1 с Claude Mythos 5
Claude Mythos 5.1 — это аналог Claude Fable 5.1 с ограниченным доступом. Подтвердите доступ вашей организации у вашей команды по работе с клиентами Anthropic перед переключением идентификаторов моделей.
Разница на уровне API совпадает с разделом Миграция на Claude Fable 5.1 с Claude Fable 5: принудительный выбор инструмента возвращает ошибку 400, а блоки мышления сохраняются только для модели, которая их создала, или более новой (Claude Mythos 5.1 читает блоки Claude Mythos 5, но не наоборот). В отличие от Claude Fable 5.1, Claude Mythos 5.1 не выполняет проверку разговора, поэтому редактирование более ранних ходов не делает блоки мышления недействительными, хотя по-прежнему сбрасывает кэш подсказок.
Обновите имя модели
model = "claude-mythos-5" # Before
model = "claude-mythos-5-1" # AfterКонтрольный список миграции
- Обновите имя модели с
claude-mythos-5наclaude-mythos-5-1. - Замените принудительный
tool_choice(anyилиtool) наautoвместе с явной инструкцией (ходuserили системное сообщение в середине разговора) и инструментами соstrict: trueлибо на выходные данные в формате JSON. - Обрабатывайте
stop_reason: "refusal"и читайтеstop_details.categoryперед содержимым ответа. См. Отказы и резервные варианты. - Продолжайте передавать блоки
thinkingобратно без изменений на каждом ходе, включая пустые. - Если ваш код сам формирует массив
messages, сохраняйте историю разговора только с добавлением в конец, чтобы кэш подсказок оставался прогретым. Claude Mythos 5.1 не выполняет проверку разговора, поэтому правки не делают его блоки мышления недействительными. - Примените изменения поведения и рекомендуемые изменения из раздела о Claude Fable 5, за исключением пунктов о редактировании истории, которые не применяются к Claude Mythos 5.1.
- Заново оцените
effortс помощью нового перебора значений и заново определите базовые показатели стоимости и задержки. Чтение из кэша подсказок стоит четверть от тарифа Claude Mythos 5.
Was this page helpful?