Это руководство охватывает миграцию кода Messages API. Если вы используете Claude Managed Agents, никаких изменений, кроме обновления имени модели, не требуется.
Автоматизируйте миграцию с помощью навыка Claude API. В Claude Code выполните /claude-api migrate, чтобы вызвать встроенный навык Claude API. Он работает для любой целевой модели на этой странице:
/claude-api migrate this project to claude-opus-5Навык применяет замену идентификатора модели и, при необходимости, критические изменения параметров, замену предзаполнения и калибровку усилия для вашей целевой модели по всей кодовой базе, а затем создает контрольный список элементов для ручной проверки. Он просит вас подтвердить область миграции (весь рабочий каталог, подкаталог или конкретный список файлов) перед редактированием каких-либо файлов. Навык также обнаруживает клиентов Amazon Bedrock и Claude Platform на AWS и корректирует форматы идентификаторов моделей и изменения функций для этих платформ.
Claude Fable 5 — самая мощная широко выпущенная модель Anthropic, общедоступная в Claude API, Amazon Bedrock, Claude Platform на AWS, Google Cloud и Microsoft Foundry. Claude Mythos 5 обладает теми же возможностями и предлагается с ограниченной доступностью одобренным клиентам в Project Glasswing.
Базовые настройки, общие для claude-fable-5 и claude-mythos-5:
thinking не требуется. Как thinking: {type: "disabled"}, так и ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) возвращают ошибку 400.invalid_request_error. Организациям с соглашением ZDR следует связаться со своей командой по работе с клиентами Anthropic для обсуждения конфигурации хранения данных. В качестве альтернативы вы можете настроить хранение данных для каждого рабочего пространства. См. Требования к хранению данных для конкретных моделей для подробностей по каждой платформе.В чем две модели различаются:
stop_reason: "refusal". Claude Mythos 5 не включает эти классификаторы. См. Отказы и резервные модели.Claude Mythos 5 — это преемник с ограниченным доступом Claude Mythos Preview, исследовательской предварительной версии, доступной только по приглашению. Claude Fable 5 — это общедоступная модель с теми же возможностями, и изменения в этом разделе в равной степени применимы к обеим целевым моделям.
Миграция в основном не требует изменений. Claude Mythos 5 и Claude Fable 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Mythos Preview, а количество токенов практически не меняется, поскольку все три модели используют один и тот же токенизатор. Ключевые изменения, которые нужно проверить, — это функции, которые больше не доступны (перечислены в следующем разделе), и вывод мышления. Если вы мигрируете на Claude Fable 5, также запланируйте обработку отказов классификаторов безопасности, которых нет у Claude Mythos Preview и Claude Mythos 5; см. Отказы и резервные модели.
График вывода из эксплуатации Claude Mythos Preview см. в разделе Устаревание моделей.
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# Или, для общедоступной модели с теми же возможностями:
model = "claude-fable-5" # AfterРасширенное мышление и бюджеты токенов мышления: Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается на claude-mythos-5 или claude-fable-5 и возвращает ошибку 400. Адаптивное мышление всегда включено: модель сама определяет, когда и сколько думать при каждом запросе, и конфигурация thinking не требуется. thinking: {type: "disabled"} возвращает ошибку. У budget_tokens нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.
До (Claude Mythos Preview):
client.messages.create(
model="claude-mythos-preview",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)После (Claude Mythos 5):
client.messages.create(
model="claude-mythos-5",
max_tokens=16000,
messages=[{"role": "user", "content": "..."}],
)Изменение для Claude Fable 5 идентично, с claude-fable-5 в качестве имени модели.
Предзаполнение ассистента: Предзаполнение сообщения ассистента не поддерживается на claude-mythos-5 или claude-fable-5 и возвращает ошибку 400, так же как и на Claude Mythos Preview. Вместо этого используйте инструкции в системной подсказке.
Вывод мышления: На claude-mythos-5 и claude-fable-5 необработанная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый обобщенный текст, когда thinking.display установлен в summarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления на Claude Fable 5 и Claude Mythos 5.
claude-mythos-5 и claude-fable-5 используют тот же токенизатор, что и claude-mythos-preview (токенизатор, представленный с Claude Opus 4.7). Количество токенов практически не меняется при миграции с claude-mythos-preview. По сравнению с моделями до Claude Opus 4.7 тот же контент может токенизироваться примерно в 30% больше токенов, в зависимости от контента и характера рабочей нагрузки.
/v1/messages/count_tokens возвращает практически неизменные значения для claude-mythos-5 и claude-fable-5 по сравнению с claude-mythos-preview. Заново оцените стоимость и задержку на ваших собственных рабочих нагрузках.
claude-mythos-preview на claude-mythos-5 или на claude-fable-5 для общедоступной модели.thinking: {type: "enabled", budget_tokens: N}). Адаптивное мышление всегда включено, и поле thinking не требуется.thinking: {type: "disabled"}. Отключение мышления возвращает ошибку на claude-mythos-5 и claude-fable-5.budget_tokens. У него нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.thinking, рассматривает его только как отображаемый текст и передает блоки мышления обратно без изменений при продолжении на той же модели. thinking.display по умолчанию равен "omitted" на claude-mythos-5 и claude-fable-5, так же как и на Claude Mythos Preview; установите display: "summarized", чтобы получать читаемые сводки. См. Вывод мышления на Claude Fable 5 и Claude Mythos 5.thinking и redacted_thinking из предыдущих ходов ассистента. Блоки мышления от claude-mythos-5 и claude-fable-5 привязаны к модели, которая их создала, и модели, отличные от Claude Fable 5 и Claude Mythos 5, молча их игнорируют. Удаление делает межмодельные запросы минимальными и единообразными.stop_reason: "refusal" и читайте поле stop_details.category. Claude Fable 5 использует классификаторы безопасности, которых нет у Claude Mythos Preview и Claude Mythos 5. См. Отказы и резервные модели.claude-mythos-preview.Claude Fable 5 и Claude Mythos 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Opus 5, с тем же контекстным окном в 1M токенов по умолчанию и тем же максимумом в 128k выходных токенов. Ограничения на предзаполнение и параметры сэмплирования, а также поведение отображения мышления переносятся с Claude Opus 5 без изменений. Изменения, которые нужно проверить, — это всегда включенное мышление, цены, Priority Tier и хранение данных.
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5" # AfterМышление больше нельзя отключить: На Claude Opus 5 мышление включено по умолчанию и может быть отключено с помощью thinking: {type: "disabled"} при уровне effort high или ниже. На claude-fable-5 и claude-mythos-5 адаптивное мышление всегда включено, и thinking: {type: "disabled"} возвращает ошибку 400 при любом уровне effort. Удалите конфигурацию thinking: {type: "disabled"} и вместо этого используйте более низкие уровни effort для контроля расхода токенов.
Цены: Claude Fable 5 и Claude Mythos 5 стоят $10 USD за миллион входных токенов и $50 USD за миллион выходных токенов по сравнению с $5 USD и $25 USD для Claude Opus 5. См. Цены Claude.
Priority Tier: Priority Tier не поддерживается на Claude Opus 5, поэтому существующий трафик не затрагивается. Если у вашей организации есть обязательство Priority Tier, Claude Fable 5 его поддерживает; Claude Mythos 5 — нет.
Хранение данных: Claude Fable 5 и Claude Mythos 5 требуют 30-дневного хранения данных и недоступны в рамках соглашений о нулевом хранении данных (ZDR); обе обозначены как Covered Models. См. Требования к хранению данных для конкретных моделей.
claude-opus-5 на claude-fable-5 (или claude-mythos-5).thinking: {type: "disabled"}; она возвращает ошибку 400 на claude-fable-5 и claude-mythos-5. Вместо этого используйте более низкие уровни effort для контроля расхода токенов и пересмотрите max_tokens для рабочих нагрузок, которые выполнялись с отключенным мышлением на Claude Opus 5.Если ваш код работает на Claude Opus 4.7 или более ранней версии, сначала примените соответствующий подраздел Миграция на Claude Opus 5 для изменений на уровне API с вашей текущей модели, а затем оставшуюся разницу из этого раздела.
Миграция в основном не требует изменений. Claude Fable 5 и Claude Mythos 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Opus 4.8, с тем же контекстным окном в 1M токенов по умолчанию и тем же максимумом в 128k выходных токенов. Количество токенов практически не меняется, поскольку модели используют один и тот же токенизатор. Ключевые изменения, которые нужно проверить, — это всегда включенное адаптивное мышление, вывод мышления, отказы классификаторов безопасности (только Claude Fable 5) и цены.
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# Или, для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5" # AfterПункты в этом разделе описывают различия в API и поведении, которые стоит проверить после замены идентификатора модели. Если не указано иное, они в равной степени применимы к claude-fable-5 и claude-mythos-5.
Адаптивное мышление всегда включено: Адаптивное мышление — единственный режим мышления на claude-fable-5 и claude-mythos-5. Модель сама определяет, когда и сколько думать при каждом запросе, и конфигурация thinking не требуется. thinking: {type: "disabled"} возвращает ошибку. Используйте параметр effort для управления глубиной мышления.
Изменение поведения, которое нужно проверить: на Claude Opus 4.8 запросы без поля thinking выполняются без мышления; на claude-fable-5 и claude-mythos-5 те же запросы выполняются с адаптивным мышлением. max_tokens остается жестким ограничением на общий вывод, мышление плюс текст ответа, поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления на Claude Opus 4.8. См. Контроль затрат.
До (Claude Opus 4.8):
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)После (Claude Fable 5):
client.messages.create(
model="claude-fable-5",
max_tokens=16000,
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)Изменение для Claude Mythos 5 идентично, с claude-mythos-5 в качестве имени модели.
Расширенное мышление и бюджеты мышления (без изменений): Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается на claude-fable-5 или claude-mythos-5 и возвращает ошибку 400, так же как и на Claude Opus 4.8. У budget_tokens нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.
Предзаполнение ассистента (без изменений): Предзаполнение сообщения ассистента не поддерживается на claude-fable-5 или claude-mythos-5 и возвращает ошибку 400, так же как и на Claude Opus 4.8. Вместо этого используйте инструкции в системной подсказке.
Вывод мышления: На claude-fable-5 и claude-mythos-5 необработанная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый обобщенный текст, когда thinking.display установлен в summarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления на Claude Fable 5 и Claude Mythos 5.
Классификаторы безопасности и причина остановки refusal (только Claude Fable 5): claude-fable-5 использует классификаторы безопасности для запросов и во время генерации ответа. Claude Mythos 5 не включает эти классификаторы. Когда классификатор отклоняет запрос, Messages API возвращает stop_reason: "refusal" как успешный ответ HTTP 200, а не ошибку. Поле stop_details.category сообщает, какой классификатор сработал, с категориями, такими как "cyber", "bio" и "reasoning_extraction", или null, когда отказ не соответствует ни одной именованной категории. Полный набор см. в таблице категорий отказов.
Вам не выставляется счет за входные токены запроса, отклоненного до генерации какого-либо вывода. Когда классификатор срабатывает в середине потока, входные данные и уже переданный вывод оплачиваются; отбросьте частичный вывод.
Чтобы автоматически повторно выполнять отклоненные запросы на другой модели, передайте опциональный параметр fallbacks, который находится в бета-версии в Claude API. Параметр недоступен в Message Batches API или на Amazon Bedrock, Google Cloud и Microsoft Foundry; на этих трех платформах выполняйте повтор на стороне клиента или используйте промежуточное ПО SDK для резервной обработки отказов. См. Отказы и резервные модели.
Начинайте с усилия high: Значение по умолчанию параметра effort остается high. На Claude Opus 4.8 рекомендация для кодирования и работы с высокой автономностью — явно устанавливать xhigh. На claude-fable-5 и claude-mythos-5 используйте high по умолчанию для большинства задач и оставьте xhigh для наиболее чувствительных к возможностям рабочих нагрузок. Более низкие настройки усилия по-прежнему работают хорошо и часто превосходят производительность xhigh на предыдущих моделях. Уменьшите усилие, если задача выполняется, но занимает больше времени, чем необходимо. См. Подсказки для Claude Fable 5.
Более низкий минимум для кэширования подсказок: Минимальная длина кэшируемой подсказки на claude-fable-5 и claude-mythos-5 составляет 512 токенов, что ниже 1 024 токенов на Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования на Claude Opus 4.8, теперь могут создавать записи кэша без каких-либо изменений кода. Минимумы для каждой модели см. в разделе Кэширование подсказок.
claude-fable-5 и claude-mythos-5 требуют 30-дневного хранения данных; в Claude API запросы к claude-fable-5, не соответствующие этому требованию, возвращают ошибку 400 invalid_request_error. Claude Opus 4.8 остается доступной в рамках ZDR. См. Требования к хранению данных для конкретных моделей.claude-opus-4-8 на claude-fable-5 (или claude-mythos-5).thinking: {type: "disabled"}. Отключение мышления возвращает ошибку на claude-fable-5 и claude-mythos-5, а запросы без поля thinking выполняются с адаптивным мышлением.claude-fable-5 и claude-mythos-5.thinking, рассматривает его только как отображаемый текст и передает блоки мышления обратно без изменений при продолжении на той же модели. thinking.display по умолчанию равен "omitted" на claude-fable-5 и claude-mythos-5, так же как и на Claude Opus 4.8; установите display: "summarized", чтобы получать читаемые сводки. См. Вывод мышления на Claude Fable 5 и Claude Mythos 5.thinking и redacted_thinking из предыдущих ходов ассистента. Блоки мышления от claude-fable-5 и claude-mythos-5 привязаны к модели, которая их создала, и модели, отличные от Claude Fable 5 и Claude Mythos 5, молча их игнорируют. Удаление делает межмодельные запросы минимальными и единообразными. Исключение — погашение резервного кредита, которое требует, чтобы тело запроса было воспроизведено в соответствии с точными правилами этой функции.stop_reason: "refusal" и читайте поле stop_details.category. Чтобы автоматически повторно выполнять отклоненные запросы на другой модели, рассмотрите опциональный параметр fallbacks (бета). См. Отказы и резервные модели.effort. Начинайте с high для большинства задач, включая рабочие нагрузки, которые выполнялись на xhigh на Claude Opus 4.8.claude-opus-4-8; цена за токен отличается.Claude Opus 5 — это качественный скачок по сравнению с Claude Opus 4.8, сильный в глубоком рассуждении, агентных и долгосрочных задачах, а также в масштабировании вычислений во время тестирования. Поведенческие различия и специфичные для модели паттерны подсказок см. в разделе Подсказки для Claude Opus 5.
Claude Opus 5 — это прямая замена Claude Opus 4.8 по той же цене $5 за миллион входных токенов и $25 за миллион выходных токенов; см. Цены Claude. Есть два критических изменения для кода, уже работающего на Claude Opus 4.8, описанных ниже в разделе «Критические изменения». Claude Opus 5 поддерживает тот же набор функций, что и Claude Opus 4.8, включая контекстное окно в 1M токенов (по умолчанию, без бета-заголовка), максимум 128k выходных токенов, адаптивное мышление, кэширование подсказок, пакетную обработку, Files API, поддержку PDF, зрение, а также серверные и клиентские инструменты, с двумя исключениями: web fetch недоступен на Claude Opus 5, и Priority Tier не поддерживается на Claude Opus 5. Доступность для каждой модели см. на странице каждого инструмента.
Этот раздел охватывает только разницу с Claude Opus 4.8. Если ваш код работает на Claude Opus 4.7 или более ранней версии, используйте вместо этого разделы ниже: Миграция на Claude Opus 5 с Claude Opus 4.7 или Миграция на Claude Opus 5 с Claude Opus 4.6 и более ранних моделей Opus. Они включают эту разницу плюс критические изменения от более ранних моделей (отклонение параметров сэмплирования, отклонение ручного расширенного мышления, удаление предзаполнения, новый токенизатор).
# Миграция на Opus
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # Afterclaude-opus-5 — это фиксированный идентификатор модели без суффикса даты, по той же схеме, что и claude-opus-4-8 и claude-sonnet-5.
Мышление включено по умолчанию: На Claude Opus 4.8 запросы без поля thinking выполняются без мышления; на Claude Opus 5 те же запросы выполняются с адаптивным мышлением. max_tokens остается жестким ограничением на общий вывод, мышление плюс текст ответа, поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления на Claude Opus 4.8. Чтобы сохранить старое поведение, передайте thinking: {type: "disabled"}, с учетом ограничения на effort из следующего пункта; обратите внимание, что при отключенном мышлении модель может иногда выдавать вызовы инструментов как обычный текст или включать внутренние XML-теги в видимый вывод, поэтому предпочитайте более низкие уровни effort с включенным мышлением там, где это возможно, и см. Работа с отключенным мышлением для мер смягчения там, где это невозможно.
Отключение мышления ограничено усилием high: Вы по-прежнему можете отключить мышление с помощью thinking: {type: "disabled"}, но только при уровне effort high или ниже. Запрос, который сочетает thinking: {type: "disabled"} с effort xhigh или max, возвращает ошибку 400. Claude Opus 4.8 принимает эту комбинацию, поэтому проверьте запросы, отключающие мышление, перед миграцией.
Проверка выполняется для каждого запроса: конфигурация effort и thinking каждого запроса проверяется независимо, поэтому запрос, который повышает effort до xhigh или max при отключенном мышлении, отклоняется, даже если более ранние запросы в разговоре были приняты.
До (принимается на Claude Opus 4.8, отклоняется на Claude Opus 5):
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "disabled"},
output_config={"effort": "xhigh"},
messages=[{"role": "user", "content": "..."}],
)После (Claude Opus 5), либо удалите поле thinking, чтобы снова включить мышление:
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
output_config={"effort": "xhigh"}, # thinking is on by default
messages=[{"role": "user", "content": "..."}],
)либо оставьте мышление отключенным и понизьте effort:
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
thinking={"type": "disabled"},
output_config={"effort": "high"}, # or "medium", "low"
messages=[{"role": "user", "content": "..."}],
)Они не обязательны, но улучшат ваш опыт:
Протестируйте усилие max для работы, критичной к возможностям: Claude Opus 5 поддерживает полный набор уровней effort (low, medium, high, xhigh, max). Там, где максимальные возможности важнее расхода токенов, протестируйте усилие max. Оно может дать выигрыш на самых требовательных задачах, но может показывать убывающую отдачу от увеличенного использования токенов и быть склонным к чрезмерному обдумыванию на более простых. Если вы работаете с усилием xhigh или max, установите большой max_tokens, чтобы у модели было пространство для размышлений и действий; начните с 64k токенов и настраивайте оттуда.
Рассмотрите автоматические резервные модели: Claude Opus 5 поставляется с классификаторами безопасности в области кибербезопасности, чьи отказы категории cyber могут переключаться на Claude Opus 4.8. Чтобы автоматически повторно выполнять отклоненные запросы на другой модели, рассмотрите параметр fallbacks с режимом "default" (fallbacks: "default"), который выбирает рекомендуемую резервную модель на основе категории отказа вместо вручную поддерживаемого списка моделей. Серверная резервная обработка находится в бета-версии; режим "default" требует бета-заголовка server-side-fallback-2026-07-01. См. Отказы и резервные модели.
Кэшируйте более короткие подсказки: Минимальная длина кэшируемой подсказки на Claude Opus 5 составляет 512 токенов, по сравнению с 1 024 токенами на Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования на Claude Opus 4.8, теперь могут создавать записи кэша без каких-либо изменений кода. Минимумы для каждой модели см. в разделе Кэширование подсказок.
Изменяйте инструменты в середине разговора (бета): Вы можете добавлять или удалять инструменты между ходами разговора без инвалидации попаданий в кэш подсказок на предыдущих ходах. Отправьте бета-заголовок mid-conversation-tool-changes-2026-07-01. Это полезно для агентных рабочих нагрузок, которые постепенно раскрывают инструменты или убирают их по мере продвижения задачи; без этого измененный список инструментов инвалидирует кэшированный префикс.
Перенастройте подсказки для длины и многословности: Видимые ответы по умолчанию и письменные результаты на Claude Opus 5 длиннее, чем на Claude Opus 4.8, а снижение effort уменьшает объем мышления, не сокращая надежно видимый ответ. Вместо этого явно указывайте в подсказке краткость или целевую длину. См. Длина ответа и многословность и Длина письменных результатов.
Удалите перенесенные инструкции по проверке и ограничьте область задачи: Claude Opus 5 проверяет свою работу без указаний, поэтому удалите явные инструкции по проверке или самопроверке, перенесенные из подсказок, настроенных для более ранних моделей; их сохранение приводит к чрезмерной проверке. Для узких задач явно ограничивайте область задачи. В многоагентных фреймворках давайте явные указания о том, какие сценарии требуют делегирования, или ограничивайте количество субагентов, поскольку Claude Opus 5 делегирует охотнее, чем более ранние модели. См. Область задачи и чрезмерная проверка и Управление порождением субагентов.
claude-opus-4-8 на claude-opus-5.thinking: на Claude Opus 5 они выполняются с мышлением. Пересмотрите max_tokens, который остается жестким ограничением на общий вывод (мышление плюс текст ответа), или передайте thinking: {type: "disabled"} при effort high или ниже, чтобы сохранить старое поведение. Если вы отключаете мышление, ознакомьтесь с разделом Работа с отключенным мышлением для артефактов вывода, которые могут появиться, и мер их смягчения через подсказки.thinking: {type: "disabled"} с effort xhigh или max возвращает ошибку 400, проверяемую для каждого запроса. Снова включите мышление или понизьте effort до high или ниже.effort: проведите свежий перебор effort на ваших собственных оценках, а не переносите настройку, подобранную для более ранней модели. Усилия low и medium стоит протестировать как средства контроля стоимости и задержки, а усилие max — там, где максимальные возможности важнее расхода токенов. Если вы работаете с усилием xhigh или max, увеличьте max_tokens как минимум до 64k в качестве отправной точки.stop_reason: "refusal" и рассмотрите fallbacks: "default" (бета) для автоматического повторного выполнения отклоненных запросов на рекомендуемой резервной модели.Claude Opus 5 должен демонстрировать высокую производительность «из коробки» на существующих подсказках и оценках Claude Opus 4.7 при той же цене: $5 за миллион входных токенов и $25 за миллион выходных токенов. Он поддерживает тот же набор функций, что и Claude Opus 4.7, включая контекстное окно в 1M токенов, максимум 128k выходных токенов, адаптивное мышление, кэширование подсказок, пакетную обработку, Files API, поддержку PDF, зрение, а также серверные и клиентские инструменты, с двумя исключениями: web fetch недоступен на Claude Opus 5, и Priority Tier не поддерживается на Claude Opus 5. Он также добавляет системные сообщения в середине разговора и публично документирует детали остановки при отказе.
Если ваш код работает на Claude Opus 4.6 или более ранней версии, используйте вместо этого Миграция на Claude Opus 5 с Claude Opus 4.6 и более ранних моделей Opus. Этот раздел включает критические изменения (отклонение параметров сэмплирования, отклонение ручного расширенного мышления, новый токенизатор), которые не охватываются обновлением только с Claude Opus 4.7.
# Миграция на Opus
model = "claude-opus-4-7" # Before
model = "claude-opus-5" # AfterМышление включено по умолчанию: На Claude Opus 4.7 запросы без поля thinking выполняются без мышления; на Claude Opus 5 те же запросы выполняются с адаптивным мышлением. max_tokens остаётся жёстким ограничением на общий вывод — мышление плюс текст ответа, — поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления на Claude Opus 4.7. Чтобы сохранить прежнее поведение, передайте thinking: {type: "disabled"}, с учётом ограничения на уровень усилий, описанного в следующем пункте; обратите внимание, что при отключённом мышлении модель может иногда выдавать вызовы инструментов в виде обычного текста или включать внутренние XML-теги в видимый вывод, поэтому предпочитайте более низкие уровни усилий с включённым мышлением там, где это возможно, и см. Работа с отключённым мышлением для мер смягчения там, где это невозможно.
Отключение мышления ограничено уровнем усилий high: Вы можете отключить мышление с помощью thinking: {type: "disabled"}, но только при уровне effort high или ниже. Запрос, который сочетает thinking: {type: "disabled"} с уровнем усилий xhigh или max, возвращает ошибку 400. Claude Opus 4.7 принимает эту комбинацию, поэтому проверьте запросы, отключающие мышление, перед миграцией.
Проверка выполняется для каждого запроса: конфигурация усилий и мышления каждого запроса проверяется независимо, поэтому запрос, который повышает уровень усилий до xhigh или max при отключённом мышлении, отклоняется, даже если более ранние запросы в разговоре были приняты.
До (принимается на Claude Opus 4.7, отклоняется на Claude Opus 5):
client.messages.create(
model="claude-opus-4-7",
max_tokens=16000,
thinking={"type": "disabled"},
output_config={"effort": "xhigh"},
messages=[{"role": "user", "content": "..."}],
)После (Claude Opus 5) — либо удалите поле thinking, чтобы выполнять запросы с мышлением:
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
output_config={"effort": "xhigh"}, # thinking is on by default
messages=[{"role": "user", "content": "..."}],
)либо оставьте мышление отключённым и понизьте уровень усилий:
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
thinking={"type": "disabled"},
output_config={"effort": "high"}, # or "medium", "low"
messages=[{"role": "user", "content": "..."}],
)Следующие пункты не являются критическими изменениями; они описывают различия в поведении, которые стоит проверить после замены идентификатора модели.
Параметры сэмплирования (без изменений): Установка temperature, top_p или top_k в значение, отличное от значения по умолчанию, возвращает ошибку 400 на Claude Opus 5, так же как и на Claude Opus 4.7. Типы запросов SDK по-прежнему определяют эти поля для совместимости с более ранними моделями, поэтому код, который их устанавливает, проходит проверку типов, но API отклоняет запрос на стороне сервера. Если вы удалили эти параметры при миграции на Opus 4.7, дальнейшие изменения не требуются.
Уровень усилий по умолчанию — high: Значение по умолчанию параметра effort на Claude Opus 5 — high в Claude API и Claude Code. Если вы уже задаёте уровень усилий явно, ваша настройка не изменится.
Уровни усилий перекалиброваны: Распределение токенов для каждого уровня усилий на Claude Opus 5 изменилось по сравнению с Claude Opus 4.7, и Claude Opus 5 поддерживает полный набор уровней усилий (low, medium, high, xhigh, max). Проведите новый перебор уровней усилий на ваших собственных оценках, вместо того чтобы переносить настройку, подобранную для Claude Opus 4.7. Уровни low и medium стоит протестировать как средства контроля стоимости и задержки, а уровень max — там, где максимальные возможности важнее расхода токенов. Если вы работаете на уровне усилий xhigh или max, установите большое значение max_tokens, чтобы у модели было пространство для размышлений и действий; начните с 64k токенов и настраивайте дальше. См. Effort.
Контекстное окно в 1M — значение по умолчанию: Claude Opus 5 предоставляет полное контекстное окно в 1M токенов по умолчанию без бета-заголовка и без надбавки за длинный контекст. Если ваш клиент передаёт бета-заголовок контекстного окна для совместимости со старыми моделями, вы можете удалить его на Claude Opus 5.
Системные сообщения в середине разговора: Claude Opus 5 принимает сообщения role: "system" сразу после хода пользователя в массиве messages (с учётом правил размещения). Используйте поле system верхнего уровня для инструкций, которые применяются с самого начала. Claude Opus 4.7 отклоняет role: "system" в messages с ошибкой 400. Если вы поддерживаете пути кода, которые перестраивают всю историю сообщений для обновления инструкций, вы можете упростить их и сохранить попадания в кэш подсказок на более ранних ходах.
Детали остановки при отказе: Объект stop_details в ответах с отказом (доступен начиная с Claude Opus 4.7) теперь публично задокументирован. Когда модель отклоняет запрос, она указывает категорию отказа в дополнение к существующей причине остановки refusal. Бета-заголовок не требуется, и отказаться от этой функции нельзя. См. Обработка причин остановки.
Более низкий минимум для кэширования подсказок: Минимальная длина кэшируемой подсказки на Claude Opus 5 составляет 512 токенов, что ниже, чем на Claude Opus 4.7. Подсказки, которые были слишком короткими для кэширования на Claude Opus 4.7, теперь могут создавать записи в кэше без каких-либо изменений в коде. См. Кэширование подсказок для минимумов по каждой модели.
Они не обязательны, но улучшат ваш опыт:
Рассмотрите автоматические резервные модели: Claude Opus 5 поставляется с классификаторами безопасности в области кибербезопасности, отказы которых по киберкатегориям могут переключаться на Claude Opus 4.8. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, рассмотрите параметр fallbacks с режимом "default" (fallbacks: "default"), который выбирает рекомендуемую резервную модель на основе категории отказа вместо вручную поддерживаемого списка моделей. Серверный резервный механизм находится в бета-версии; режим "default" требует бета-заголовка server-side-fallback-2026-07-01. См. Отказы и резервные модели.
Изменение инструментов в середине разговора (бета): Вы можете добавлять или удалять инструменты между ходами разговора без инвалидации попаданий в кэш подсказок на более ранних ходах. Отправьте бета-заголовок mid-conversation-tool-changes-2026-07-01. Это полезно для агентных рабочих нагрузок, которые раскрывают инструменты постепенно или убирают их по мере продвижения задачи; без этого изменённый список инструментов инвалидирует кэшированный префикс.
Перенастройте подсказки, касающиеся длины и многословности: Видимые ответы и письменные результаты по умолчанию получаются длиннее на Claude Opus 5, чем на более ранних моделях Opus, а снижение уровня усилий уменьшает объём мышления, но не гарантирует сокращения видимого ответа. Вместо этого явно указывайте в подсказке требование лаконичности или целевую длину. См. Длина ответа и многословность и Длина письменных результатов.
Удалите перенесённые инструкции по проверке и ограничьте область задачи: Claude Opus 5 проверяет свою работу без дополнительных указаний, поэтому удалите явные инструкции по проверке или самопроверке, перенесённые из подсказок, настроенных для более ранних моделей; их сохранение приводит к избыточной проверке. Для узких задач явно ограничивайте область задачи. В многоагентных фреймворках давайте явные указания о том, какие сценарии требуют делегирования, или ограничивайте количество субагентов, поскольку Claude Opus 5 делегирует охотнее, чем более ранние модели. См. Область задачи и избыточная проверка и Управление порождением субагентов.
claude-opus-4-7 на claude-opus-5 (или обновите псевдонимы).thinking: на Claude Opus 5 они выполняются с мышлением. Пересмотрите max_tokens, который остаётся жёстким ограничением на общий вывод (мышление плюс текст ответа), или передайте thinking: {type: "disabled"} при уровне усилий high или ниже, чтобы сохранить прежнее поведение. Если вы отключаете мышление, ознакомьтесь с разделом Работа с отключённым мышлением, чтобы узнать о возможных артефактах вывода и мерах их смягчения с помощью подсказок.thinking: {type: "disabled"} с уровнем усилий xhigh или max возвращает ошибку 400, проверка выполняется для каждого запроса. Снова включите мышление или понизьте уровень усилий до high или ниже.effort: проведите новый перебор уровней effort на ваших собственных оценках, вместо того чтобы переносить настройку, подобранную для Claude Opus 4.7. Протестируйте уровни low и medium как средства контроля стоимости и задержки, а уровень max — там, где максимальные возможности важнее расхода токенов. Если вы работаете на уровне усилий xhigh или max, увеличьте max_tokens как минимум до 64k в качестве отправной точки.stop_details при отказах (доступно начиная с Claude Opus 4.7; теперь публично задокументировано), и рассмотрите fallbacks: "default" (бета) для автоматического повторного выполнения отклонённых запросов на рекомендуемой резервной модели.Claude Opus 5 должен демонстрировать высокую производительность «из коробки» на существующих подсказках и оценках Claude Opus 4.6 при той же цене, но есть несколько поведенческих изменений и изменений API, о которых стоит знать при миграции. Большинство этих изменений вступили в силу в Claude Opus 4.7; ещё два — мышление, включённое по умолчанию, и ограничение уровня усилий при отключении мышления — вступают в силу в Claude Opus 5. Все они описаны ниже, поэтому этот раздел является полным для кода, переходящего напрямую с Claude Opus 4.6. Claude Opus 5 поддерживает тот же набор функций, что и Claude Opus 4.6, включая:
Два исключения: web fetch недоступен в Claude Opus 5, а Priority Tier не поддерживается в Claude Opus 5.
# Миграция на Opus
model = "claude-opus-4-6" # Before
model = "claude-opus-5" # AfterРасширенное мышление удалено: thinking: {type: "enabled", budget_tokens: N} больше не поддерживается в Claude Opus 4.7 и более поздних моделях и возвращает ошибку 400. Переключитесь на адаптивное мышление (thinking: {type: "adaptive"}) и используйте параметр effort для управления глубиной мышления. В Claude Opus 5 адаптивное мышление включено по умолчанию: thinking: {type: "adaptive"} является допустимым и эквивалентно полному отсутствию поля thinking (см. следующий пункт).
До (Claude Opus 4.6):
client.messages.create(
model="claude-opus-4-6",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)После (Claude Opus 5):
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"}, # or "max", "xhigh", "medium", "low"
messages=[{"role": "user", "content": "..."}],
)Адаптивное мышление управляется через подсказки и параметр effort; см. Выбор уровня усилий.
Мышление включено по умолчанию: В Claude Opus 4.6 и Claude Opus 4.7 запросы без поля thinking выполняются без мышления; в Claude Opus 5 те же запросы выполняются с адаптивным мышлением. max_tokens остаётся жёстким ограничением на общий вывод — мышление плюс текст ответа, — поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления. Чтобы сохранить прежнее поведение, передайте thinking: {type: "disabled"} с учётом ограничения уровня усилий из следующего пункта; обратите внимание, что при отключённом мышлении модель может иногда выдавать вызовы инструментов в виде обычного текста или включать внутренние XML-теги в видимый вывод, поэтому по возможности предпочитайте более низкие уровни усилий с включённым мышлением, а там, где это невозможно, см. Работа с отключённым мышлением для способов смягчения.
Отключение мышления ограничено уровнем усилий high: Вы можете отключить мышление с помощью thinking: {type: "disabled"}, но только при уровне effort high или ниже. Запрос, сочетающий thinking: {type: "disabled"} с уровнем усилий xhigh или max, возвращает ошибку 400 в Claude Opus 5, что проверяется для каждого запроса. Перед миграцией проверьте запросы, отключающие мышление: снова включите мышление или понизьте уровень усилий до high или ниже.
Параметры сэмплирования удалены: Установка temperature, top_p или top_k в любое значение, отличное от значения по умолчанию, в Claude Opus 4.7 или более поздних моделях, включая Claude Opus 5, возвращает ошибку 400. Самый безопасный путь миграции — полностью исключить эти параметры из полезной нагрузки запросов. Подсказки — рекомендуемый способ управления поведением модели в Claude Opus 5. Если вы использовали temperature = 0 для детерминизма, обратите внимание, что это никогда не гарантировало идентичные выводы в предыдущих моделях.
Содержимое мышления опускается по умолчанию: Блоки мышления по-прежнему появляются в потоке ответа в Claude Opus 4.7 и более поздних моделях, но их поле thinking пустое, если вы явно не включите его. Это неявное изменение по сравнению с Claude Opus 4.6, где по умолчанию возвращался суммированный текст мышления. Чтобы восстановить суммированное содержимое мышления, установите thinking.display в "summarized":
thinking = {
"type": "adaptive",
"display": "summarized",
}Значение по умолчанию — "omitted" в Claude Opus 4.7 и более поздних моделях. Если ваш продукт передаёт рассуждения пользователям в режиме потоковой передачи, новое значение по умолчанию выглядит как длинная пауза перед началом вывода; установите display: "summarized", чтобы восстановить видимый прогресс во время мышления. Подробности см. в разделе Управление отображением мышления.
Обновлённый подсчёт токенов: Claude Opus 4.7 представил новый токенизатор, который также используют более поздние модели Opus, включая Claude Opus 5. Он способствует улучшению производительности в широком спектре задач и может использовать примерно от 1x до 1,35x больше токенов при обработке текста по сравнению с моделями до Claude Opus 4.7 (до ~35% больше, в зависимости от содержимого).
/v1/messages/count_tokens возвращает другое количество токенов для Claude Opus 5, чем для Claude Opus 4.6. Эффективность использования токенов может варьироваться в зависимости от характера рабочей нагрузки.
Вмешательства через подсказки, task_budget и effort могут помочь контролировать затраты и обеспечить надлежащее использование токенов. Эти средства управления могут снижать интеллект модели. Обновите параметры max_tokens, чтобы обеспечить дополнительный запас, включая триггеры компактизации. Claude Opus 5 предоставляет контекстное окно в 1M по стандартной цене API без надбавки за длинный контекст.
Удаление предзаполнения (перенесено из Opus 4.6): Предзаполнение сообщений ассистента возвращает ошибку 400 в Claude Opus 4.7 и более поздних моделях, включая Claude Opus 5. Вместо этого используйте структурированные выводы, инструкции в системной подсказке или output_config.format.
Параметр effort позволяет настраивать баланс между интеллектом Claude и расходом токенов, жертвуя возможностями ради более высокой скорости и меньших затрат. Claude Opus 5 поддерживает полный набор уровней усилий и по умолчанию использует high. Проведите новый перебор уровней усилий на собственных оценках, а не переносите настройку, подобранную для более ранней модели:
max: Может обеспечить прирост на самых требовательных задачах, но может демонстрировать убывающую отдачу от увеличенного использования токенов и склонен к избыточному обдумыванию на более простых задачах. Тестируйте его там, где максимальные возможности важнее расхода токенов.xhigh: Расширенные возможности для длительной агентной работы и работы с кодом, требующей большей глубины, чем по умолчанию.high: Значение по умолчанию. Балансирует использование токенов и интеллект для большинства задач.medium: Экономичный шаг вниз от значения по умолчанию, стоит протестировать как средство контроля затрат и задержки.low: Наиболее эффективный. Оставьте для коротких, ограниченных задач и рабочих нагрузок, чувствительных к задержке.Если вы работаете с уровнем усилий xhigh или max, установите большое значение max_tokens, чтобы у модели было пространство для мышления и действий; начните с 64k токенов и настраивайте дальше. Уровень усилий важнее для этой модели, чем для любой предыдущей Opus. Активно экспериментируйте с ним при обновлении.
Claude Opus 4.7 представил несколько поведенческих отличий от Claude Opus 4.6, которые не являются критическими изменениями API, но могут потребовать обновления подсказок или удаления вспомогательных конструкций. Они переносятся в Claude Opus 5 с корректировками, указанными ниже.
Длина ответа варьируется в зависимости от сценария использования: Claude Opus 4.7 калибрует длину ответа в соответствии с тем, насколько сложной он считает задачу, вместо того чтобы по умолчанию использовать фиксированную многословность. Обычно это означает более короткие ответы на простые запросы и гораздо более длинные на открытый анализ.
Если ваш продукт зависит от определённого стиля или многословности вывода, вам может потребоваться настроить подсказки. Например, чтобы уменьшить многословность, добавьте: «Provide concise, focused responses. Skip non-essential context, and keep examples minimal.» Если вы видите конкретные виды избыточных объяснений, добавьте целевые инструкции в подсказку, чтобы предотвратить их.
Положительные примеры, показывающие, как Claude может общаться с надлежащим уровнем лаконичности, как правило, более эффективны, чем отрицательные примеры или инструкции, говорящие модели, чего не делать. В Claude Opus 5 видимые ответы по умолчанию и письменные результаты получаются длиннее, чем в более ранних моделях Opus, а снижение уровня усилий уменьшает объём мышления, но не гарантирует сокращения видимого ответа; явно указывайте в подсказке требование лаконичности или целевую длину. См. Длина ответа и многословность.
Более буквальное следование инструкциям: Claude Opus 4.7 интерпретирует подсказки более буквально и явно, чем Claude Opus 4.6, особенно на более низких уровнях усилий. Он не обобщает молча инструкцию с одного элемента на другой и не домысливает запросы, которые вы не делали. Преимущество этой буквальности — точность и меньше лишних действий. Он, как правило, лучше работает для сценариев использования API с тщательно настроенными подсказками, структурированным извлечением и конвейерами, где требуется предсказуемое поведение. Проверка подсказок и обвязки может быть особенно полезна при миграции на Claude Opus 5.
Более прямой тон: Как и с любой новой моделью, стиль прозы в длинных текстах может измениться. Claude Opus 4.7 более прямой и имеет более выраженное мнение, с меньшим количеством одобрительных формулировок и меньшим количеством эмодзи, чем более тёплый стиль Claude Opus 4.6. Если ваш продукт полагается на определённый голос, переоцените стилевые подсказки относительно новой базовой линии.
Встроенные обновления о прогрессе в агентных трассах: Claude Opus 4.7 предоставляет более регулярные и качественные обновления пользователю на протяжении длинных агентных трасс. Если вы добавили вспомогательные конструкции для принудительных промежуточных сообщений о статусе («After every 3 tool calls, summarize progress»), попробуйте удалить их. Если вы обнаружите, что длина или содержание обновлений Claude Opus 4.7 для пользователя плохо откалиброваны для вашего сценария использования, явно опишите в подсказке, как должны выглядеть эти обновления, и приведите примеры.
Изменено порождение субагентов: Claude Opus 4.7, как правило, порождает меньше субагентов по умолчанию, чем Claude Opus 4.6, в то время как Claude Opus 5 делегирует субагентам охотнее, чем более ранние модели. Это поведение управляется через подсказки в обоих направлениях; дайте явные указания о том, когда субагенты желательны, или ограничьте количество субагентов. См. Управление порождением субагентов.
Более строгая калибровка уровня усилий: Существенно отличаясь от Claude Opus 4.6, Claude Opus 4.7 строго соблюдает уровни усилий, особенно на нижнем конце диапазона. На уровнях low и medium модель ограничивает свою работу тем, что было запрошено, а не делает больше, чем требовалось.
Это хорошо для задержки и затрат, но на умеренно сложных задачах, выполняемых с уровнем усилий low, есть некоторый риск недостаточного обдумывания. Если вы наблюдаете поверхностные рассуждения на сложных задачах, повысьте уровень усилий до high или xhigh, вместо того чтобы обходить это подсказками.
Если вам нужно сохранить уровень усилий low ради задержки, добавьте целевое указание: «This task involves multistep reasoning. Think carefully through the problem before responding.» См. Рекомендуемые уровни усилий для Claude Opus 4.7.
Меньше вызовов инструментов по умолчанию: Claude Opus 4.7 имеет тенденцию использовать инструменты реже, чем Claude Opus 4.6, и больше полагаться на рассуждения. В большинстве случаев это даёт лучшие результаты.
Чтобы увеличить использование инструментов, повысьте настройку уровня усилий. Настройки уровня усилий high или xhigh показывают существенно большее использование инструментов в агентном поиске и работе с кодом. Вы также можете скорректировать подсказку, чтобы явно проинструктировать модель о том, когда и как правильно использовать её инструменты.
Защитные механизмы кибербезопасности в реальном времени: Новинка в Claude Opus 4.7: запросы, связанные с запрещёнными или высокорисковыми темами, могут приводить к отказам. Для легитимной работы в области безопасности, такой как тестирование на проникновение, исследование уязвимостей или red-teaming, подайте заявку в Cyber Verification Program, чтобы запросить снижение ограничений. Для справки см. Защитные механизмы, предупреждения и апелляции.
Поддержка изображений высокого разрешения: Claude Opus 4.7 — первая модель Claude с поддержкой изображений высокого разрешения. Максимальное разрешение изображения составляет 2 576 пикселей по длинной стороне, по сравнению с 1 568 пикселями в предыдущих моделях. Это открывает преимущества для рабочих нагрузок с интенсивным использованием зрения и особенно ценно для использования компьютера, понимания скриншотов и анализа документов.
Поддержка высокого разрешения работает автоматически и не требует бета-заголовка или включения на стороне клиента. Два момента, которые следует учесть:
max_tokens и ожидания по затратам для рабочих нагрузок с большим количеством изображений или уменьшайте разрешение перед отправкой, если дополнительная детализация не нужна.Подробности см. в разделе Поддержка изображений высокого разрешения в Claude Opus 4.7.
Они не обязательны, но улучшат ваш опыт:
Переоцените max_tokens: Поскольку тот же текст даёт большее количество токенов в Claude Opus 4.7 и более поздних моделях, обновите параметры max_tokens, чтобы обеспечить дополнительный запас, включая триггеры компактизации. Вмешательства через подсказки, task_budget и effort могут помочь контролировать затраты и обеспечить надлежащее использование токенов.
Проверьте ожидания по подсчёту токенов: Любой путь в коде, который оценивает токены на стороне клиента или предполагает фиксированное соотношение токенов к символам, следует повторно протестировать на Claude Opus 5. Используйте конечную точку подсчёта токенов для проверки.
Внедрите бюджеты задач (бета): Claude Opus 4.7 представляет бюджеты задач. Эти бюджеты позволяют сообщить Claude, сколько токенов у него есть на полный агентный цикл, включая мышление, вызовы инструментов, результаты инструментов и финальный вывод. Модель видит текущий обратный отсчёт и использует его для приоритизации работы и корректного завершения задачи по мере расходования бюджета. Для использования установите бета-заголовок task-budgets-2026-03-13 и добавьте следующее в конфигурацию вывода:
output_config = {
"effort": "high",
"task_budget": {"type": "tokens", "total": 128000},
}Возможно, вам потребуется поэкспериментировать с разными бюджетами задач для вашего сценария использования. Если модели задан слишком ограничительный бюджет задачи, она может выполнить задачу менее тщательно, ссылаясь на бюджет как на ограничение.
Для открытых агентных задач, где качество важнее скорости, не устанавливайте бюджет задачи. Оставьте бюджеты задач для рабочих нагрузок, где вам нужно, чтобы модель ограничивала свою работу выделенным количеством токенов. Минимальное значение бюджета задачи — 20k токенов.
Бюджет задачи — это не жёсткое ограничение; это рекомендация, о которой модель знает. Он отличается от max_tokens:
task_budget: рекомендательное ограничение на весь агентный цикл. Модель видит его и использует для распределения своих усилий.max_tokens: жёсткий потолок на сгенерированные токены для каждого запроса. Он не передаётся модели, поэтому модель о нём не знает.Используйте task_budget, когда хотите, чтобы модель саморегулировалась, и max_tokens как жёсткий потолок для ограничения использования.
Установите большое значение max_tokens при уровне усилий max или xhigh: Если вы запускаете Claude Opus 4.7 или более позднюю модель с уровнем усилий max или xhigh, установите большой бюджет максимальных выходных токенов, чтобы у модели было пространство для мышления и действий через её субагентов и вызовы инструментов. Начните с 64k токенов и настраивайте дальше.
Уменьшайте разрешение изображений, если высокое разрешение не нужно: Claude Opus 4.7 и более поздние модели поддерживают изображения до 2576px / 3,75MP. Изображения высокого разрешения используют больше токенов. Если дополнительная детализация изображения не нужна, уменьшайте разрешение изображений перед отправкой в Claude, чтобы избежать увеличения использования токенов. См. Изображения и зрение.
Рассмотрите автоматические резервные модели: Claude Opus 5 поставляется с классификаторами безопасности в области кибербезопасности, отказы которых по киберкатегориям могут переключаться на Claude Opus 4.8. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, рассмотрите параметр fallbacks с режимом "default" (fallbacks: "default"), который выбирает рекомендуемую резервную модель на основе категории отказа вместо вручную поддерживаемого списка моделей. Серверный резервный механизм находится в бета-версии; режим "default" требует бета-заголовка server-side-fallback-2026-07-01. См. Отказы и резервные модели.
Кэшируйте более короткие подсказки: Минимальная длина кэшируемой подсказки в Claude Opus 5 составляет 512 токенов, что меньше, чем в более ранних моделях Opus. Подсказки, которые были слишком короткими для кэширования, теперь могут создавать записи в кэше без изменений в коде. Минимумы для каждой модели см. в разделе Кэширование подсказок.
Изменяйте инструменты в середине разговора (бета): Вы можете добавлять или удалять инструменты между ходами разговора без инвалидации попаданий в кэш подсказок на предыдущих ходах. Отправьте бета-заголовок mid-conversation-tool-changes-2026-07-01. Это полезно для агентных рабочих нагрузок, которые раскрывают инструменты постепенно или убирают их по мере продвижения задачи; без этого изменённый список инструментов инвалидирует кэшированный префикс.
Удалите перенесённые инструкции по проверке и ограничьте область задачи: Claude Opus 5 проверяет свою работу без указаний, поэтому удалите явные инструкции по проверке или самопроверке, перенесённые из подсказок, настроенных для более ранних моделей; их сохранение приводит к избыточной проверке. Для узких задач явно ограничьте область задачи. См. Область задачи и избыточная проверка.
claude-opus-4-6 на claude-opus-5 (или обновите псевдонимы).temperature, top_p и top_k из полезной нагрузки запросов.thinking: {type: "enabled", budget_tokens: N} на thinking: {type: "adaptive"} плюс параметр effort или полностью удалите поле thinking; адаптивное мышление включено по умолчанию в Claude Opus 5.thinking: в Claude Opus 5 они выполняются с мышлением. Пересмотрите max_tokens, который остаётся жёстким ограничением на общий вывод (мышление плюс текст ответа), или передайте thinking: {type: "disabled"} при уровне усилий high или ниже, чтобы сохранить прежнее поведение.thinking: {type: "disabled"} с уровнем усилий xhigh или max возвращает ошибку 400, что проверяется для каждого запроса. Снова включите мышление или понизьте уровень усилий до high или ниже.max_tokens с учётом обновлённой токенизации.xhigh или max, повысьте max_tokens как минимум до 64k в качестве отправной точки.stop_reason: "refusal" и рассмотрите fallbacks: "default" (бета) для автоматического повторного выполнения отклонённых запросов на рекомендуемой резервной модели.Если вы мигрируете с Claude Opus 4.5, Opus 4.1 (устаревшая) или более ранней модели напрямую на Claude Opus 5, примените все изменения, описанные ранее в этом разделе, плюс накопленные изменения ниже, которые вступили в силу между Opus 4.5 и Opus 4.7. Если вы мигрируете с Opus 4.6, изменений, описанных ранее в этом разделе, достаточно.
# Миграция на Opus
model = "claude-opus-4-5" # Before
model = "claude-opus-5" # AfterУдаление предзаполнения описано в критических изменениях при миграции с Claude Opus 4.6.
Экранирование параметров инструментов: Claude Opus 4.6 и более поздние модели могут выдавать немного другое экранирование JSON-строк в аргументах вызовов инструментов (например, другую обработку Unicode-экранирования или экранирования прямых слэшей). Если вы разбираете input вызова инструмента как необработанную строку, а не используете JSON-парсер, проверьте логику разбора. Стандартные JSON-парсеры (такие как json.loads() или JSON.parse()) обрабатывают эти различия автоматически.
Эти изменения улучшают ваш опыт работы с Claude Opus 4.7 и более поздними моделями. Пункты, отмеченные (обязательно в Opus 4.7), были необязательными рекомендациями при запуске Opus 4.6, но теперь являются обязательными; остальные остаются рекомендуемыми.
Мигрируйте на адаптивное мышление (обязательно в Opus 4.7): thinking: {type: "enabled", budget_tokens: N} возвращает ошибку 400 в Claude Opus 4.7 и более поздних моделях. Переключитесь на thinking: {type: "adaptive"} и используйте параметр effort для управления глубиной мышления; в Claude Opus 5 thinking: {type: "adaptive"} эквивалентно отсутствию поля thinking, при котором адаптивное мышление работает по умолчанию. См. Мышление.
response = client.beta.messages.create(
model="claude-opus-4-5",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 32000},
betas=["interleaved-thinking-2025-05-14"],
messages=[{"role": "user", "content": "Your prompt here"}],
)Обратите внимание, что миграция также включает переход с client.beta.messages.create на client.messages.create. Адаптивное мышление и уровень усилий — это функции общей доступности (GA), которые не требуют бета-пространства имён SDK или каких-либо бета-заголовков.
Удалите бета-заголовок effort: Параметр effort теперь общедоступен (GA). Удалите betas=["effort-2025-11-24"] из ваших запросов.
Удалите бета-заголовок детализированной потоковой передачи инструментов: Детализированная потоковая передача инструментов теперь общедоступна (GA). Удалите betas=["fine-grained-tool-streaming-2025-05-14"] из ваших запросов.
Удалите бета-заголовок чередующегося мышления: Адаптивное мышление автоматически включает чередующееся мышление в Claude Opus 4.7, Opus 4.6 и Sonnet 4.6. Удалите betas=["interleaved-thinking-2025-05-14"] из ваших запросов. Заголовок по-прежнему работает в Sonnet 4.6 с ручным расширенным мышлением, но ручной режим устарел.
Мигрируйте на output_config.format: Если вы используете структурированные выводы, обновите output_format={...} на output_config={"format": {...}}. Старый параметр продолжает работать, но устарел и будет удалён в будущем выпуске модели.
Если вы мигрируете с Opus 4.1 (устаревшая) или более ранних моделей напрямую на Claude Opus 5, примените все изменения, описанные ранее в этом разделе, плюс дополнительные изменения в этом подразделе.
# Из Opus 4.1
model = "claude-opus-4-1-20250805" # Before
model = "claude-opus-5" # After
# Из Sonnet 3.7
model = "claude-3-7-sonnet-20250219" # Before
model = "claude-opus-5" # AfterУдалите параметры сэмплирования
Это критическое изменение при миграции с моделей Claude 3.x.
Начиная с Claude Opus 4.7, установка temperature, top_p или top_k в любое значение, отличное от значения по умолчанию, возвращает ошибку 400. Самый безопасный путь миграции — полностью исключить эти параметры из запросов и использовать подсказки для управления поведением модели. Если вы использовали temperature = 0 для детерминизма, обратите внимание, что это никогда не гарантировало идентичные выводы.
# До — это вызовет ошибку в моделях Claude 4+
response = client.messages.create(
model="claude-3-7-sonnet-20250219",
temperature=0.7,
top_p=0.9, # Non-default sampling params return 400 on Opus 4.7
# ...
)
# После
response = client.messages.create(
model="claude-opus-5",
# ...
)Обновите версии инструментов
Это критическое изменение при миграции с моделей Claude 3.x.
Обновитесь до последних версий инструментов. Удалите любой код, использующий команду undo_edit.
# До
tools = [{"type": "text_editor_20250124", "name": "str_replace_editor"}]
# После
tools = [{"type": "text_editor_20250728", "name": "str_replace_based_edit_tool"}]text_editor_20250728 и str_replace_based_edit_tool. Подробности см. в документации по инструменту текстового редактора.code_execution_20260521. Инструкции по миграции см. в документации по инструменту выполнения кода.Обрабатывайте причину остановки refusal
Обновите ваше приложение для обработки причин остановки refusal:
response = client.messages.create(...)
if response.stop_reason == "refusal":
# Обработайте отказ соответствующим образом
passОбрабатывайте причину остановки model_context_window_exceeded
Модели Claude 4.5+ возвращают причину остановки model_context_window_exceeded, когда генерация останавливается из-за достижения предела контекстного окна, а не запрошенного предела max_tokens. Обновите ваше приложение для обработки этой новой причины остановки:
response = client.messages.create(...)
if response.stop_reason == "model_context_window_exceeded":
# Обрабатываем ограничение контекстного окна соответствующим образом
passПроверьте обработку параметров инструментов (завершающие переводы строк)
Модели Claude 4.5+ сохраняют завершающие переводы строк в строковых параметрах вызовов инструментов, которые ранее удалялись. Если ваши инструменты полагаются на точное сопоставление строк с параметрами вызовов инструментов, убедитесь, что ваша логика правильно обрабатывает завершающие переводы строк.
Обновите подсказки с учётом поведенческих изменений
Модели Claude 4+ имеют более лаконичный, прямой стиль общения и требуют явных указаний. Ознакомьтесь с лучшими практиками составления подсказок для рекомендаций по оптимизации.
token-efficient-tools-2025-02-19 и output-128k-2025-02-19. Все модели Claude 4+ имеют встроенное токен-эффективное использование инструментов, и эти заголовки не имеют эффекта.claude-opus-5output_config.formatthinking: {type: "enabled", budget_tokens: N} на thinking: {type: "adaptive"} плюс параметр effort (возвращает 400 в Opus 4.7)effort-2025-11-24 (effort теперь общедоступен)fine-grained-tool-streaming-2025-05-14interleaved-thinking-2025-05-14 (адаптивное мышление автоматически включает чередующееся мышление)output_format на output_config.format (если применимо)temperature, top_p и top_k (значения, отличные от значений по умолчанию, возвращают 400 в Opus 4.7)text_editor_20250728, code_execution_20260521)refusalmodel_context_window_exceededtoken-efficient-tools-2025-02-19, output-128k-2025-02-19)Claude Opus 5 и Claude Sonnet 5 имеют одинаковую поверхность API: оба работают с включённым по умолчанию адаптивным мышлением, у обоих параметр effort по умолчанию равен high в Claude API и Claude Code, оба по умолчанию предоставляют контекстное окно в 1M токенов с максимумом в 128k выходных токенов, и ни один из них не поддерживает Priority Tier. Ручное расширенное мышление и нестандартные параметры сэмплирования возвращают ошибку 400 на обеих моделях, как и предзаполнение сообщения ассистента.
model = "claude-sonnet-5" # Before
model = "claude-opus-5" # AfterЦенообразование: Claude Opus 5 стоит $5 за миллион входных токенов и $25 за миллион выходных токенов. Для Claude Sonnet 5 действует вводная цена $2/$10 за миллион входных/выходных токенов до 31 августа 2026 года, после чего вступает в силу стандартная цена $3/$15. Полную информацию о ценах см. в разделе Цены Claude.
Отключение мышления ограничено уровнем effort high: На Claude Sonnet 5 thinking: {type: "disabled"} принимается при любом уровне effort. На Claude Opus 5 это принимается только при уровне effort high или ниже; запрос, сочетающий thinking: {type: "disabled"} с effort xhigh или max, возвращает ошибку 400, что проверяется для каждого запроса. Проверьте запросы, отключающие мышление, перед миграцией.
Системные сообщения в середине разговора: Claude Opus 5 принимает сообщения role: "system" сразу после хода пользователя в массиве messages (с учётом правил размещения); Claude Sonnet 5 — нет. Если вы поддерживаете пути кода, которые перестраивают всю историю сообщений для обновления инструкций, вы можете упростить их и сохранить попадания в кэш подсказок на более ранних ходах.
Web fetch недоступен: Инструмент web fetch доступен на Claude Sonnet 5, но не на Claude Opus 5.
claude-sonnet-5 на claude-opus-5.thinking: {type: "disabled"} с effort xhigh или max возвращает ошибку 400 на Claude Opus 5. Снова включите мышление или понизьте effort до high или ниже.Claude Sonnet 5 предлагает лучшее сочетание скорости и интеллекта в семействе моделей Claude. Он основан на Claude Sonnet 4.6.
Claude Sonnet 5 — это прямая замена для Claude Sonnet 4.6. Вводная цена $2/$10 USD за миллион входных/выходных токенов действует до 31 августа 2026 года, после чего вступит в силу стандартная цена $3/$15 USD за миллион входных/выходных токенов; подробности см. в разделе Цены. Есть два критических изменения API для кода, уже работающего на Claude Sonnet 4.6: ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) и параметры сэмплирования (temperature, top_p, top_k), установленные в нестандартные значения, больше не принимаются и возвращают ошибку 400. Вместо этого используйте адаптивное мышление с параметром effort. Claude Sonnet 5 поддерживает тот же набор функций, что и Claude Sonnet 4.6, включая контекстное окно в 1M токенов, адаптивное мышление, кэширование подсказок, пакетную обработку, Files API, поддержку PDF, зрение и полный набор серверных и клиентских инструментов. Priority Tier недоступен на Claude Sonnet 5. Claude Sonnet 5 также использует новый токенизатор.
Если ваш код работает на Claude Sonnet 4.5 или более ранней версии, также примените раздел Миграция на Claude Sonnet 5 с Claude Sonnet 4.5 и более ранних моделей Sonnet. Эти шаги включают критические изменения (отклонение предзаполнения сообщения ассистента, различия в экранировании JSON в параметрах инструментов), которые этот раздел сам по себе не охватывает.
# Миграция на Sonnet
model = "claude-sonnet-4-6" # Before
model = "claude-sonnet-5" # AfterПункты 4 и 5 в следующем списке являются критическими изменениями. max_tokens остаётся жёстким ограничением на общий вывод (мышление плюс текст ответа), поэтому пересмотрите его для рабочих нагрузок, которые работали без мышления на Claude Sonnet 4.6.
Новый токенизатор: Claude Sonnet 5 использует новый токенизатор. Один и тот же входной текст производит примерно на 30% больше токенов, чем на Claude Sonnet 4.6. Точное увеличение зависит от содержимого. Запросы, ответы и события потоковой передачи сохраняют ту же форму, и изменения кода не требуются, но всё, что вы измеряете или планируете в токенах, смещается: поля usage и результаты подсчёта токенов для одного и того же текста выше, контекстное окно в 1M токенов вмещает меньше текста, а ограничение max_tokens, настроенное для Claude Sonnet 4.6, может обрезать эквивалентный вывод. Цена за токен не изменилась, поэтому стоимость эквивалентного запроса может отличаться. Повторно выполните подсчёт токенов для Claude Sonnet 5 вместо повторного использования подсчётов, измеренных для более ранних моделей.
Максимум 128k выходных токенов (без изменений): Claude Sonnet 5 поддерживает до 128k выходных токенов, как и Claude Sonnet 4.6. Существующие значения max_tokens остаются действительными. Учитывайте новый токенизатор при их определении.
Предзаполнение сообщения ассистента (без изменений): Предзаполнение сообщения ассистента возвращает ошибку 400 на Claude Sonnet 5, как и на Claude Sonnet 4.6. Если вы удалили предзаполнение при миграции на Claude Sonnet 4.6, дальнейшие изменения не требуются. Вместо этого используйте структурированные выводы, инструкции в системной подсказке или output_config.format.
Адаптивное мышление включено по умолчанию: На Claude Sonnet 4.6 запросы без поля thinking выполняются без мышления; на Claude Sonnet 5 те же запросы выполняются с адаптивным мышлением. Чтобы отключить мышление, передайте thinking: {type: "disabled"}. Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается и возвращает ошибку 400. Используйте параметр effort (по умолчанию high) для управления глубиной мышления.
Адаптивное мышление включено по умолчанию для Claude Sonnet 5. Поле thinking показано здесь явно, чтобы установить display: "summarized"; если вы опустите thinking, Claude Sonnet 5 по умолчанию не включает содержимое мышления в ответ. Значения по умолчанию для каждой модели см. в разделе Конфигурации, отклоняемые каждой моделью.
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=16000,
thinking={"type": "adaptive", "display": "summarized"},
output_config={"effort": "high"},
messages=[
{
"role": "user",
"content": "Are there an infinite number of prime numbers such that n mod 4 == 3?",
}
],
)
# Ответ содержит суммаризированные блоки мышления и текстовые блоки
for block in response.content:
match block.type:
case "thinking":
print(f"\nThinking summary: {block.thinking}")
case "text":
print(f"\nResponse: {block.text}")Параметры сэмплирования удалены: Параметры сэмплирования (temperature, top_p, top_k), установленные в нестандартное значение, не принимаются и возвращают ошибку 400.
Меры защиты в области кибербезопасности: Claude Sonnet 5 — первая модель уровня Sonnet с мерами защиты в области кибербезопасности в реальном времени. Запросы, затрагивающие запрещённые или высокорисковые темы кибербезопасности, могут быть отклонены. Отказы возвращаются как успешный ответ HTTP 200 с stop_reason: "refusal", а не как ошибка. Подробнее см. в разделе Меры защиты, предупреждения и апелляции.
claude-sonnet-4-6 на claude-sonnet-5.max_tokens, установленные близко к ожидаемой длине вывода, и повысьте их до максимума в 128k (без изменений по сравнению с Claude Sonnet 4.6), где это полезно.thinking: {type: "enabled", budget_tokens: N} (возвращает ошибку 400). Адаптивное мышление включено по умолчанию; передайте {type: "disabled"}, чтобы отключить его, или используйте параметр effort для управления глубиной.temperature, top_p и top_k, установленные в нестандартные значения (они возвращают ошибку 400 на Claude Sonnet 5).stop_reason: "refusal", если ваша рабочая нагрузка может затрагивать темы кибербезопасности.max_tokens для рабочих нагрузок, которые ранее работали без мышления.Если вы мигрируете с Claude Sonnet 4.5 или более ранней модели Sonnet непосредственно на Claude Sonnet 5, примените изменения из раздела Миграция на Claude Sonnet 5 с Claude Sonnet 4.6, а также изменения из этого раздела.
Claude Sonnet 5 по умолчанию использует уровень effort high, в отличие от Sonnet 4.5, у которого не было параметра effort. Рассмотрите возможность настройки параметра effort при миграции. Если он не установлен явно, вы можете столкнуться с более высокой задержкой при уровне effort по умолчанию.
Предзаполнение сообщений ассистента больше не поддерживается
Это критическое изменение при миграции с Sonnet 4.5 или более ранних версий.
Предзаполнение сообщений ассистента возвращает ошибку 400 на Claude Sonnet 4.6 и более поздних моделях, включая Claude Sonnet 5. Вместо этого используйте структурированные выводы, инструкции в системной подсказке или output_config.format.
Распространённые случаи использования предзаполнения и миграции:
Управление форматированием вывода (принудительный вывод JSON/YAML): Используйте структурированные выводы или инструменты с полями enum для задач классификации.
Устранение преамбул (удаление фраз «Вот...»): Добавьте прямые инструкции в системную подсказку: «Отвечайте напрямую без преамбулы. Не начинайте с фраз вроде 'Вот...', 'На основе...' и т. д.»
Избежание неуместных отказов: Claude теперь гораздо лучше справляется с уместными отказами. Чёткой подсказки в сообщении пользователя без предзаполнения должно быть достаточно.
Продолжения (возобновление прерванных ответов): Перенесите продолжение в сообщение пользователя: «Ваш предыдущий ответ был прерван и закончился на [previous_response]. Продолжите с того места, где остановились.»
Гидратация контекста / согласованность роли (обновление контекста в длинных разговорах): Вместо этого вставляйте то, что ранее было напоминаниями в предзаполненном сообщении ассистента, в ход пользователя.
Экранирование JSON в параметрах инструментов может отличаться
Это критическое изменение при миграции с Sonnet 4.5 или более ранних версий.
Экранирование строк JSON в параметрах инструментов может отличаться от предыдущих моделей. Стандартные парсеры JSON обрабатывают это автоматически, но пользовательский строковый парсинг может потребовать обновлений.
Изменения расширенного мышления: Конфигурации budget_tokens из Claude Sonnet 4.5 (thinking: {type: "enabled", budget_tokens: N}) не поддерживаются на Claude Sonnet 5 и возвращают ошибку 400. Адаптивное мышление включено по умолчанию, поэтому большинству рабочих нагрузок вообще не нужна конфигурация thinking; используйте параметр effort для управления глубиной мышления. Если вы запускали Claude Sonnet 4.5 без расширенного мышления, передайте thinking: {type: "disabled"}, чтобы сохранить это поведение.
Удалите параметры сэмплирования
Это критическое изменение при миграции с моделей Claude 3.x.
Параметры сэмплирования (temperature, top_p, top_k), установленные в нестандартное значение, возвращают ошибку 400 на Claude Sonnet 5. Удалите их из запросов и вместо этого используйте подсказки для управления поведением модели.
Обновите версии инструментов
Это критическое изменение при миграции с моделей Claude 3.x.
Обновитесь до последних версий инструментов (text_editor_20250728, code_execution_20260521). Удалите любой код, использующий команду undo_edit.
Обрабатывайте причину остановки refusal
Обновите ваше приложение для обработки причин остановки refusal.
Обновите ваши подсказки с учётом поведенческих изменений
Модели Claude 4 имеют более лаконичный, прямой стиль общения. Ознакомьтесь с лучшими практиками создания подсказок для рекомендаций по оптимизации.
Claude Haiku 4.5 и Claude Sonnet 5 различаются на уровне API сильнее, чем соседние модели в пределах одного класса: Claude Haiku 4.5 использует ручное расширенное мышление (отключено по умолчанию), контекстное окно в 200k токенов и до 64k выходных токенов, в то время как Claude Sonnet 5 работает с включённым по умолчанию адаптивным мышлением, по умолчанию предоставляет контекстное окно в 1M токенов и поддерживает до 128k выходных токенов.
model = "claude-haiku-4-5-20251001" # Before
model = "claude-sonnet-5" # AfterКонфигурация мышления: Claude Haiku 4.5 поддерживает ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) и отклоняет thinking: {type: "adaptive"}. На Claude Sonnet 5 поддержка обратная: адаптивное мышление включено по умолчанию, а ручное расширенное мышление возвращает ошибку 400. Удалите конфигурации thinking: {type: "enabled", budget_tokens: N} и полагайтесь на значение по умолчанию, или передайте thinking: {type: "disabled"}, чтобы отключить мышление. У budget_tokens нет прямой замены; используйте параметр effort для управления глубиной мышления. Effort недоступен на Claude Haiku 4.5 и по умолчанию равен high на Claude Sonnet 5.
Параметры сэмплирования удалены: temperature и top_p работают на Claude Haiku 4.5 (по одному за раз, не оба). На Claude Sonnet 5 установка temperature, top_p или top_k в нестандартное значение возвращает ошибку 400. Удалите эти параметры и используйте подсказки для управления поведением модели.
Предзаполнение ассистента удалено: Предзаполнение сообщения ассистента работает на Claude Haiku 4.5, но возвращает ошибку 400 на Claude Sonnet 5. Вместо этого используйте структурированные выводы, инструкции в системной подсказке или output_config.format.
Большее контекстное окно и вывод: Claude Sonnet 5 по умолчанию предоставляет контекстное окно в 1M токенов по сравнению с 200k токенов на Claude Haiku 4.5 и поддерживает до 128k выходных токенов по сравнению с 64k. Claude Sonnet 5 также использует другой токенизатор, поэтому повторно выполните подсчёт токенов вместо повторного использования подсчётов, измеренных для Claude Haiku 4.5.
Ценообразование: Claude Haiku 4.5 стоит $1/$5 за миллион входных/выходных токенов. Для Claude Sonnet 5 действует вводная цена $2/$10 за миллион входных/выходных токенов до 31 августа 2026 года, после чего вступает в силу стандартная цена $3/$15. См. Цены Claude.
Меры защиты в области кибербезопасности: Claude Sonnet 5 имеет меры защиты в области кибербезопасности в реальном времени. Запросы, затрагивающие запрещённые или высокорисковые темы кибербезопасности, могут быть отклонены и возвращены как успешный ответ HTTP 200 с stop_reason: "refusal". Подробнее см. в разделе Меры защиты, предупреждения и апелляции.
claude-haiku-4-5-20251001 (или псевдонима claude-haiku-4-5) на claude-sonnet-5.thinking: {type: "enabled", budget_tokens: N} (возвращает ошибку 400). Адаптивное мышление включено по умолчанию; передайте thinking: {type: "disabled"}, чтобы сохранить поведение без мышления, и пересмотрите max_tokens для рабочих нагрузок, которые работали без мышления.high) для управления глубиной мышления и расходом токенов; он недоступен на Claude Haiku 4.5, поэтому никакая существующая настройка не переносится.temperature и top_p (нестандартные значения возвращают ошибку 400 на Claude Sonnet 5).max_tokens, которые вы можете повысить до максимума в 128k.stop_reason: "refusal", если ваша рабочая нагрузка может затрагивать темы кибербезопасности.Claude Haiku 4.5 — самая быстрая и интеллектуальная модель Haiku с производительностью, близкой к передовой, обеспечивающая качество премиальной модели для интерактивных приложений и высокообъёмной обработки.
Полный обзор возможностей см. в обзоре моделей.
Цены на Claude Haiku 4.5 см. в разделе Цены Claude.
Для значительного улучшения производительности в задачах кодирования и рассуждения рассмотрите возможность включения расширенного мышления с помощью thinking: {type: "enabled", budget_tokens: N}.
Расширенное мышление влияет на эффективность кэширования подсказок.
Расширенное мышление устарело в моделях Claude 4.6 и удалено в Claude Opus 4.7. Если вы используете более новые модели, используйте вместо этого адаптивное мышление.
Обновите имя модели:
# Из Haiku 3.5
model = "claude-3-5-haiku-20241022" # Before
model = "claude-haiku-4-5-20251001" # AfterОзнакомьтесь с новыми ограничениями скорости: Haiku 4.5 имеет отдельные ограничения скорости от Haiku 3.5. Подробности см. в документации по ограничениям скорости.
Изучите новые возможности: См. обзор моделей для получения подробной информации об осведомлённости о контексте, увеличенной ёмкости вывода (64k токенов), более высоком интеллекте и улучшенной скорости.
Эти критические изменения применяются при миграции с моделей Claude 3.x Haiku.
Обновите параметры сэмплирования
Это критическое изменение при миграции с моделей Claude 3.x.
Используйте только temperature ИЛИ top_p, но не оба. Установка обоих возвращает ошибку 400 на Claude Haiku 4.5.
Обновите версии инструментов
Это критическое изменение при миграции с моделей Claude 3.x.
Обновитесь до последних версий инструментов (text_editor_20250728, code_execution_20250825). Удалите любой код, использующий команду undo_edit.
Обрабатывайте причину остановки refusal
Обновите ваше приложение для обработки причин остановки refusal.
Обновите ваши подсказки с учётом поведенческих изменений
Модели Claude 4 имеют более лаконичный, прямой стиль общения. Ознакомьтесь с лучшими практиками создания подсказок для рекомендаций по оптимизации.
claude-haiku-4-5-20251001text_editor_20250728, code_execution_20250825); устаревшие версии не поддерживаютсяundo_edit (если применимо)temperature ИЛИ top_p, но не оба (установка обоих возвращает ошибку 400)refusal в вашем приложенииWas this page helpful?