Это руководство охватывает миграцию кода Messages API. Если вы используете Claude Managed Agents, никаких изменений, кроме обновления имени модели, не требуется.
Автоматизируйте вашу миграцию с помощью навыка Claude API. В Claude Code выполните /claude-api migrate, чтобы вызвать встроенный навык Claude API. Он работает для любой целевой модели на этой странице:
/claude-api migrate this project to claude-opus-4-8Навык применяет замену идентификатора модели и, при необходимости, критические изменения параметров, замену предзаполнения и калибровку усилия для вашей целевой модели по всей вашей кодовой базе, а затем создает контрольный список элементов для ручной проверки. Он просит вас подтвердить область миграции (весь рабочий каталог, подкаталог или конкретный список файлов) перед редактированием каких-либо файлов. Навык также обнаруживает клиентов Amazon Bedrock, Google Cloud, Claude Platform on AWS и Microsoft Foundry и корректирует форматы идентификаторов моделей и изменения функций для каждой платформы.
Claude Mythos 5 — это преемник с ограниченным доступом модели Claude Mythos Preview, исследовательской предварительной версии, доступной только по приглашению. Для общедоступной модели с теми же возможностями см. Claude Fable 5.
Миграция в основном не требует изменений. Claude Mythos 5 использует тот же Messages API и те же шаблоны «tool use» (использование инструментов), что и Claude Mythos Preview, а количество токенов практически не изменилось, поскольку обе модели используют один и тот же токенизатор. Ключевые изменения, которые следует проверить, — это функции, которые больше не доступны (перечислены в следующем разделе), и вывод мышления. Подробнее об использовании инструментов см. в обзоре.
Сроки вывода из эксплуатации Claude Mythos Preview см. в разделе Устаревание моделей.
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # AfterРасширенное мышление и бюджеты токенов мышления: Ручное «extended thinking» (расширенное мышление) (thinking: {type: "enabled", budget_tokens: N}) не поддерживается в claude-mythos-5 и возвращает ошибку 400. Адаптивное мышление всегда включено: модель определяет, когда и сколько думать при каждом запросе, и никакая конфигурация thinking не требуется. thinking: {type: "disabled"} возвращает ошибку. У budget_tokens нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.
До (Claude Mythos Preview):
client.messages.create(
model="claude-mythos-preview",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)После (Claude Mythos 5):
client.messages.create(
model="claude-mythos-5",
max_tokens=16000,
messages=[{"role": "user", "content": "..."}],
)Предзаполнение ассистента: Предзаполнение сообщения ассистента не поддерживается в claude-mythos-5 и возвращает ошибку 400, так же как и в Claude Mythos Preview. Вместо этого используйте инструкции в системной подсказке.
Вывод мышления: В claude-mythos-5 необработанная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый суммированный текст, когда thinking.display установлен в summarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления в Claude Fable 5 и Claude Mythos 5.
claude-mythos-5 использует тот же токенизатор, что и claude-mythos-preview (токенизатор, представленный с Claude Opus 4.7). Количество токенов практически не изменяется при миграции с claude-mythos-preview. По сравнению с моделями до Claude Opus 4.7 тот же контент может токенизироваться примерно в 30% больше токенов, в зависимости от контента и формы рабочей нагрузки.
/v1/messages/count_tokens возвращает практически неизменные значения для claude-mythos-5 по сравнению с claude-mythos-preview. Заново определите базовые показатели стоимости и задержки на ваших собственных рабочих нагрузках.
claude-mythos-preview на claude-mythos-5.thinking: {type: "enabled", budget_tokens: N}). Адаптивное мышление всегда включено, и поле thinking не требуется.thinking: {type: "disabled"}. Отключение мышления возвращает ошибку в claude-mythos-5.budget_tokens. У него нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.thinking, рассматривает его только как отображаемый текст и передает блоки мышления обратно без изменений при продолжении на той же модели. thinking.display по умолчанию равен "omitted" в claude-mythos-5, так же как и в Claude Mythos Preview; установите display: "summarized", чтобы получать читаемые сводки. См. Вывод мышления в Claude Fable 5 и Claude Mythos 5.thinking и redacted_thinking из предыдущих ходов ассистента. Блоки мышления из claude-mythos-5 привязаны к модели, которая их создала, и модели, отличные от Claude Fable 5 и Claude Mythos 5, молча их игнорируют. Удаление сохраняет межмодельные запросы минимальными и единообразными.claude-mythos-preview.Claude Fable 5 — это самая способная широко выпущенная модель Anthropic, общедоступная в Claude API, Claude Platform on AWS, Amazon Bedrock, Google Cloud и Microsoft Foundry.
Миграция в основном не требует изменений. Claude Fable 5 использует тот же Messages API и те же шаблоны использования инструментов, что и Claude Opus 4.8. Она поддерживает то же контекстное окно в 1M токенов по умолчанию и те же 128k максимальных выходных токенов. Количество токенов практически не изменилось, поскольку обе модели используют один и тот же токенизатор.
Ключевые изменения, которые следует проверить, — это всегда включенное адаптивное мышление, вывод мышления, отказы классификаторов безопасности и ценообразование. Раздел Перед миграцией охватывает ценообразование и хранение данных; раздел Что изменилось охватывает остальное.
Claude Fable 5 стоит $10 за миллион входных токенов и $50 за миллион выходных токенов по сравнению с $5 и $25 для Claude Opus 4.8. Подробности см. в разделе Цены Claude.
Claude Fable 5 требует 30-дневного хранения данных и недоступна в рамках соглашений о нулевом хранении данных (ZDR); она обозначена как Covered Model. В Claude API запрос от организации, чья конфигурация хранения данных не соответствует этому требованию, возвращает ошибку 400 invalid_request_error. Организациям с соглашением ZDR следует связаться со своей командой по работе с клиентами Anthropic, чтобы обсудить конфигурацию хранения данных; Claude Opus 4.8 остается доступной в рамках ZDR. В качестве альтернативы вы можете настроить хранение данных для каждого рабочего пространства. Требование 30-дневного хранения данных применяется на каждой платформе, где предлагается Claude Fable 5; подробности по каждой платформе см. в разделе Требования к хранению данных для конкретных моделей.
Если ваш код работает на Claude Opus 4.7 или более ранней версии, сначала примените раздел Миграция с Claude Opus 4.7 на Claude Opus 4.8 и, для моделей ранее Claude Opus 4.7, шаги миграции на Claude Opus 4.7. Эти разделы охватывают критические изменения (отклонение параметров сэмплирования, отклонение ручного расширенного мышления, удаление предзаполнения, новый токенизатор), которые этот раздел не повторяет.
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # AfterЭлементы в этом разделе описывают различия в API и поведении, которые стоит проверить после замены идентификатора модели.
Адаптивное мышление всегда включено: Адаптивное мышление — единственный режим мышления в claude-fable-5. Модель определяет, когда и сколько думать при каждом запросе, и никакая конфигурация thinking не требуется. thinking: {type: "disabled"} возвращает ошибку. Используйте параметр effort для управления глубиной мышления.
Изменение поведения, которое следует проверить: в Claude Opus 4.8 запросы без поля thinking выполняются без мышления; в claude-fable-5 те же запросы выполняются с адаптивным мышлением. max_tokens остается жестким ограничением на общий вывод, мышление плюс текст ответа, поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления в Claude Opus 4.8. См. Контроль затрат.
До (Claude Opus 4.8):
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)После (Claude Fable 5):
client.messages.create(
model="claude-fable-5",
max_tokens=16000,
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)Расширенное мышление и бюджеты мышления (без изменений): Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается в claude-fable-5 и возвращает ошибку 400, так же как и в Claude Opus 4.8. У budget_tokens нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.
Предзаполнение ассистента (без изменений): Предзаполнение сообщения ассистента не поддерживается в claude-fable-5 и возвращает ошибку 400, так же как и в Claude Opus 4.8. Вместо этого используйте инструкции в системной подсказке.
Вывод мышления: В claude-fable-5 необработанная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый суммированный текст, когда thinking.display установлен в summarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления в Claude Fable 5 и Claude Mythos 5.
Классификаторы безопасности и причина остановки refusal: claude-fable-5 запускает классификаторы безопасности на запросах и во время генерации ответа. Когда классификатор отклоняет запрос, Messages API возвращает stop_reason: "refusal" как успешный ответ HTTP 200, а не ошибку. Поле stop_details.category сообщает, какой классификатор сработал, с категориями, такими как "cyber", "bio" и "reasoning_extraction", или null, когда отказ не соответствует ни одной именованной категории. Полный набор см. в таблице категорий отказов.
С вас не взимается плата за входные токены запроса, отклоненного до генерации какого-либо вывода. Когда классификатор срабатывает в середине потока, входные данные и уже переданный вывод оплачиваются; отбросьте частичный вывод.
Чтобы автоматически повторно выполнять отклоненные запросы на другой модели, передайте опциональный параметр fallbacks, который находится в бета-версии в Claude API и Claude Platform on AWS. Параметр недоступен в Message Batches API или в Amazon Bedrock, Google Cloud и Microsoft Foundry; на этих трех платформах выполняйте повторную попытку на стороне клиента или используйте промежуточное ПО SDK для отказов с резервным вариантом. См. Обработка причин остановки.
Начните с усилия high: Значение по умолчанию параметра effort остается high. В Claude Opus 4.8 рекомендация для кодирования и работы с высокой автономией — явно устанавливать xhigh. В claude-fable-5 используйте high по умолчанию для большинства задач и оставьте xhigh для наиболее чувствительных к возможностям рабочих нагрузок. Более низкие настройки усилия в claude-fable-5 по-прежнему работают хорошо и часто превосходят производительность xhigh на предыдущих моделях. Уменьшите усилие, если задача выполняется, но занимает больше времени, чем необходимо. См. Подсказки для Claude Fable 5.
Более низкий минимум кэширования подсказок: Минимальная кэшируемая длина подсказки в claude-fable-5 составляет 512 токенов, что ниже, чем 1 024 токена в Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования в Claude Opus 4.8, теперь могут создавать записи кэша без изменений кода. В Amazon Bedrock минимум для claude-fable-5 составляет 1 024 токена. Минимумы для каждой модели см. в разделе Кэширование подсказок.
claude-fable-5 требует 30-дневного хранения данных и в Claude API в противном случае возвращает ошибку 400 invalid_request_error. См. Требования к хранению данных для конкретных моделей.claude-opus-4-8 на claude-fable-5.thinking: {type: "disabled"}. Отключение мышления возвращает ошибку в claude-fable-5, а запросы без поля thinking выполняются с адаптивным мышлением.claude-fable-5.thinking, рассматривает его только как отображаемый текст и передает блоки мышления обратно без изменений при продолжении на той же модели. thinking.display по умолчанию равен "omitted" в claude-fable-5, так же как и в Claude Opus 4.8; установите display: "summarized", чтобы получать читаемые сводки. См. Вывод мышления в Claude Fable 5 и Claude Mythos 5.thinking и redacted_thinking из предыдущих ходов ассистента. Блоки мышления из claude-fable-5 привязаны к модели, которая их создала, и модели, отличные от Claude Fable 5 и Claude Mythos 5, молча их игнорируют. Удаление сохраняет межмодельные запросы минимальными и единообразными. Исключением является погашение резервного кредита, которое требует тела запроса, воспроизведенного в соответствии с точными правилами этой функции.stop_reason: "refusal" и читайте поле stop_details.category. Чтобы автоматически повторно выполнять отклоненные запросы на другой модели, рассмотрите опциональный параметр fallbacks (бета). См. Обработка причин остановки.effort. Начните с high для большинства задач, включая рабочие нагрузки, которые выполнялись с xhigh в Claude Opus 4.8.claude-opus-4-8; цена за токен отличается.Claude Opus 4.8 создана для сложного агентного кодирования и корпоративной работы. Она основана на Claude Opus 4.7.
Claude Opus 4.8 должна демонстрировать высокую производительность «из коробки» на существующих подсказках и оценках Claude Opus 4.7. Нет критических изменений API для кода, уже работающего на Claude Opus 4.7. Она поддерживает тот же набор функций, что и Claude Opus 4.7, включая контекстное окно в 1M токенов, 128k максимальных выходных токенов, адаптивное мышление, кэширование подсказок, пакетную обработку, Files API, поддержку PDF, зрение и полный набор серверных и клиентских инструментов. Она также добавляет системные сообщения в середине разговора и публично документирует детали остановки при отказе.
Если ваш код работает на Claude Opus 4.6 или более ранней версии, также примените шаги миграции на Claude Opus 4.7 ниже перед обновлением до Claude Opus 4.8. Эти шаги включают критические изменения (отклонение параметров сэмплирования, отклонение ручного расширенного мышления, новый токенизатор), которые обновление до 4.8 само по себе не охватывает.
# Миграция на Opus
model = "claude-opus-4-7" # Before
model = "claude-opus-4-8" # AfterЭто не критические изменения. Код, который работает на Claude Opus 4.7, продолжает работать без изменений на Claude Opus 4.8. Элементы ниже описывают различия в поведении, которые стоит проверить после замены идентификатора модели.
Параметры сэмплирования (без изменений): Установка temperature, top_p или top_k в значение, отличное от значения по умолчанию, возвращает ошибку 400 в Claude Opus 4.8, так же как и в Claude Opus 4.7. Типы запросов SDK по-прежнему определяют эти поля для совместимости с более ранними моделями, поэтому код, который их устанавливает, проходит проверку типов, но API отклоняет запрос на стороне сервера. Если вы удалили эти параметры при миграции на Opus 4.7, дальнейшие изменения не требуются.
Значение effort по умолчанию — high: Значение по умолчанию параметра effort в Claude Opus 4.8 — high на всех поверхностях, включая Claude Code и Messages API. Если вы уже явно установили effort, ваша настройка не изменилась. Для кодирования и работы с высокой автономией явно устанавливайте xhigh. Переоцените вашу настройку effort относительно вашего бюджета задержки и затрат.
Контекстное окно 1M является значением по умолчанию: Claude Opus 4.8 предоставляет полное контекстное окно в 1M токенов по умолчанию без бета-заголовка и без надбавки за длинный контекст. Если ваш клиент передает бета-заголовок контекстного окна для совместимости со старыми моделями, вы можете удалить его в Claude Opus 4.8.
Системные сообщения в середине разговора: Claude Opus 4.8 принимает сообщения role: "system" сразу после хода пользователя в массиве messages (с учетом правил размещения). Используйте поле верхнего уровня system для инструкций, которые применяются с самого начала. Более ранние модели, включая Claude Opus 4.7, отклоняют role: "system" в messages с ошибкой 400. Если вы поддерживаете пути кода, которые перестраивают всю историю сообщений для обновления инструкций, вы можете упростить их и сохранить попадания в кэш подсказок на более ранних ходах.
Детали остановки при отказе: Объект stop_details в ответах с отказом (доступный с Claude Opus 4.7) теперь публично документирован. Когда модель отклоняет запрос, она идентифицирует категорию отказа в дополнение к существующей причине остановки refusal. Бета-заголовок не требуется, и нет возможности отказаться. См. Обработка причин остановки.
Более низкий минимум кэширования подсказок: Минимальная кэшируемая длина подсказки в Claude Opus 4.8 составляет 1 024 токена, что ниже, чем в Claude Opus 4.7. Подсказки, которые были слишком короткими для кэширования в Claude Opus 4.7, теперь могут создавать записи кэша без изменений кода. Минимумы для каждой модели см. в разделе Кэширование подсказок.
Перекалибровка уровней усилия: Распределение токенов для каждого уровня усилия изменяется в Claude Opus 4.8 по сравнению с Claude Opus 4.7: medium допускает несколько больше мышления, high — несколько меньше, а xhigh — существенно больше. Если вы настраивали уровень усилия относительно стоимости или задержки Claude Opus 4.7, заново определите базовые показатели на том же уровне перед его корректировкой. См. Effort.
claude-opus-4-7 на claude-opus-4-8 (или обновите псевдонимы).effort. Значение по умолчанию — high на всех поверхностях; для кодирования и работы с высокой автономией явно устанавливайте xhigh.stop_details при отказах (доступно с Claude Opus 4.7; теперь публично документировано).Claude Opus 4.7 обладает высокой автономией и исключительно хорошо справляется с долгосрочной агентной работой, интеллектуальной работой, задачами зрения и задачами памяти.
Claude Opus 4.7 должна демонстрировать высокую производительность «из коробки» на существующих подсказках и оценках Claude Opus 4.6 при той же цене $5 / $25 за MTok, но есть несколько поведенческих и API-изменений, о которых стоит знать при миграции. Она поддерживает тот же набор функций, что и Claude Opus 4.6, включая:
# Миграция на Opus
model = "claude-opus-4-6" # Before
model = "claude-opus-4-7" # AfterРасширенное мышление удалено: thinking: {type: "enabled", budget_tokens: N} больше не поддерживается в Claude Opus 4.7 или более поздних моделях и возвращает ошибку 400. Переключитесь на адаптивное мышление (thinking: {type: "adaptive"}) и используйте параметр effort для управления глубиной мышления. Адаптивное мышление выключено по умолчанию в Claude Opus 4.7: запросы без поля thinking выполняются без мышления, что соответствует поведению Opus 4.6. Явно установите thinking: {type: "adaptive"}, чтобы включить его.
До (Claude Opus 4.6):
client.messages.create(
model="claude-opus-4-6",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)После (Claude Opus 4.7):
client.messages.create(
model="claude-opus-4-7",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"}, # or "max", "xhigh", "medium", "low"
messages=[{"role": "user", "content": "..."}],
)Адаптивное мышление управляется через подсказки. Рекомендации по настройке, когда модель думает слишком много или слишком мало, см. в разделе Калибровка усилия и глубины мышления.
Параметры сэмплирования удалены: Установка temperature, top_p или top_k в любое значение, отличное от значения по умолчанию, в Claude Opus 4.7 возвращает ошибку 400. Самый безопасный путь миграции — полностью исключить эти параметры из полезных нагрузок запросов. Подсказки — рекомендуемый способ управления поведением модели в Claude Opus 4.7. Если вы использовали temperature = 0 для детерминизма, обратите внимание, что это никогда не гарантировало идентичные выходные данные на предыдущих моделях.
Содержимое мышления опущено по умолчанию: Блоки мышления по-прежнему появляются в потоке ответа в Claude Opus 4.7, но их поле thinking пусто, если вы явно не включите его. Это незаметное изменение по сравнению с Claude Opus 4.6, где по умолчанию возвращался суммированный текст мышления. Чтобы восстановить суммированное содержимое мышления в Claude Opus 4.7, установите thinking.display в "summarized":
thinking = {
"type": "adaptive",
"display": "summarized",
}Значение по умолчанию — "omitted" в Claude Opus 4.7. Если ваш продукт передает рассуждения пользователям в потоковом режиме, новое значение по умолчанию выглядит как длинная пауза перед началом вывода; установите display: "summarized", чтобы восстановить видимый прогресс во время мышления. Подробности см. в разделе Расширенное мышление.
Обновленный подсчет токенов: Claude Opus 4.7 использует новый токенизатор, что способствует улучшению производительности на широком спектре задач. Новый токенизатор может использовать примерно от 1x до 1,35x больше токенов при обработке текста по сравнению с предыдущими моделями (до ~35% больше, в зависимости от контента).
/v1/messages/count_tokens вернет другое количество токенов для Claude Opus 4.7, чем для Claude Opus 4.6. Эффективность токенов может варьироваться в зависимости от формы рабочей нагрузки.
Вмешательства через подсказки, task_budget и effort могут помочь контролировать затраты и обеспечить надлежащее использование токенов. Эти элементы управления могут снижать интеллект модели. Обновите ваши параметры max_tokens, чтобы обеспечить дополнительный запас, включая триггеры сжатия. Claude Opus 4.7 предоставляет контекстное окно в 1M по стандартной цене API без надбавки за длинный контекст.
Удаление предзаполнения (перенесено из Opus 4.6): Предзаполнение сообщений ассистента возвращает ошибку 400 в Claude Opus 4.7. Вместо этого используйте структурированные выходные данные, инструкции в системной подсказке или output_config.format.
Параметр effort позволяет вам настраивать соотношение интеллекта Claude и расхода токенов, жертвуя возможностями ради более высокой скорости и более низких затрат. Начните с нового уровня усилия xhigh для кодирования и агентных сценариев использования и используйте минимум high для большинства сценариев, чувствительных к интеллекту. Экспериментируйте с другими уровнями усилия для дальнейшей настройки использования токенов и интеллекта:
max: Максимальное усилие может обеспечить прирост производительности в некоторых сценариях использования, но может демонстрировать убывающую отдачу от увеличенного использования токенов. Эта настройка также иногда может быть склонна к чрезмерному обдумыванию. Протестируйте максимальное усилие для задач, требующих интеллекта.xhigh (новый): Сверхвысокое усилие — лучшая настройка для большинства сценариев кодирования и агентных сценариев использования.high: Эта настройка балансирует использование токенов и интеллект. Для большинства сценариев, чувствительных к интеллекту, используйте минимум high.medium: Подходит для сценариев, чувствительных к затратам, которым необходимо сократить использование токенов, жертвуя интеллектом.low: Оставьте для коротких, ограниченных задач и чувствительных к задержке рабочих нагрузок, которые не чувствительны к интеллекту.Усилие важнее для этой модели, чем для любой предыдущей Opus. Активно экспериментируйте с ним при обновлении.
Claude Opus 4.7 имеет несколько поведенческих отличий от Claude Opus 4.6, которые не являются ломающими изменениями API, но могут потребовать обновления подсказок или удаления вспомогательных конструкций (scaffolding).
Длина ответа варьируется в зависимости от сценария использования: Claude Opus 4.7 калибрует длину ответа в соответствии с тем, насколько сложной он считает задачу, вместо того чтобы по умолчанию придерживаться фиксированной многословности. Обычно это означает более короткие ответы на простые запросы и значительно более длинные — на открытый анализ.
Если ваш продукт зависит от определённого стиля или многословности вывода, вам может потребоваться настроить ваши подсказки. Например, чтобы уменьшить многословность, добавьте: "Provide concise, focused responses. Skip non-essential context, and keep examples minimal." Если вы видите конкретные виды избыточных объяснений, добавьте целевые инструкции в вашу подсказку, чтобы предотвратить их.
Положительные примеры, показывающие, как Claude может общаться с надлежащим уровнем лаконичности, как правило, более эффективны, чем отрицательные примеры или инструкции, которые говорят модели, чего не делать.
Более буквальное следование инструкциям: Claude Opus 4.7 интерпретирует подсказки более буквально и явно, чем Claude Opus 4.6, особенно на более низких уровнях усилий. Он не будет молча обобщать инструкцию с одного элемента на другой и не будет домысливать запросы, которые вы не делали. Преимущество этого буквализма — точность и меньше лишних действий. Он, как правило, работает лучше для сценариев использования API с тщательно настроенными подсказками, структурированным извлечением данных и конвейерами, где вам нужно предсказуемое поведение. Проверка подсказок и обвязки (harness) может быть особенно полезна при миграции на Claude Opus 4.7.
Более прямой тон: Как и с любой новой моделью, стиль прозы при написании длинных текстов может измениться. Claude Opus 4.7 более прямой и имеет более выраженное мнение, с меньшим количеством одобряющих формулировок и меньшим количеством эмодзи, чем более тёплый стиль Claude Opus 4.6. Если ваш продукт полагается на определённый голос, переоцените стилевые подсказки относительно новой базовой линии.
Встроенные обновления о прогрессе в агентных трассах: Claude Opus 4.7 предоставляет более регулярные и качественные обновления для пользователя на протяжении длинных агентных трасс. Если вы добавили вспомогательные конструкции для принудительных промежуточных сообщений о статусе («После каждых 3 вызовов инструментов подведи итог прогресса»), попробуйте удалить их. Если вы обнаружите, что длина или содержание обновлений Claude Opus 4.7 для пользователя плохо откалиброваны для вашего сценария использования, явно опишите в подсказке, как должны выглядеть эти обновления, и предоставьте примеры.
Меньше субагентов по умолчанию: Claude Opus 4.7 по умолчанию склонен порождать меньше субагентов. Однако это поведение управляется через подсказки; дайте Claude Opus 4.7 явные указания о том, когда субагенты желательны.
Более строгая калибровка усилий: Существенно отличаясь от Claude Opus 4.6, Claude Opus 4.7 строго соблюдает уровни усилий, особенно на нижнем конце диапазона. На уровнях low и medium модель ограничивает свою работу тем, что было запрошено, вместо того чтобы делать больше необходимого.
Это хорошо для задержки (latency) и стоимости, но на умеренно сложных задачах, выполняемых с усилием low, есть некоторый риск недостаточного обдумывания. Если вы наблюдаете поверхностные рассуждения на сложных задачах, повысьте усилие до high или xhigh, вместо того чтобы обходить это подсказками.
Если вам нужно сохранить усилие на уровне low ради задержки, добавьте целевое указание: "This task involves multi-step reasoning. Think carefully through the problem before responding." См. Рекомендуемые уровни усилий для Claude Opus 4.7.
Меньше вызовов инструментов по умолчанию: Claude Opus 4.7 имеет тенденцию использовать инструменты реже, чем Claude Opus 4.6, и больше полагаться на рассуждения. В большинстве случаев это даёт лучшие результаты.
Чтобы увеличить использование инструментов, повысьте настройку усилия. Настройки усилия high или xhigh показывают существенно большее использование инструментов в агентном поиске и программировании. Вы также можете скорректировать вашу подсказку, чтобы явно проинструктировать модель о том, когда и как правильно использовать её инструменты.
Защитные механизмы кибербезопасности в реальном времени: Новое в Claude Opus 4.7: запросы, связанные с запрещёнными или высокорисковыми темами, могут приводить к отказам. Для легитимной работы в области безопасности, такой как тестирование на проникновение, исследование уязвимостей или red-teaming, подайте заявку в Cyber Verification Program, чтобы запросить снижение ограничений. См. Защитные механизмы, предупреждения и апелляции для получения дополнительной информации.
Поддержка изображений высокого разрешения: Claude Opus 4.7 — первая модель Claude с поддержкой изображений высокого разрешения. Максимальное разрешение изображения составляет 2576 пикселей по длинной стороне, по сравнению с 1568 пикселями у предыдущих моделей. Это открывает улучшения в рабочих нагрузках с интенсивным использованием зрения и особенно ценно для использования компьютера, понимания скриншотов и анализа документов.
Поддержка высокого разрешения работает автоматически и не требует бета-заголовка или включения на стороне клиента. Два момента, которые следует учесть:
max_tokens и ожидания по стоимости для рабочих нагрузок с большим количеством изображений или уменьшайте разрешение перед отправкой, если вам не нужна дополнительная детализация.См. Поддержка изображений высокого разрешения на Claude Opus 4.7 для подробностей.
Они не обязательны, но улучшат ваш опыт:
Переоцените max_tokens: Поскольку тот же текст даёт большее количество токенов на Claude Opus 4.7, обновите ваши параметры max_tokens, чтобы обеспечить дополнительный запас, включая триггеры компактизации. Вмешательства через подсказки, task_budget и effort могут помочь контролировать затраты и обеспечить надлежащее использование токенов.
Проверьте ожидания по количеству токенов: Любой путь в коде, который оценивает токены на стороне клиента или предполагает фиксированное соотношение токенов к символам, должен быть повторно протестирован на Claude Opus 4.7. Используйте конечную точку подсчёта токенов для проверки.
Внедрите бюджеты задач (бета): Claude Opus 4.7 вводит бюджеты задач. Эти бюджеты позволяют вам сообщить Claude, сколько токенов у него есть на полный агентный цикл, включая мышление, вызовы инструментов, результаты инструментов и финальный вывод. Модель видит текущий обратный отсчёт и использует его для приоритизации работы и корректного завершения задачи по мере расходования бюджета. Для использования установите бета-заголовок task-budgets-2026-03-13 и добавьте следующее в вашу конфигурацию вывода:
output_config = {
"effort": "high",
"task_budget": {"type": "tokens", "total": 128000},
}Возможно, вам потребуется поэкспериментировать с разными бюджетами задач для вашего сценария использования. Если модели задан слишком ограничивающий бюджет задачи, она может выполнить задачу менее тщательно, ссылаясь на свой бюджет как на ограничение.
Для открытых агентных задач, где качество важнее скорости, не устанавливайте бюджет задачи. Оставьте бюджеты задач для рабочих нагрузок, где вам нужно, чтобы модель ограничивала свою работу выделенным количеством токенов. Минимальное значение бюджета задачи — 20 тыс. токенов.
Бюджет задачи — это не жёсткий предел; это рекомендация, о которой модель осведомлена. Он отличается от max_tokens:
task_budget: рекомендательный предел на весь агентный цикл. Модель видит его и использует для регулирования темпа работы.max_tokens: жёсткий потолок на сгенерированные токены для каждого запроса. Он не передаётся модели, поэтому модель о нём не знает.Используйте task_budget, когда вы хотите, чтобы модель саморегулировалась, и max_tokens как жёсткий потолок для ограничения использования.
Установите большой max_tokens при усилии max или xhigh: Если вы запускаете Claude Opus 4.7 с усилием max или xhigh, установите большой максимальный бюджет выходных токенов, чтобы у модели было пространство для размышлений и действий через её субагентов и вызовы инструментов. Начните с 64 тыс. токенов и настраивайте дальше.
Уменьшайте разрешение изображений, если высокое разрешение не требуется: Claude Opus 4.7 поддерживает изображения до 2576 пикселей / 3,75 Мп. Изображения высокого разрешения используют больше токенов. Если дополнительная детализация изображения не нужна, уменьшайте разрешение изображений перед отправкой в Claude, чтобы избежать увеличения использования токенов. См. Изображения и зрение.
claude-opus-4-6 на claude-opus-4-7 (или обновите псевдонимы).temperature, top_p и top_k из полезных нагрузок запросов.thinking: {type: "enabled", budget_tokens: N} на thinking: {type: "adaptive"} плюс параметр effort.max_tokens с учётом обновлённой токенизации.xhigh или max, повысьте max_tokens как минимум до 64 тыс. в качестве отправной точки.Если вы мигрируете с Claude Opus 4.5, Opus 4.1 (устаревшая) или более ранней модели напрямую на Claude Opus 4.7, примените все изменения Opus 4.7 плюс накопленные изменения в этом разделе, которые вступили в силу между Opus 4.5 и Opus 4.7. Если вы мигрируете с Opus 4.6, вам нужен только раздел Opus 4.7.
# Миграция на Opus
model = "claude-opus-4-5" # Before
model = "claude-opus-4-7" # AfterУдаление предзаполнения (prefill) описано в ломающих изменениях Opus 4.7 выше.
Экранирование параметров инструментов: Claude Opus 4.6 и более поздние модели могут производить немного иное экранирование строк JSON в аргументах вызовов инструментов (например, иную обработку экранирования Unicode или экранирования прямых слэшей). Если вы разбираете input вызова инструмента как сырую строку, а не используете парсер JSON, проверьте вашу логику разбора. Стандартные парсеры JSON (такие как json.loads() или JSON.parse()) обрабатывают эти различия автоматически.
Эти изменения улучшают ваш опыт на Opus 4.7. Пункты, помеченные (обязательно на Opus 4.7), были необязательными рекомендациями при запуске Opus 4.6, но теперь обязательны; остальные остаются рекомендуемыми.
Мигрируйте на адаптивное мышление (обязательно на Opus 4.7): thinking: {type: "enabled", budget_tokens: N} возвращает ошибку 400 на Claude Opus 4.7. Переключитесь на thinking: {type: "adaptive"} и используйте параметр effort для управления глубиной мышления. См. Адаптивное мышление.
response = client.beta.messages.create(
model="claude-opus-4-5",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 32000},
betas=["interleaved-thinking-2025-05-14"],
messages=[{"role": "user", "content": "Your prompt here"}],
)Обратите внимание, что миграция также переходит с client.beta.messages.create на client.messages.create. Адаптивное мышление и effort являются общедоступными (GA) функциями и не требуют бета-пространства имён SDK или каких-либо бета-заголовков.
Удалите бета-заголовок effort: Параметр effort теперь общедоступен (GA). Удалите betas=["effort-2025-11-24"] из ваших запросов.
Удалите бета-заголовок детализированной потоковой передачи инструментов: Детализированная потоковая передача инструментов теперь общедоступна (GA). Удалите betas=["fine-grained-tool-streaming-2025-05-14"] из ваших запросов.
Удалите бета-заголовок чередующегося мышления: Адаптивное мышление автоматически включает чередующееся мышление на Claude Opus 4.7, Opus 4.6 и Sonnet 4.6. Удалите betas=["interleaved-thinking-2025-05-14"] из ваших запросов. Заголовок всё ещё работает на Sonnet 4.6 с ручным расширенным мышлением, но ручной режим устарел.
Мигрируйте на output_config.format: Если вы используете структурированные выводы, обновите output_format={...} на output_config={"format": {...}}. Старый параметр остаётся работоспособным, но устарел и будет удалён в будущем выпуске модели.
Если вы мигрируете с Opus 4.1 (устаревшая) или более ранних моделей напрямую на Claude Opus 4.7, примените изменения Claude Opus 4.7 в начале этого руководства и накопленные изменения выше, плюс дополнительные изменения в этом разделе.
# Из Opus 4.1
model = "claude-opus-4-1-20250805" # Before
model = "claude-opus-4-7" # After
# Из Sonnet 3.7
model = "claude-3-7-sonnet-20250219" # Before
model = "claude-opus-4-7" # AfterУдалите параметры сэмплирования
Это ломающее изменение при миграции с моделей Claude 3.x.
Начиная с Claude Opus 4.7, установка temperature, top_p или top_k в любое значение, отличное от значения по умолчанию, будет возвращать ошибку 400. Самый безопасный путь миграции — полностью исключить эти параметры из запросов и использовать подсказки для управления поведением модели. Если вы использовали temperature = 0 для детерминизма, обратите внимание, что это никогда не гарантировало идентичные выводы.
# До — это вызовет ошибку в моделях Claude 4+
response = client.messages.create(
model="claude-3-7-sonnet-20250219",
temperature=0.7,
top_p=0.9, # Non-default sampling params return 400 on Opus 4.7
# ...
)
# После
response = client.messages.create(
model="claude-opus-4-7",
# ...
)Обновите версии инструментов
Это ломающее изменение при миграции с моделей Claude 3.x.
Обновитесь до последних версий инструментов. Удалите любой код, использующий команду undo_edit.
# До
tools = [{"type": "text_editor_20250124", "name": "str_replace_editor"}]
# После
tools = [{"type": "text_editor_20250728", "name": "str_replace_based_edit_tool"}]text_editor_20250728 и str_replace_based_edit_tool. См. документацию по инструменту текстового редактора для подробностей.code_execution_20260521. См. документацию по инструменту выполнения кода для инструкций по миграции.Обрабатывайте причину остановки refusal
Обновите ваше приложение для обработки причин остановки refusal:
response = client.messages.create(...)
if response.stop_reason == "refusal":
# Обработайте отказ соответствующим образом
passОбрабатывайте причину остановки model_context_window_exceeded
Модели Claude 4.5+ возвращают причину остановки model_context_window_exceeded, когда генерация останавливается из-за достижения предела контекстного окна, а не запрошенного предела max_tokens. Обновите ваше приложение для обработки этой новой причины остановки:
response = client.messages.create(...)
if response.stop_reason == "model_context_window_exceeded":
# Обработайте превышение лимита контекстного окна соответствующим образом
passПроверьте обработку параметров инструментов (завершающие переводы строк)
Модели Claude 4.5+ сохраняют завершающие переводы строк в строковых параметрах вызовов инструментов, которые ранее удалялись. Если ваши инструменты полагаются на точное сопоставление строк с параметрами вызовов инструментов, убедитесь, что ваша логика корректно обрабатывает завершающие переводы строк.
Обновите ваши подсказки с учётом поведенческих изменений
Модели Claude 4+ имеют более лаконичный, прямой стиль общения и требуют явных указаний. Ознакомьтесь с лучшими практиками составления подсказок для рекомендаций по оптимизации.
token-efficient-tools-2025-02-19 и output-128k-2025-02-19. Все модели Claude 4+ имеют встроенное токен-эффективное использование инструментов, и эти заголовки не имеют эффекта.claude-opus-4-7output_config.formatthinking: {type: "enabled", budget_tokens: N} на thinking: {type: "adaptive"} плюс параметр effort (возвращает 400 на Opus 4.7)effort-2025-11-24 (effort теперь общедоступен)fine-grained-tool-streaming-2025-05-14interleaved-thinking-2025-05-14 (адаптивное мышление включает чередующееся мышление автоматически)output_format на output_config.format (если применимо)temperature, top_p и top_k (значения, отличные от значений по умолчанию, возвращают 400 на Opus 4.7)text_editor_20250728, code_execution_20260521)refusalmodel_context_window_exceededtoken-efficient-tools-2025-02-19, output-128k-2025-02-19)Claude Sonnet 5 предлагает лучшее сочетание скорости и интеллекта в семействе моделей Claude. Он основан на Claude Sonnet 4.6.
Claude Sonnet 5 — это прямая замена (drop-in upgrade) для Claude Sonnet 4.6 по той же цене $3 / $15 за миллион токенов (вводная цена $2 / $10 за миллион токенов до 31 августа 2026 года; см. Цены). Есть два ломающих изменения API для кода, уже работающего на Claude Sonnet 4.6: ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) и параметры сэмплирования (temperature, top_p, top_k), установленные в значения, отличные от значений по умолчанию, больше не принимаются и возвращают ошибку 400. Используйте вместо этого адаптивное мышление с параметром effort. Claude Sonnet 5 поддерживает тот же набор функций, что и Claude Sonnet 4.6, включая контекстное окно в 1 млн токенов, адаптивное мышление, кэширование подсказок, пакетную обработку, Files API, поддержку PDF, зрение и полный набор серверных и клиентских инструментов. Priority Tier недоступен на Claude Sonnet 5. Claude Sonnet 5 также использует новый токенизатор.
Если ваш код работает на Claude Sonnet 4.5 или более ранней версии, также примените шаги миграции на Claude Sonnet 4.6 перед обновлением до Claude Sonnet 5. Эти шаги включают ломающие изменения (отклонение предзаполнения сообщений ассистента, различия в экранировании JSON параметров инструментов), которые обновление до Sonnet 5 само по себе не покрывает.
# Миграция на Sonnet
model = "claude-sonnet-4-6" # Before
model = "claude-sonnet-5" # AfterПункты 4 и 5 в следующем списке являются ломающими изменениями. max_tokens остаётся жёстким пределом на общий вывод (мышление плюс текст ответа), поэтому пересмотрите его для рабочих нагрузок, которые работали без мышления на Claude Sonnet 4.6.
Новый токенизатор: Claude Sonnet 5 использует новый токенизатор. Тот же входной текст даёт примерно на 30% больше токенов, чем на Claude Sonnet 4.6. Точное увеличение зависит от содержимого. Запросы, ответы и события потоковой передачи сохраняют ту же форму, и изменения кода не требуются, но всё, что вы измеряете или бюджетируете в токенах, смещается: поля usage и результаты подсчёта токенов для того же текста выше, контекстное окно в 1 млн токенов вмещает меньше текста, а предел max_tokens, настроенный для Claude Sonnet 4.6, может обрезать эквивалентный вывод. Цена за токен не изменилась, поэтому стоимость эквивалентного запроса может отличаться. Повторно выполните подсчёт токенов на Claude Sonnet 5, вместо того чтобы повторно использовать подсчёты, измеренные на более ранних моделях.
Максимум 128 тыс. выходных токенов (без изменений): Claude Sonnet 5 поддерживает до 128 тыс. выходных токенов, так же как Claude Sonnet 4.6. Существующие значения max_tokens остаются действительными. Учитывайте новый токенизатор при их определении.
Предзаполнение сообщений ассистента (без изменений): Предзаполнение сообщения ассистента возвращает ошибку 400 на Claude Sonnet 5, так же как на Claude Sonnet 4.6. Если вы удалили предзаполнение при миграции на Claude Sonnet 4.6, дальнейшие изменения не требуются. Используйте вместо этого структурированные выводы, инструкции в системной подсказке или output_config.format.
Адаптивное мышление включено по умолчанию: На Claude Sonnet 4.6 запросы без поля thinking выполняются без мышления; на Claude Sonnet 5 те же запросы выполняются с адаптивным мышлением. Чтобы отключить мышление, передайте thinking: {type: "disabled"}. Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается и возвращает ошибку 400. Используйте параметр effort (по умолчанию high) для управления глубиной мышления.
Параметры сэмплирования удалены: Параметры сэмплирования (temperature, top_p, top_k), установленные в значение, отличное от значения по умолчанию, не принимаются и возвращают ошибку 400.
Защитные механизмы кибербезопасности: Claude Sonnet 5 — первая модель уровня Sonnet с защитными механизмами кибербезопасности в реальном времени. Запросы, связанные с запрещёнными или высокорисковыми темами кибербезопасности, могут быть отклонены. Отказы возвращаются как успешный HTTP-ответ 200 с stop_reason: "refusal", а не как ошибка. См. Защитные механизмы, предупреждения и апелляции для получения дополнительной информации.
claude-sonnet-4-6 на claude-sonnet-5.max_tokens, установленные близко к ожидаемой длине вывода, и повысьте их до максимума в 128 тыс. (без изменений по сравнению с Claude Sonnet 4.6), где это полезно.thinking: {type: "enabled", budget_tokens: N} (возвращает ошибку 400). Адаптивное мышление включено по умолчанию; передайте {type: "disabled"}, чтобы отключить его, или используйте параметр effort для управления глубиной.temperature, top_p и top_k, установленные в значения, отличные от значений по умолчанию (они возвращают ошибку 400 на Claude Sonnet 5).stop_reason: "refusal", если ваша рабочая нагрузка может затрагивать темы кибербезопасности.max_tokens для рабочих нагрузок, которые ранее работали без мышления.Claude Sonnet 4.6 сочетает высокий интеллект с быстрой производительностью, предлагая улучшенные возможности агентного поиска и бесплатное выполнение кода при использовании с веб-поиском или веб-загрузкой. Он идеален для повседневного программирования, анализа и задач с контентом.
Полный обзор возможностей см. в обзоре моделей.
Цена Sonnet 4.6 составляет $3 за миллион входных токенов, $15 за миллион выходных токенов. См. цены Claude для подробностей.
Обновите имя модели:
# Из Sonnet 4.5
model = "claude-sonnet-4-5" # Before
model = "claude-sonnet-4-6" # AfterПредзаполнение сообщений ассистента больше не поддерживается
Это ломающее изменение при миграции с Sonnet 4.5 или более ранних версий.
Предзаполнение сообщений ассистента возвращает ошибку 400 на Sonnet 4.6. Используйте вместо этого структурированные выводы, инструкции в системной подсказке или output_config.format.
Распространённые сценарии использования предзаполнения и их миграция:
Управление форматированием вывода (принудительный вывод JSON/YAML): Используйте структурированные выводы или инструменты с полями enum для задач классификации.
Устранение преамбул (удаление фраз вида «Вот...»): Добавьте прямые инструкции в системную подсказку: "Respond directly without preamble. Do not start with phrases like 'Here is...', 'Based on...', etc."
Избежание необоснованных отказов: Claude теперь значительно лучше справляется с уместными отказами. Чёткой подсказки в сообщении пользователя без предзаполнения должно быть достаточно.
Продолжения (возобновление прерванных ответов): Перенесите продолжение в сообщение пользователя: «Ваш предыдущий ответ был прерван и закончился на [previous_response]. Продолжите с того места, где остановились.»
Гидратация контекста / согласованность роли (обновление контекста в длинных разговорах): Вместо этого вставляйте то, что ранее было напоминаниями в предзаполненных сообщениях ассистента, в реплику пользователя.
Экранирование JSON в параметрах инструментов может отличаться
Это ломающее изменение при миграции с Sonnet 4.5 или более ранних версий.
Экранирование строк JSON в параметрах инструментов может отличаться от предыдущих моделей. Стандартные парсеры JSON обрабатывают это автоматически, но пользовательский разбор на основе строк может потребовать обновлений.
Обновите параметры сэмплирования
Это ломающее изменение при миграции с моделей Claude 3.x.
Используйте только temperature ИЛИ top_p, но не оба.
Обновите версии инструментов
Это ломающее изменение при миграции с моделей Claude 3.x.
Обновитесь до последних версий инструментов (text_editor_20250728, code_execution_20260521). Удалите любой код, использующий команду undo_edit.
Обрабатывайте причину остановки refusal
Обновите ваше приложение для обработки причин остановки refusal.
Обновите ваши подсказки с учётом поведенческих изменений
Модели Claude 4 имеют более лаконичный, прямой стиль общения. Ознакомьтесь с лучшими практиками составления подсказок для рекомендаций по оптимизации.
fine-grained-tool-streaming-2025-05-14: Детализированная потоковая передача инструментов теперь общедоступна (GA) на Sonnet 4.6 и больше не требует бета-заголовка.output_format на output_config.format: Параметр output_format устарел. Используйте вместо него output_config.format.Рассмотрите возможность миграции с Sonnet 4.5 на Sonnet 4.6, который обеспечивает больший интеллект при той же цене.
Sonnet 4.6 по умолчанию использует уровень усилий high, в отличие от Sonnet 4.5, у которого не было параметра усилий. Рассмотрите возможность настройки параметра усилий при миграции с Sonnet 4.5 на Sonnet 4.6. Если он не задан явно, вы можете столкнуться с более высокой задержкой при уровне усилий по умолчанию.
Если вы не используете расширенное мышление на Sonnet 4.5, вы можете продолжать без него на Sonnet 4.6. Вам следует явно установить уровень усилий, подходящий для вашего случая использования. При уровне усилий low с отключённым мышлением вы можете ожидать аналогичную или лучшую производительность по сравнению с Sonnet 4.5 без расширенного мышления.
response = client.messages.create(
model="claude-sonnet-4-6",
max_tokens=8192,
output_config={"effort": "low"},
messages=[{"role": "user", "content": "Your prompt here"}],
)Если вы используете расширенное мышление с budget_tokens на Sonnet 4.5, оно всё ещё функционирует на Sonnet 4.6, но является устаревшим. Мигрируйте на адаптивное мышление с параметром усилий.
Адаптивное мышление — это рекомендуемая замена budget_tokens на Sonnet 4.6. Оно особенно хорошо подходит для следующих типов рабочих нагрузок:
high. Если задержка или использование токенов вызывают беспокойство, снизьте до medium.При использовании адаптивного мышления оцените уровни усилий medium и high на ваших задачах. Правильный уровень зависит от компромисса вашей рабочей нагрузки между качеством, задержкой и использованием токенов.
response = client.messages.create(
model="claude-sonnet-4-6",
max_tokens=64000,
thinking={"type": "adaptive"},
output_config={"effort": "medium"},
messages=[{"role": "user", "content": "Your prompt here"}],
)Если вы наблюдаете непоследовательное поведение или снижение качества при адаптивном мышлении, попробуйте сначала снизить настройку усилий или использовать max_tokens в качестве жёсткого ограничения. Расширенное мышление с budget_tokens всё ещё функционирует на Sonnet 4.6, но является устаревшим и больше не рекомендуется.
Если вам нужно временно сохранить budget_tokens во время миграции, бюджет около 16 тыс. токенов обеспечивает запас для более сложных задач без риска неконтролируемого использования токенов. Эта конфигурация устарела и будет удалена в будущем выпуске модели.
Для агентного написания кода, дизайна фронтенда, рабочих процессов с интенсивным использованием инструментов и сложных корпоративных рабочих процессов начните с уровня усилий medium. Если вы обнаружите, что задержка слишком высока, рассмотрите возможность снижения усилий до low. Если вам нужен более высокий интеллект, рассмотрите возможность увеличения усилий до high или миграции на Opus 4.7.
response = client.beta.messages.create(
model="claude-sonnet-4-6",
max_tokens=16384,
thinking={"type": "enabled", "budget_tokens": 16384},
output_config={"effort": "medium"},
betas=["interleaved-thinking-2025-05-14"],
messages=[{"role": "user", "content": "Your prompt here"}],
)Для чата, генерации контента, поиска, классификации и других задач, не связанных с написанием кода, начните с уровня усилий low с расширенным мышлением. Если вам нужна большая глубина, увеличьте усилия до medium.
response = client.beta.messages.create(
model="claude-sonnet-4-6",
max_tokens=8192,
thinking={"type": "enabled", "budget_tokens": 16384},
output_config={"effort": "low"},
betas=["interleaved-thinking-2025-05-14"],
messages=[{"role": "user", "content": "Your prompt here"}],
)claude-sonnet-4-6output_config.formattext_editor_20250728, code_execution_20260521); устаревшие версии не поддерживаются (при миграции с 3.x)undo_edit (если применимо)temperature ИЛИ top_p, но не оба (при миграции с 3.x)refusal в вашем приложенииfine-grained-tool-streaming-2025-05-14 (теперь общедоступно)output_format на output_config.formatthinking: {type: "enabled", budget_tokens: N} на thinking: {type: "adaptive"} с параметром усилий (budget_tokens устарел и будет удалён в будущем выпуске)Claude Sonnet 4.5 сочетает высокий интеллект с быстрой производительностью, что делает его идеальным для повседневного написания кода, анализа и задач с контентом.
Для полного обзора возможностей см. обзор моделей.
Цена Sonnet 4.5 составляет $3 за миллион входных токенов, $15 за миллион выходных токенов. Подробности см. в разделе Цены Claude.
Обновите имя вашей модели:
# Из Sonnet 3.7
model = "claude-3-7-sonnet-20250219" # Before
model = "claude-sonnet-4-5-20250929" # AfterЭти критические изменения применяются при миграции с моделей Claude 3.x Sonnet.
Обновите параметры сэмплирования
Это критическое изменение при миграции с моделей Claude 3.x.
Используйте только temperature ИЛИ top_p, но не оба.
Обновите версии инструментов
Это критическое изменение при миграции с моделей Claude 3.x.
Обновите до последних версий инструментов (text_editor_20250728, code_execution_20260521). Удалите любой код, использующий команду undo_edit.
Обработайте причину остановки refusal
Обновите ваше приложение для обработки причин остановки refusal.
Обновите ваши подсказки с учётом поведенческих изменений
Модели Claude 4 имеют более лаконичный, прямой стиль общения. Ознакомьтесь с лучшими практиками создания подсказок для получения рекомендаций по оптимизации.
claude-sonnet-4-5-20250929text_editor_20250728, code_execution_20260521); устаревшие версии не поддерживаются (при миграции с 3.x)undo_edit (если применимо)temperature ИЛИ top_p, но не оба (при миграции с 3.x)refusal в вашем приложенииClaude Haiku 4.5 — это самая быстрая и самая интеллектуальная модель Haiku с производительностью, близкой к передовой, обеспечивающая качество премиальной модели для интерактивных приложений и высокообъёмной обработки.
Для полного обзора возможностей см. обзор моделей.
Цена Haiku 4.5 составляет $1 за миллион входных токенов, $5 за миллион выходных токенов. Подробности см. в разделе Цены Claude.
Обновите имя вашей модели:
# Из Haiku 3.5
model = "claude-3-5-haiku-20241022" # Before
model = "claude-haiku-4-5-20251001" # AfterОзнакомьтесь с новыми ограничениями скорости: Haiku 4.5 имеет отдельные ограничения скорости от Haiku 3.5. Подробности см. в документации по ограничениям скорости.
Для значительного улучшения производительности в задачах написания кода и рассуждения рассмотрите возможность включения расширенного мышления с thinking: {type: "enabled", budget_tokens: N}.
Расширенное мышление влияет на эффективность кэширования подсказок.
Расширенное мышление устарело в моделях Claude 4.6 и удалено в Claude Opus 4.7. Если вы используете более новые модели, используйте вместо этого адаптивное мышление.
Изучите новые возможности: См. обзор моделей для получения подробной информации об осведомлённости о контексте, увеличенной выходной ёмкости (64 тыс. токенов), более высоком интеллекте и улучшенной скорости.
Эти критические изменения применяются при миграции с моделей Claude 3.x Haiku.
Обновите параметры сэмплирования
Это критическое изменение при миграции с моделей Claude 3.x.
Используйте только temperature ИЛИ top_p, но не оба.
Обновите версии инструментов
Это критическое изменение при миграции с моделей Claude 3.x.
Обновите до последних версий инструментов (text_editor_20250728, code_execution_20250825). Удалите любой код, использующий команду undo_edit.
Обработайте причину остановки refusal
Обновите ваше приложение для обработки причин остановки refusal.
Обновите ваши подсказки с учётом поведенческих изменений
Модели Claude 4 имеют более лаконичный, прямой стиль общения. Ознакомьтесь с лучшими практиками создания подсказок для получения рекомендаций по оптимизации.
claude-haiku-4-5-20251001text_editor_20250728, code_execution_20250825); устаревшие версии не поддерживаютсяundo_edit (если применимо)temperature ИЛИ top_p, но не обаrefusal в вашем приложенииWas this page helpful?