Claude Opus 5 — это качественный скачок по сравнению с Claude Opus 4.8, с наибольшими улучшениями в глубоком рассуждении, агентных и долгосрочных задачах, а также в масштабировании вычислений во время тестирования. Эта страница обобщает всё новое в Claude Opus 5, включая мышление, включённое по умолчанию, изменения инструментов в середине разговора и критическое изменение в том, когда мышление может быть отключено.
| Модель | ID модели в API | Описание |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | Для сложного агентного программирования и корпоративной работы |
Claude Opus 5 имеет контекстное окно в 1M токенов (1M токенов — это и значение по умолчанию, и максимум; меньшего варианта контекста нет), максимум 128k выходных токенов и мышление, включённое по умолчанию.
Полную информацию о ценах и характеристиках см. в обзоре моделей.
Вы можете добавлять или удалять инструменты между ходами разговора, сохраняя кэш подсказок, вместо повторной отправки фиксированного списка инструментов на протяжении всей сессии. Изменения инструментов в середине разговора находятся в бета-версии: включите бета-заголовок mid-conversation-tool-changes-2026-07-01 в ваши запросы. См. Изменения инструментов в середине разговора для информации об использовании.
Параметр fallbacks поддерживает новый режим "default", который применяет рекомендованные Anthropic резервные модели по категории отказа вместо списка моделей, который вы поддерживаете самостоятельно. Весь параметр fallbacks находится в бета-версии. Используйте бета-заголовок server-side-fallback-2026-07-01, который поддерживает как режим "default", так и явные списки моделей (более ранний заголовок server-side-fallback-2026-06-01 принимает только явные списки). См. Отказы и резервные модели.
Минимальная длина кэшируемой подсказки на Claude Opus 5 составляет 512 токенов, по сравнению с 1 024 токенами на Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования на Claude Opus 4.8, теперь могут создавать записи в кэше без изменений кода. См. Кэширование подсказок для минимумов по каждой модели.
Быстрый режим (исследовательская предварительная версия) доступен для Claude Opus 5 только в Claude API; в настоящее время он недоступен на Amazon Bedrock, Google Cloud или Microsoft Foundry. Быстрый режим для Claude Opus 5 стоит $10 за миллион входных токенов и $50 за миллион выходных токенов. См. Быстрый режим для информации о доступе, поддерживаемых моделях и ценах.
На Claude Opus 4.8 запросы выполняются без мышления, если вы не установите thinking: {"type": "adaptive"}. На Claude Opus 5 те же запросы выполняются с включённым мышлением: модель решает, когда и сколько думать на каждом ходу, а параметр effort является средством управления глубиной мышления. Значение в запросе не изменилось; thinking: {"type": "adaptive"} остаётся допустимым и эквивалентным значению по умолчанию.
Поскольку max_tokens является жёстким ограничением на общий вывод (мышление плюс текст ответа), пересмотрите его для рабочих нагрузок, которые выполнялись без мышления на Claude Opus 4.8.
API сохраняет возможность отключить мышление с учётом ограничения по effort, описанного ниже.
Claude Opus 5 преобразует дополнительный effort в лучшие результаты более надёжно, чем любая более ранняя модель Opus, поэтому выбранный вами уровень effort имеет больший вес. Доступна полная шкала: low, medium, high, xhigh и max, где max — это высший уровень для максимально глубокого рассуждения. Начните со значения по умолчанию, high, и корректируйте в любую сторону на основе ваших оценок: понижайте там, где качество сохраняется, чтобы сэкономить токены и задержку, или повышайте для самой требовательной работы. При работе с effort xhigh или max установите большое значение max_tokens, чтобы у модели было пространство для размышлений и действий через субагентов и вызовы инструментов.
Этот запрос повышает effort до максимума — max:
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)Мышление включено по умолчанию на Claude Opus 5, поэтому поле thinking не требуется.
high или нижеНа Claude Opus 5 thinking: {"type": "disabled"} принимается только тогда, когда уровень effort равен high или ниже. Установка thinking: {"type": "disabled"} с effort xhigh или max возвращает ошибку 400. Это общедоступное поведение начиная с Claude Opus 5, применяемое к каждому запросу, и это критическое изменение по сравнению с Claude Opus 4.8, где отключение мышления не зависело от уровня effort. Если вы сегодня отключаете мышление на высоких уровнях effort, либо оставьте мышление отключённым и установите effort на high или ниже, либо сохраните уровень effort и удалите поле thinking.
С отключённым мышлением Claude Opus 5 может иногда записывать вызов инструмента в свой текстовый вывод вместо выдачи блока tool_use или включать внутренние XML-теги в свой видимый ответ. По возможности оставляйте мышление включённым и контролируйте стоимость токенов с помощью более низких уровней effort; для интеграций, которые должны держать мышление отключённым, см. Работа с отключённым мышлением для смягчающих приёмов в подсказках.
Помимо изменений API, описанных выше, Claude Opus 5 ведёт себя иначе, чем Claude Opus 4.8, и вы можете заметить это без изменения какого-либо кода. Ответы, обращённые к пользователю по умолчанию, и письменные результаты работы становятся длиннее. В агентных сессиях модель чаще рассказывает пользователю о своём прогрессе. В многоагентных фреймворках она охотнее делегирует задачи субагентам. Она также проверяет свою собственную работу без указаний, поэтому удалите инструкции по проверке, перенесённые из более ранних моделей («включите финальный шаг проверки», «используйте субагента для проверки»); они вызывают избыточную проверку на Claude Opus 5. Для шаблонов подсказок, которые настраивают каждое из этих поведений, см. Подсказки для Claude Opus 5.
По сравнению с Claude Opus 4.8, Claude Opus 5 представляет собой качественный скачок, а не постепенное улучшение, и обеспечивает передовой интеллект за половину стоимости Claude Fable 5. Наибольшие улучшения:
max) в лучшие результаты.low и medium обеспечивают высокое качество при доле токенов и задержки более высоких настроек.Для шаблонов подсказок, которые позволяют максимально использовать эти возможности, см. Подсказки для Claude Opus 5.
Claude Opus 5 стоит $5 за миллион входных токенов и $25 за миллион выходных токенов, без изменений по сравнению с Claude Opus 4.8.
См. Цены для полной информации о ценах, включая пакетную обработку, кэширование подсказок и тарифы быстрого режима.
Claude Opus 5 доступен на:
claude-opus-5.anthropic.claude-opus-5. Claude Opus 5 также доступен через API InvokeModel на bedrock-runtime, обслуживаемый той же инфраструктурой; интеграция Claude на Amazon Bedrock (устаревшая) не включает его в свою таблицу ID моделей с версионированием по ARN.claude-opus-5.Claude Opus 4.8 остаётся доступным на всех этих платформах.
Чтобы мигрировать с Claude Opus 4.8, обновите ID вашей модели:
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # AfterЗатем ознакомьтесь с двумя изменениями в поведении: мышление включено по умолчанию, а отключение мышления с effort xhigh или max возвращает ошибку 400. См. руководство по миграции для пошаговых инструкций.
Полные характеристики и цены для всех текущих моделей Claude.
Поведенческие различия и шаблоны подсказок, специфичные для Claude Opus 5.
Управляйте количеством токенов, которые Claude использует при ответе, от low до max.
Как работает мышление, когда оно включено по умолчанию, и когда его можно отключить.
Дайте Claude рекомендательный бюджет токенов, на который он будет ориентироваться в своей работе.
Руководство по миграции на последние модели Claude с предыдущих версий Claude.
Получайте больше выходных токенов в секунду от моделей Claude Opus по премиальной цене.
Was this page helpful?