Claude Platform Docs
Модели и ценыClaude Opus 5

Что нового в Claude Opus 5

Обзор новых функций и изменений поведения в Claude Opus 5.

Claude Opus 5 — это качественный скачок по сравнению с Claude Opus 4.8, с наибольшим приростом в глубоких рассуждениях, агентных и долгосрочных задачах, а также в масштабировании вычислений во время инференса. На этой странице кратко изложено всё новое в Claude Opus 5, включая изменение инструментов в середине разговора и два критических изменения для кода, работающего на Claude Opus 4.8: мышление включено по умолчанию, и мышление можно отключить только при уровне effort high или ниже.

Новая модель

МодельID модели в APIОписание
Claude Opus 5claude-opus-5Для сложного агентного программирования и корпоративной работы

Claude Opus 5 имеет «context window» (контекстное окно) размером 1M токенов (1M токенов — это и значение по умолчанию, и максимум; варианта с меньшим контекстом нет), максимум 128k выходных токенов и мышление, включённое по умолчанию. Priority Tier не поддерживается на Claude Opus 5.

Полные цены и характеристики см. в обзоре моделей.

Новые функции

Изменение инструментов в середине разговора (бета)

Вы можете добавлять или удалять инструменты между ходами разговора, сохраняя кэш подсказок, вместо того чтобы повторно отправлять фиксированный список инструментов на протяжении всей сессии. Изменение инструментов в середине разговора находится в бета-версии: включите бета-заголовок mid-conversation-tool-changes-2026-07-01 в ваши запросы. Об использовании см. Изменение инструментов в середине разговора.

Режим резервных моделей по умолчанию

Параметр fallbacks поддерживает новый режим "default", который применяет рекомендованные Anthropic резервные модели по категориям отказов вместо списка моделей, который вы поддерживаете самостоятельно. Весь параметр fallbacks находится в бета-версии. Используйте бета-заголовок server-side-fallback-2026-07-01, который поддерживает как режим "default", так и явные списки моделей (более ранний заголовок server-side-fallback-2026-06-01 принимает только явные списки). См. Отказы и резервные модели.

Сниженный минимум для кэша подсказок

Минимальная кэшируемая длина подсказки на Claude Opus 5 составляет 512 токенов, по сравнению с 1 024 токенами на Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования на Claude Opus 4.8, теперь могут создавать записи кэша без изменений в коде. Минимумы для каждой модели см. в разделе «prompt caching» (кэширование подсказок).

Быстрый режим

Быстрый режим (исследовательская предварительная версия) доступен для Claude Opus 5 только в Claude API; в настоящее время он недоступен на Amazon Bedrock, Claude Platform на AWS, Google Cloud или Microsoft Foundry. Быстрый режим для Claude Opus 5 стоит $10 за миллион входных токенов и $50 за миллион выходных токенов. Информацию о доступе, поддерживаемых моделях и ценах см. в разделе Быстрый режим.

Изменения поведения

Мышление включено по умолчанию

На Claude Opus 4.8 запросы выполняются без мышления, если вы не установите thinking: {"type": "adaptive"}. На Claude Opus 5 те же запросы выполняются с адаптивным мышлением, включённым по умолчанию: модель решает, когда и сколько думать на каждом ходу, а параметр effort служит средством управления глубиной мышления. Значение, передаваемое по сети, не изменилось; thinking: {"type": "adaptive"} остаётся допустимым и эквивалентным значению по умолчанию.

Это критическое изменение для кода, который работал без мышления на Claude Opus 4.8. Ответ может начинаться с одного или нескольких блоков thinking перед первым блоком text, возвращаемых с пустым полем thinking при значении по умолчанию display: "omitted", поэтому код, который читает content[0].text или рассматривает первый переданный потоком блок содержимого как текст, должен вместо этого выбирать блоки содержимого по их полю type. Циклы использования инструментов должны передавать блоки thinking обратно полностью и без изменений вместе с результатами инструментов; см. Сохранение блоков мышления.

Токены мышления тарифицируются как выходные токены и учитываются в max_tokens — жёстком ограничении на общий объём вывода (мышление плюс текст ответа), поэтому пересмотрите max_tokens и заново оцените базовую стоимость для рабочих нагрузок, которые выполнялись без мышления на Claude Opus 4.8.

API сохраняет возможность отключить мышление с учётом ограничения по effort на его отключение.

Effort имеет большее значение

Claude Opus 5 преобразует дополнительный effort в лучшие результаты надёжнее, чем любая более ранняя модель Opus, поэтому выбранный вами уровень effort имеет больший вес. Доступна полная шкала: low, medium, high, xhigh и max, где max — высший уровень для максимально глубоких рассуждений. Начните со значения по умолчанию, high, и корректируйте в любую сторону на основе ваших оценок: понижайте там, где качество сохраняется, чтобы сэкономить токены и снизить задержку, или повышайте для самой требовательной работы. При работе на уровне effort xhigh или max установите большое значение max_tokens, чтобы у модели было пространство для размышлений и действий с использованием субагентов и вызовов инструментов.

Этот запрос поднимает effort до максимального уровня max:

client = anthropic.Anthropic()

with client.messages.stream(
    model="claude-opus-5",
    max_tokens=64000,
    output_config={"effort": "max"},
    messages=[
        {
            "role": "user",
            "content": "Explain why the sum of two even numbers is always even.",
        }
    ],
) as stream:
    response = stream.get_final_message()

print(response)

Мышление включено по умолчанию на Claude Opus 5, поэтому поле thinking не требуется.

Отключение мышления требует effort high или ниже

На Claude Opus 5 thinking: {"type": "disabled"} принимается только тогда, когда уровень effort равен high или ниже. Установка thinking: {"type": "disabled"} с effort xhigh или max возвращает ошибку 400. Это правило применяется к каждому запросу к Claude Opus 5 и более поздним моделям. Это критическое изменение по сравнению с Claude Opus 4.8, где отключение мышления не зависело от уровня effort. Если ваши запросы к Claude Opus 4.8 отключают мышление при effort xhigh или max, либо оставьте мышление отключённым и установите effort на high или ниже, либо сохраните уровень effort и удалите поле thinking.

При отключённом мышлении Claude Opus 5 может иногда записывать вызов инструмента в свой текстовый вывод вместо выдачи блока tool_use или включать внутренние XML-теги в свой видимый ответ. По возможности оставляйте мышление включённым и управляйте стоимостью токенов с помощью более низких уровней effort; для интеграций, которые должны держать мышление отключённым, см. Работа с отключённым мышлением о смягчающих приёмах в подсказках.

Различия в поведении модели

Помимо этих изменений API, Claude Opus 5 ведёт себя иначе, чем Claude Opus 4.8, и вы можете заметить это, не меняя никакого кода. Ответы пользователю по умолчанию и письменные результаты работы стали длиннее. В агентных сессиях модель чаще рассказывает пользователю о своём прогрессе. В мультиагентных фреймворках она охотнее делегирует задачи субагентам. Она также проверяет собственную работу без указаний, поэтому удалите инструкции по проверке, перенесённые из более ранних моделей («включи финальный шаг проверки», «используй субагента для проверки»); на Claude Opus 5 они приводят к избыточной проверке. Приёмы составления подсказок для настройки каждого из этих видов поведения см. в разделе Составление подсказок для Claude Opus 5.

Улучшения возможностей

По сравнению с Claude Opus 4.8, Claude Opus 5 — это качественный скачок, а не постепенное улучшение, и он обеспечивает передовой интеллект за половину стоимости Claude Fable 5. Наибольший прирост достигнут в следующих областях:

  • Глубокие рассуждения — поддержание многошагового анализа на протяжении длинных цепочек задач.
  • Агентное программирование и долгосрочные задачи — удержание фокуса на задаче в продолжительных циклах использования инструментов и завершение многофайловых функций, крупных рефакторингов и сквозной работы над функциональностью без оставления заглушек или заполнителей.
  • Масштабирование вычислений во время инференса — преобразование дополнительного effort (вплоть до уровня max) в лучшие результаты.
  • Эффективность на низких уровнях effort — уровни effort low и medium обеспечивают высокое качество при доле токенов и задержки по сравнению с более высокими настройками.
  • Ревью кода и поиск ошибок — выявление реальных ошибок с высокой частотой за проход при малом числе ложных срабатываний и сохранение точности на низких уровнях effort.
  • Зрение — понимание графиков, документов и диаграмм, а также воспроизведение UI и визуальных элементов фронтенда; наилучшие результаты достигаются при наличии инструментов для итеративного анализа, обрезки и проверки своей работы.
  • Работа с длинным контекстомконтекстное окно в 1M токенов как значение по умолчанию и максимум, а также стабильное следование инструкциям, вызов инструментов и рассуждения на протяжении всего окна.
  • Офисные задачи и работа с документами — создание и редактирование сложных многолистовых электронных таблиц с нетривиальными формулами и подготовка хорошо структурированных презентаций.
  • Мультиагентная координация — управление командами субагентов с эффективными паттернами «автор — проверяющий» и редкими случаями, когда агенты перезаписывают работу друг друга.

Приёмы составления подсказок, позволяющие максимально использовать эти возможности, см. в разделе Составление подсказок для Claude Opus 5.

Цены

Claude Opus 5 стоит $5 за миллион входных токенов и $25 за миллион выходных токенов — без изменений по сравнению с Claude Opus 4.8. Поскольку мышление включено по умолчанию, а токены мышления тарифицируются как выходные токены, рабочая нагрузка, которая выполнялась без мышления на Claude Opus 4.8, может производить больше выходных токенов на запрос при тех же тарифах за токен; см. Контроль стоимости.

Полные цены, включая тарифы на пакетную обработку, кэширование подсказок и быстрый режим, см. в разделе Цены.

Доступность

Claude Opus 5 доступен на:

Claude Opus 4.8 остаётся доступным на всех этих платформах.

Руководство по миграции

Чтобы мигрировать с Claude Opus 4.8, обновите ID модели:

model = "claude-opus-4-8"  # Before
model = "claude-opus-5"  # After

Затем ознакомьтесь с двумя критическими изменениями в разделе Изменения поведения: мышление включено по умолчанию (ответы могут начинаться с блоков thinking, поэтому выбирайте блоки содержимого по type), а отключение мышления при effort xhigh или max возвращает ошибку 400. Пошаговые инструкции и полный контрольный список см. в руководстве по миграции.

Следующие шаги

Полные характеристики и цены для всех актуальных моделей Claude.

Различия в поведении и приёмы составления подсказок, специфичные для Claude Opus 5.

Управляйте тем, сколько токенов Claude использует при ответе, от low до max.

Как работает мышление, когда оно включено по умолчанию, и когда его можно отключить.

Задайте Claude рекомендательный бюджет токенов, чтобы он распределял свою работу в его рамках.

Руководство по миграции на новейшие модели Claude с предыдущих версий Claude.

Получайте больше выходных токенов в секунду от моделей Claude Opus по премиальной цене.

Was this page helpful?