Claude Platform Docs
MessagesВозможности модели

Уровень усилий

Управляйте тем, сколько токенов Claude использует при ответе, с помощью параметра effort, находя баланс между тщательностью ответа и эффективностью использования токенов.

Параметр «effort» (усилие) позволяет управлять тем, сколько токенов Claude тратит при ответе на запросы. Вы можете находить баланс между тщательностью ответа и эффективностью расхода токенов в рамках одной модели. Параметр effort верхнего уровня доступен на всех поддерживаемых моделях и не требует бета-заголовка. Уровень усилий для отдельных сообщений находится в бета-версии.

Установка уровня усилия

Задайте output_config.effort в запросе. В следующем примере выполняется один запрос с усилием medium и выводится текст ответа.

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-opus-5-5",
    max_tokens=4096,
    messages=[
        {
            "role": "user",
            "content": "Analyze the trade-offs between microservices and monolithic architectures",
        }
    ],
    output_config={"effort": "medium"},
)

for block in response.content:
    if block.type == "text":
        print(block.text)

Как работает уровень усилий

Большинство моделей Claude по умолчанию используют высокий уровень усилий, тратя столько токенов, сколько необходимо для отличных результатов; для Claude Opus 5.5 и Claude Haiku 5.5 по умолчанию используется средний уровень. Вы можете повысить уровень усилий до max для достижения абсолютно максимальных возможностей или понизить его, чтобы экономнее расходовать токены, оптимизируя скорость и стоимость ценой некоторого снижения возможностей.

Параметр effort влияет на все токены в ответе, включая:

  • Текстовые ответы и пояснения
  • Вызовы инструментов и аргументы функций
  • Размышления (когда они активны)

Поскольку уровень усилий применяется к каждому выходному токену, он работает независимо от того, включены ли размышления. Более низкий уровень усилий также означает меньшее количество вызовов инструментов и их большую лаконичность.

Уровни усилий

УровеньОписаниеТипичный сценарий использования
maxАбсолютно максимальные возможности без ограничений на расход токенов. Доступен в Claude Fable 5.1, Claude Mythos 5.1, Claude Fable 5, Claude Mythos 5, Claude Mythos Preview, Claude Opus 5.5, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5.5, Claude Sonnet 5, Claude Sonnet 4.6 и Claude Haiku 5.5.Задачи, требующие максимально глубоких рассуждений и наиболее тщательного анализа
xhighРасширенные возможности для долгосрочной работы. Доступен в Claude Fable 5.1, Claude Mythos 5.1, Claude Fable 5, Claude Mythos 5, Claude Opus 5.5, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Sonnet 5.5, Claude Sonnet 5 и Claude Haiku 5.5.Длительные агентные задачи и задачи программирования (более 30 минут) с бюджетами токенов в миллионы
highТратит столько токенов, сколько требуется задаче для отличных результатов. Значение по умолчанию для всех моделей, поддерживающих уровень усилий, кроме Claude Opus 5.5 и Claude Haiku 5.5.Сложные рассуждения, трудные задачи программирования, агентные задачи
mediumСбалансированный подход с умеренной экономией токенов. Значение по умолчанию для Claude Opus 5.5 и Claude Haiku 5.5.Агентные задачи, требующие баланса скорости, стоимости и производительности
lowНаиболее эффективный. Значительная экономия токенов с некоторым снижением возможностей.Более простые задачи, требующие максимальной скорости и минимальных затрат, например субагенты

Не каждая модель, поддерживающая max, поддерживает xhigh.

Приведённые ниже рекомендации для отдельных моделей имеют приоритет над этой таблицей там, где они расходятся.

Claude Fable 5.1 поддерживает все пять уровней усилия. Начните с high, значения по умолчанию. Поднимайтесь до xhigh или max для наиболее чувствительной к возможностям агентной работы и программирования и опускайтесь до medium или low для рутинной или чувствительной к задержкам работы, как только ваши оценки покажут, что качество сохраняется. На уровне high и выше задавайте большое значение max_tokens. Это жёсткий лимит на общий объём вывода (размышления плюс текст ответа). Те же рекомендации применимы к Claude Mythos 5.1. См. Составление подсказок для Claude Fable 5.1.

Claude Fable 5.1 также поддерживает изменение усилия в ходе разговора с помощью output_config на уровне сообщения, что сохраняет кэш подсказок.

Усилие — основной элемент управления балансом между интеллектом, задержкой и стоимостью на Claude Fable 5. Начните с high, значения по умолчанию, для большинства задач, используйте xhigh для наиболее чувствительных к возможностям рабочих нагрузок и опускайтесь до medium или low для рутинной работы. Более низкие настройки усилия на Claude Fable 5 по-прежнему работают хорошо и часто превосходят производительность xhigh на предыдущих моделях. На уровнях high и xhigh задавайте большое значение max_tokens. Это жёсткий лимит на общий объём вывода (размышления плюс текст ответа). См. Контроль затрат.

Снижайте усилие, если задача выполняется, но занимает больше времени, чем необходимо, или если вы хотите более быстрый и интерактивный стиль работы. Те же рекомендации применимы к Claude Mythos 5. Более полное руководство см. в разделе Составление подсказок для Claude Fable 5.

Claude Opus 5.5 поддерживает все пять уровней усилия, и значением по умолчанию является medium (Claude Opus 5 и более ранние модели Opus по умолчанию используют high, поэтому запрос без effort выполняется на один уровень ниже, чем в Claude Opus 5). Адаптивные размышления всегда включены и не могут быть отключены, поэтому усилие является основным механизмом управления тем, насколько много модель рассуждает и сколько стоит запрос. Проведите перебор уровней усилия на собственных оценках, а не переносите настройки из более ранней модели, и задавайте большое значение max_tokens на более высоких уровнях: это жёсткое ограничение на общий объём вывода (размышления плюс текст ответа). Запросы, в которых задано thinking: {"type": "disabled"}, возвращают ошибку 400 на любом уровне усилия. Claude Opus 5.5 также поддерживает изменение усилия в ходе разговора с помощью output_config на уровне сообщения, что сохраняет кэш подсказок. См. Составление подсказок для Claude Opus 5.5.

Claude Opus 5 поддерживает все пять уровней усилий. Начните с high — значения по умолчанию — и корректируйте его на основе ваших оценок: повышайте до xhigh для требовательных задач программирования и агентной работы или до max, когда задача оправдывает неограниченный расход токенов, и свободно используйте low и medium в качестве основного механизма управления стоимостью токенов и временем ответа везде, где ваши оценки показывают, что качество сохраняется. Если вы перенесли настройки уровня усилий из более ранней модели, проведите новый перебор уровней усилий на своих оценках, а не используйте их повторно.

Уровень усилий управляет объёмом размышлений, а не длиной видимого ответа: в Claude Opus 5 изменение уровня усилий не сокращает ответы надёжно, поэтому вместо этого указывайте длину в подсказке.

Значение по умолчанию в API — high. Чтобы использовать другой уровень, задайте effort явно. Переданное вами значение переопределяет значение по умолчанию.

В Claude Opus 5 размышления нельзя отключить на уровнях усилий xhigh или max: запросы, в которых на этих уровнях задано thinking: {"type": "disabled"}, возвращают ошибку 400. См. Усилие с размышлениями.

При запуске Claude Opus 5 с уровнем усилий xhigh или max задавайте большое значение max_tokens, чтобы у модели было пространство для размышлений и действий с использованием субагентов и вызовов инструментов. Разумное значение по умолчанию — начать с 64k токенов и настраивать от него.

Claude Opus 5 также поддерживает изменение уровня усилий в ходе разговора с помощью output_config для отдельного сообщения, что сохраняет кэш подсказок. Уровень усилий для отдельных сообщений недоступен для Claude Opus 5 в Amazon Bedrock.

Рекомендации для Claude Opus 4.7 также применимы к Claude Opus 4.8. Начните с xhigh для сценариев программирования и агентных сценариев, используйте high для большинства других чувствительных к интеллекту рабочих нагрузок и опускайтесь до medium или low только тогда, когда вы измерили, что более низкий уровень сохраняет качество на ваших оценках.

Значение по умолчанию в API — high. Задайте effort явно, чтобы использовать другой уровень. Переданное вами значение переопределяет значение по умолчанию.

При запуске Claude Opus 4.8 с усилием xhigh или max задавайте большое значение max_tokens, чтобы у модели было пространство для размышлений и действий в рамках субагентов и вызовов инструментов. Разумное значение по умолчанию — начать с 64k токенов и настраивать далее.

Начните с xhigh для сценариев программирования и агентной работы и используйте high как минимум для большинства рабочих нагрузок, чувствительных к интеллекту модели. Понижайте до medium для рабочих нагрузок, чувствительных к стоимости, или повышайте до max только тогда, когда ваши оценки показывают измеримый запас для улучшения на уровне xhigh.

Значение по умолчанию в API — high. Чтобы использовать xhigh, задайте effort явно. Переданное вами значение переопределяет значение по умолчанию.

Уровень усилийРекомендации для Claude Opus 4.7
lowЭффективный, но лучше всего подходит для коротких задач с чётко очерченными рамками. Сочетайте low с явными контрольными списками, если ваша задача состоит из нескольких разделов.
mediumГотовая замена для среднего рабочего процесса, когда вам нужны хорошие результаты при снижении затрат.
highПродвинутые сценарии использования, которым всё ещё нужен баланс между интеллектом и расходом токенов. Часто это лучший баланс качества и эффективности использования токенов.
xhighРекомендуемая отправная точка для программирования и агентной работы, а также для исследовательских задач, таких как многократные вызовы инструментов, детальный веб-поиск и поиск по базе знаний. Ожидайте заметно более высокого расхода токенов, чем при high.
maxПриберегите для передовых задач. На большинстве рабочих нагрузок max значительно увеличивает стоимость при относительно небольшом приросте качества, а в некоторых задачах со структурированным выводом или задачах, менее чувствительных к интеллекту модели, может приводить к чрезмерным размышлениям.

Claude Opus 4.7 также строже соблюдает уровни усилий, чем Claude Opus 4.6, особенно на уровнях low и medium. На более низких уровнях усилий модель ограничивает свою работу тем, что было запрошено, а не делает больше, чем требуется. Если вы наблюдаете поверхностные рассуждения при решении сложных задач с Claude Opus 4.7, повысьте уровень усилий, а не пытайтесь обойти это с помощью подсказок. Если вам необходимо сохранять низкий уровень усилий из-за задержки, добавьте целевые указания, например: «This task involves multistep reasoning. Think carefully before responding.»

При запуске Claude Opus 4.7 с уровнем усилий xhigh или max задавайте большое значение max_tokens, чтобы у модели было пространство для размышлений и действий с использованием субагентов и вызовов инструментов. Разумное значение по умолчанию — начать с 64k токенов и настраивать от него.

Claude Sonnet 5.5 поддерживает все пять уровней усилий, и значением по умолчанию в Claude API является high. Его уровни откалиброваны заново, поэтому уровень не даёт того же объёма размышлений, что и тот же уровень в Claude Sonnet 5. Проведите новый перебор уровней усилий на своих оценках, а не переносите настройку, которую вы использовали в Claude Sonnet 5. Начните с high, если только ваша рабочая нагрузка не является агентной или чувствительной к задержкам. Для агентного программирования и многошагового использования инструментов начните с medium для чётко сформулированных задач и переходите к high для более сложных или длительных. Для чата и другой работы, чувствительной к задержкам, начните с medium или low. Используйте xhigh или max только там, где ваши оценки показывают прирост качества. Задавайте max_tokens с запасом для размышлений и ответа. Размышления учитываются в max_tokens, даже если содержимое размышлений не возвращается. Для агентного программирования задайте max_tokens равным 128 000 — максимуму модели — и используйте потоковую передачу ответа.

Чтобы отключить предварительные размышления, отправьте thinking: {"type": "between_tools"} вместо "disabled". Это самая низкая настройка размышлений в Claude Sonnet 5.5, и она работает на уровнях усилий low, medium и high. На уровнях xhigh или max запрос с ней возвращает ошибку 400, поэтому на этих уровнях используйте адаптивные размышления: опустите поле thinking или отправьте thinking: {"type": "adaptive"}. См. Работа без предварительных размышлений.

Claude Sonnet 5.5 также поддерживает изменение уровня усилий в ходе разговора с помощью output_config для отдельного сообщения, что сохраняет кэш подсказок. При использовании between_tools уровень усилий нельзя изменить в ходе диалога: output_config.effort для отдельного сообщения, отличающийся от действующего уровня, возвращает ошибку 400. Чтобы менять уровень усилий от хода к ходу, используйте адаптивные размышления. См. Подсказки для Claude Sonnet 5.5.

Claude Sonnet 5 по умолчанию использует усилие high в Claude API и Claude Code.

  • Усилие high (по умолчанию): Подходит для сложных рассуждений, программирования и агентных задач, где качество важнее скорости или стоимости.
  • Усилие xhigh: Для самых сложных задач программирования и агентных задач. См. Составление подсказок для Claude Sonnet 5.
  • Усилие medium: Экономящий затраты шаг вниз от значения по умолчанию. Сопоставимо с Claude Sonnet 4.6 при усилии high.
  • Усилие low: Для высоконагруженных или чувствительных к задержкам рабочих нагрузок. Подходит для чата и сценариев, не связанных с программированием, где приоритетна более быстрая обработка.
  • Усилие max: Для задач, требующих абсолютно максимальных возможностей без ограничений на расход токенов.

Sonnet 4.6 по умолчанию использует уровень усилий high. Явно задавайте уровень усилий при использовании Sonnet 4.6, чтобы избежать неожиданных задержек:

  • Средний уровень усилий (рекомендуемое значение по умолчанию): лучший баланс скорости, стоимости и производительности для большинства приложений. Подходит для агентного программирования, рабочих процессов с интенсивным использованием инструментов и генерации кода.
  • Низкий уровень усилий: для высоконагруженных рабочих нагрузок или рабочих нагрузок, чувствительных к задержкам. Подходит для чата и сценариев, не связанных с программированием, где приоритетом является более быстрый отклик.
  • Высокий уровень усилий: для сложных рассуждений и задач, где качество важнее скорости или стоимости.
  • Максимальный уровень усилий: для задач, требующих абсолютно максимальных возможностей без ограничений на расход токенов.

Claude Haiku 5.5 поддерживает все пять уровней усилий, и значением по умолчанию в Claude API и в Claude Code является medium. Уровень усилий — основной механизм управления тем, сколько модель размышляет, а вместе с этим — качеством, задержкой и стоимостью. Начните с medium для большинства задач, включая агентное программирование. Используйте low — самый дешёвый и быстрый уровень — для чата, коротких задач с инструментами и простых высоконагруженных запросов. В длинных агентных подсказках на уровне low модель с большей вероятностью пропустит поиск, остановится раньше времени или пропустит проверку. Используйте high для интеллектуальной работы, более длительных агентных задач и строгого следования инструкциям. Используйте xhigh или max только там, где ваши оценки показывают прирост качества, и сравнивайте их с Claude Sonnet 5.5 по производительности, стоимости и скорости. Размышления включены по умолчанию и учитываются в max_tokens, поэтому оставляйте для них запас. См. Составление подсказок для Claude Haiku 5.5.

Чтобы уменьшить объём размышлений, понизьте уровень усилий. Вы также можете отправить thinking: {"type": "disabled"} на уровне усилий high или ниже. На уровнях xhigh или max это возвращает ошибку 400, поэтому там используйте адаптивные размышления: опустите поле thinking или отправьте thinking: {"type": "adaptive"}.

В Claude API и Google Cloud Claude Haiku 5.5 также поддерживает изменение уровня усилий в ходе разговора с помощью output_config для отдельного сообщения, что сохраняет кэш подсказок. При использовании thinking: {"type": "disabled"} уровень усилий нельзя изменить в ходе диалога: output_config.effort для отдельного сообщения, отличающийся от действующего уровня, возвращает ошибку 400. Чтобы менять уровень усилий от хода к ходу, используйте адаптивные размышления.

Усилие с использованием инструментов

При «tool use» (использовании инструментов) параметр effort влияет как на объяснения вокруг вызовов инструментов, так и на сами вызовы инструментов. Более низкие уровни усилия, как правило:

  • Объединяют несколько операций в меньшее количество вызовов инструментов
  • Делают меньше вызовов инструментов
  • Переходят непосредственно к действию без вступления
  • Используют лаконичные подтверждающие сообщения после завершения

Более высокие уровни усилия могут:

  • Делать больше вызовов инструментов
  • Объяснять план перед выполнением действий
  • Предоставлять подробные сводки изменений
  • Включать более полные комментарии к коду

Усилие с размышлениями

Параметр thinking управляет тем, размышляет ли Claude в блоках размышлений перед ответом; параметр effort управляет тем, сколько усилий Claude вкладывает в весь ответ, что в адаптивном режиме включает то, как часто и насколько глубоко он размышляет. Не передавайте adaptive в качестве значения effort: adaptive — это режим размышлений, а не уровень усилий.

На более высоких уровнях усилия Claude охотнее и дольше размышляет. В цикле использования инструментов последующие запросы, которые только обрабатывают результаты инструментов, по-прежнему могут пропускать размышления на любом уровне. На более низких уровнях Claude может полностью пропускать размышления для более простых задач. Полное руководство о том, как эти два механизма управления работают вместе, см. в разделе Размышления и уровень усилий.

На Claude Opus 4.5, единственной модели только с «extended thinking» (расширенными размышлениями), поддерживающей усилие, оно работает совместно с budget_tokens: задайте уровень усилия для вашей задачи, затем задайте бюджет токенов размышлений в зависимости от того, какая глубина рассуждений нужна задаче.

Доступность размышлений для конкретных моделей см. в таблице конфигурации по моделям. Усилие работает с размышлениями и без них. См. Как работает уровень усилий.

Изменение уровня усилий в ходе разговора

Выполнять последующие ходы диалога с другим уровнем усилий можно двумя способами. В Claude Fable 5.1, Claude Mythos 5.1, Claude Opus 5.5, Claude Opus 5, Claude Sonnet 5.5 и Claude Haiku 5.5 используйте изменение уровня усилий для отдельного сообщения, которое сохраняет кэш подсказок. В других моделях задайте новое значение верхнего уровня в следующем запросе, что приводит к построению кэша заново.

Уровень усилий для отдельных сообщений (бета)

Уровень усилий для отдельных сообщений находится в стадии бета-тестирования. В Claude API и Google Cloud он доступен в Claude Fable 5.1, Claude Mythos 5.1, Claude Opus 5.5, Claude Opus 5, Claude Sonnet 5.5 и Claude Haiku 5.5. В Amazon Bedrock он доступен в Claude Fable 5.1, Claude Mythos 5.1 и Claude Opus 5.5. Для него требуется бета-заголовок mid-conversation-output-config-2026-07-01. При использовании InvokeModel API в Amazon Bedrock он доступен в Claude Fable 5.1 и Claude Opus 5.5, и вместо заголовка вы передаёте это значение в массиве anthropic_beta в теле запроса.

Без бета-значения output_config для отдельного сообщения возвращает ошибку 400: messages.N.output_config: Extra inputs are not permitted, где N — индекс сообщения system в messages. С бета-значением модели без поддержки уровня усилий для отдельных сообщений, включая Claude Fable 5, возвращают ошибку 400: output_config.effort requires a model that supports per-turn effort; this model does not. В Amazon Bedrock эти модели и Claude Opus 5 вместо этого возвращают ошибку Extra inputs are not permitted. В Claude Sonnet 5.5 с thinking: {"type": "between_tools"} и в Claude Haiku 5.5 с thinking: {"type": "disabled"} уровень усилий нельзя изменить в ходе диалога: output_config.effort для отдельного сообщения, отличающийся от действующего уровня, возвращает ошибку 400. Чтобы менять уровень усилий от хода к ходу, используйте адаптивные размышления.

Добавьте сообщение с role: "system", пустым content и новым уровнем в output_config.effort. Новый уровень вступает в силу со следующего хода user и действует до тех пор, пока его не изменит более позднее сообщение. Всё, что находится до этого сообщения, остаётся неизменным, поэтому кэшированный префикс по-прежнему совпадает.

Следующий пример начинается с уровня high, а затем понижается до low для рутинного последующего запроса:

client = anthropic.Anthropic()

response = client.beta.messages.create(
    model="claude-fable-5-1",
    max_tokens=4096,
    output_config={"effort": "high"},
    messages=[
        {
            "role": "user",
            "content": "Plan a migration from SQLite to PostgreSQL in three short steps.",
        },
        {
            "role": "assistant",
            "content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.",
        },
        # Системное сообщение только с effort: новый уровень действует со следующего хода пользователя.
        {"role": "system", "content": [], "output_config": {"effort": "low"}},
        {"role": "user", "content": "Summarize the plan in one sentence."},
    ],
    betas=["mid-conversation-output-config-2026-07-01"],
)

for block in response.content:
    if block.type == "text":
        print(block.text)

Системное сообщение, содержащее только уровень усилий, не несёт текста, поэтому правила размещения системных сообщений в середине разговора к нему не применяются. Оно может находиться в любом месте messages, в том числе быть первым элементом или располагаться между ходом assistant и следующим ходом user. Значениями являются названия уровней (low, medium, high, xhigh и max).

В Claude Fable 5.1 предпочитайте эту форму изменению значения верхнего уровня между запросами. Изменение на верхнем уровне перезапускает кэш, а также менее надёжно управляет моделью: её предыдущие ответы были написаны на прежнем уровне, и она склонна оставаться с ними согласованной.

Усилие верхнего уровня в следующем запросе

output_config.effort верхнего уровня применяется ко всему запросу. Чтобы выполнить более позднюю часть разговора на другом уровне, задайте новое значение в следующем запросе. Поскольку усилие верхнего уровня формирует итоговую подсказку, его изменение между запросами не сохраняет кэшированные префиксы предыдущих ходов. Если вы полагаетесь на «prompt caching» (кэширование подсказок) — см. кэширование подсказок — на протяжении длинной сессии, а ваша модель не поддерживает усилие на уровне сообщения, выберите уровень усилия в начале и держите его постоянным.

Лучшие практики

  1. Задавайте уровень усилий явно: по умолчанию API использует high (medium для Claude Opus 5.5 и Claude Haiku 5.5), но правильная отправная точка зависит от вашей модели и рабочей нагрузки.
  2. Используйте low для задач, чувствительных к скорости, или простых задач: когда важна задержка или задачи несложные, низкий уровень усилий может значительно сократить время ответа и затраты.
  3. Тестируйте свой сценарий использования: влияние уровней усилий зависит от типа задачи. Оцените производительность на ваших конкретных сценариях использования перед развёртыванием.
  4. Рассмотрите динамический уровень усилий: корректируйте уровень усилий в зависимости от сложности задачи. Для простых запросов может быть достаточно низкого уровня усилий, тогда как агентное программирование и сложные рассуждения выигрывают от высокого уровня усилий. Прежде чем менять его в рамках одного диалога, ознакомьтесь со следующим пунктом.
  5. Сохраняйте уровень усилий верхнего уровня неизменным в кэшируемых диалогах: изменение значения уровня усилий верхнего уровня между запросами делает недействительным кэширование подсказок, поэтому меняйте его между рабочими нагрузками, а не внутри диалога, который полагается на попадания в кэш. В моделях, которые это поддерживают, вместо этого используйте изменение уровня усилий для отдельного сообщения, которое сохраняет кэш. См. Размышления и кэширование подсказок.

Следующие шаги

Задайте Claude рекомендательный бюджет токенов для всего агентного цикла, чтобы помочь модели саморегулироваться в длительных агентных задачах.

Разберитесь в адаптивных размышлениях, при которых Claude сам определяет, когда и сколько размышлять, и управляйте ими с помощью уровня усилий и подсказок.

Узнайте, как работают размышления, когда Claude размышляет по умолчанию и как размышления взаимодействуют с уровнем усилий.

Compatibility

Supported models
  • Fable 5 and 5.1
  • Mythos 5, 5.1, and Preview
  • Opus 4.5, 4.6, 4.7, 4.8, 5, and 5.5
  • Sonnet 4.6, 5, and 5.5
  • Haiku 5.5
Supported platforms
  • Claude API
  • Claude Platform on AWS
  • Amazon Bedrock
  • Google Cloud
  • Microsoft Foundry

Was this page helpful?