Claude Platform Docs
Модели и ценыМодели

Claude Sonnet 5.5Latest

The best combination of speed and intelligence

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$2/ MTok
Output pricing
$10/ MTok

Обзор

Claude Sonnet 5.5 предлагает лучшее сочетание скорости и интеллекта. Код, который уже работает на Claude Sonnet 5, затрагивают пять «breaking changes» (критических изменений):

Ещё одно изменение меняет форму ответа, не приводя к сбою ни одного запроса: текст между вызовами инструментов возвращается в блоках thinking. Приложение, которое передаёт этот текст своим пользователям в режиме «streaming» (потоковая передача), замолкает между вызовами инструментов, пока не задаст значение display, возвращающее текст, или не отключит предварительные размышления с помощью between_tools.

Что нового в Claude Sonnet 5.5

Сравнение с другими моделями

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.5This model1M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtended—Feb 2025

Характеристики

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$2 / MTok
Output
$10 / MTok
5m cache write
$2.50 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fast
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 28, 2026
Retirement
Not sooner than September 28, 2027

Полезно знать

  • «Adaptive thinking» (адаптивные размышления) включены по умолчанию. Самая низкая настройка размышлений — between_tools, которая отключает предварительные размышления. Она работает при уровне усилий high или ниже. См. Что нового в Claude Sonnet 5.5.
  • Установка для temperature, top_p или top_k значения, отличного от значения по умолчанию, приводит к ошибке 400.
  • Минимальная длина «prompt» (подсказки), которую можно кэшировать, составляет 512 токенов. См. Кэширование подсказок.
  • В Message Batches API Claude Sonnet 5.5 поддерживает до 300 тыс. выходных токенов с «beta header» (бета-заголовком) output-300k-2026-03-24.
  • Запрашивайте ограничения и возможности программно с помощью Models API.

Ресурсы

Различия в поведении и приёмы составления подсказок, характерные для Claude Sonnet 5.5.

Параметр управления глубиной размышлений, «latency» (задержкой) и стоимостью. Выбирайте уровень для каждой рабочей нагрузки.

Как работают адаптивные размышления, какие настройки размышлений принимает каждая модель и как сохраняются блоки размышлений.

Справочник

Полный прайс-лист, включая скидки на пакетную обработку и тарифы на кэширование подсказок.

Как работают идентификаторы моделей, псевдонимы и закреплённые снимки.

Статус жизненного цикла и обязательства по выводу из эксплуатации для каждой модели Claude.

Was this page helpful?