Claude Sonnet 5.5Latest
The best combination of speed and intelligence
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $2/ MTok
- Output pricing
- $10/ MTok
Обзор
Claude Sonnet 5.5 предлагает лучшее сочетание скорости и интеллекта. Код, который уже работает на Claude Sonnet 5, затрагивают пять «breaking changes» (критических изменений):
- Отключайте предварительные размышления с помощью
between_tools. - Принудительное использование инструментов возвращает ошибку.
- Блоки размышлений привязаны к модели и разговору.
- В Claude API и Google Cloud прежний инструмент computer use
computer_20251124не принимается. - Инструмент-советник отклоняет Claude Opus 4.8, Claude Opus 4.7 и Claude Sonnet 5 в качестве советников.
Ещё одно изменение меняет форму ответа, не приводя к сбою ни одного запроса: текст между вызовами инструментов возвращается в блоках thinking. Приложение, которое передаёт этот текст своим пользователям в режиме «streaming» (потоковая передача), замолкает между вызовами инструментов, пока не задаст значение display, возвращающее текст, или не отключит предварительные размышления с помощью between_tools.
Сравнение с другими моделями
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5This model | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Характеристики
Model IDs
Pricing
- Input
- $2 / MTok
- Output
- $10 / MTok
- 5m cache write
- $2.50 / MTok
- 1h cache write
- $4 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Fast
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 28, 2026
- Retirement
- Not sooner than September 28, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Полезно знать
- «Adaptive thinking» (адаптивные размышления) включены по умолчанию. Самая низкая настройка размышлений —
between_tools, которая отключает предварительные размышления. Она работает при уровне усилийhighили ниже. См. Что нового в Claude Sonnet 5.5. - Установка для
temperature,top_pилиtop_kзначения, отличного от значения по умолчанию, приводит к ошибке 400. - Минимальная длина «prompt» (подсказки), которую можно кэшировать, составляет 512 токенов. См. Кэширование подсказок.
- В Message Batches API Claude Sonnet 5.5 поддерживает до 300 тыс. выходных токенов с «beta header» (бета-заголовком)
output-300k-2026-03-24. - Запрашивайте ограничения и возможности программно с помощью Models API.
Ресурсы
Различия в поведении и приёмы составления подсказок, характерные для Claude Sonnet 5.5.
Параметр управления глубиной размышлений, «latency» (задержкой) и стоимостью. Выбирайте уровень для каждой рабочей нагрузки.
Как работают адаптивные размышления, какие настройки размышлений принимает каждая модель и как сохраняются блоки размышлений.
Справочник
Полный прайс-лист, включая скидки на пакетную обработку и тарифы на кэширование подсказок.
Как работают идентификаторы моделей, псевдонимы и закреплённые снимки.
Статус жизненного цикла и обязательства по выводу из эксплуатации для каждой модели Claude.
Was this page helpful?