Claude Haiku 5.5Latest
For high-volume, latency-sensitive tasks such as classification, extraction, and routing
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- From $0.10/ MTok
- Output pricing
- From $0.50/ MTok
Обзор
Claude Haiku 5.5 создана для высоконагруженной работы, чувствительной к «latency» (задержке), такой как классификация, маршрутизация, извлечение данных и задачи субагентов. Она поддерживает «adaptive thinking» (адаптивные размышления) с параметром «effort» (усилие), «context window» (контекстное окно) размером 1M токенов и до 128k выходных токенов. Она использует тот же новый «tokenizer» (токенизатор), что и Claude 4.7 и более поздние модели, поэтому один и тот же текст насчитывает примерно на 30% больше токенов, чем в Claude Haiku 4.5. Её «thinking blocks» (блоки размышлений) работают только в аккаунте, который их создал, или в связанном с ним аккаунте.
Об изменениях в коде см. руководство по миграции. Идентификаторы моделей, цены и ограничения см. в обзоре Claude Haiku 5.5. Рекомендации по составлению подсказок см. в разделе Составление подсказок для Claude Haiku 5.5.
Сравнение с другими моделями
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 5.5This model | 1M | 128K | From $0.10 / $0.50 | Fastest | Adaptive | medium | Jun 2026 |
Характеристики
Model IDs
Pricing
- Input
- $0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
- Output
- $0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
- 5m cache write
- $0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
- 1h cache write
- $0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
- Cache read
- $0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
medium- Comparative latency
- Fastest
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- October 7, 2026
- Retirement
- Not sooner than October 7, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Полезно знать
- «Adaptive thinking» (адаптивные размышления) включены по умолчанию. Управляйте глубиной размышлений с помощью параметра effort.
- Не указывайте
temperature,top_pиtop_k, поскольку значение, отличное от значения по умолчанию, для любого из них приводит к ошибке 400. - В Message Batches API Claude Haiku 5.5 поддерживает до 300 тыс. выходных токенов с бета-заголовком
output-300k-2026-03-24. - Запрашивайте ограничения и возможности программно с помощью Models API.
Ресурсы
Поведенческие отличия и шаблоны подсказок, характерные для Claude Haiku 5.5.
Выберите модель и уровень effort, оптимизируйте подсказки и используйте потоковую передачу вывода для более быстрых ответов.
Claude Haiku 5.5 сама решает, когда и сколько размышлять. Управляйте глубиной с помощью effort.
1M токенов. Как подсчитывается и управляется контекстное окно.
Справочные материалы
Системная подсказка, которую Claude Haiku 5.5 использует на claude.ai и в приложениях Claude.
Оценки безопасности и решения о развёртывании для Claude Haiku 5.5.
Полный прайс-лист, включая скидки на пакетную обработку и тарифы на кэширование подсказок.
Как работают идентификаторы моделей, псевдонимы и закреплённые снимки.
Статус жизненного цикла и обязательства по выводу из эксплуатации для каждой модели Claude.
Was this page helpful?