Claude Platform Docs

Claude Haiku 5.5Latest

For high-volume, latency-sensitive tasks such as classification, extraction, and routing

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
From $0.10/ MTok
Output pricing
From $0.50/ MTok

Обзор

Claude Haiku 5.5 создана для высоконагруженной работы, чувствительной к «latency» (задержке), такой как классификация, маршрутизация, извлечение данных и задачи субагентов. Она поддерживает «adaptive thinking» (адаптивные размышления) с параметром «effort» (усилие), «context window» (контекстное окно) размером 1M токенов и до 128k выходных токенов. Она использует тот же новый «tokenizer» (токенизатор), что и Claude 4.7 и более поздние модели, поэтому один и тот же текст насчитывает примерно на 30% больше токенов, чем в Claude Haiku 4.5. Её «thinking blocks» (блоки размышлений) работают только в аккаунте, который их создал, или в связанном с ним аккаунте.

Об изменениях в коде см. руководство по миграции. Идентификаторы моделей, цены и ограничения см. в обзоре Claude Haiku 5.5. Рекомендации по составлению подсказок см. в разделе Составление подсказок для Claude Haiku 5.5.

Что нового в Claude Haiku 5.5

Сравнение с другими моделями

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.51M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 5.5This model1M128KFrom $0.10 / $0.50FastestAdaptivemediumJun 2026

Характеристики

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
Output
$0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
5m cache write
$0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
1h cache write
$0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
Cache read
$0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fastest
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
October 7, 2026
Retirement
Not sooner than October 7, 2027

Полезно знать

  • «Adaptive thinking» (адаптивные размышления) включены по умолчанию. Управляйте глубиной размышлений с помощью параметра effort.
  • Не указывайте temperature, top_p и top_k, поскольку значение, отличное от значения по умолчанию, для любого из них приводит к ошибке 400.
  • В Message Batches API Claude Haiku 5.5 поддерживает до 300 тыс. выходных токенов с бета-заголовком output-300k-2026-03-24.
  • Запрашивайте ограничения и возможности программно с помощью Models API.

Ресурсы

Поведенческие отличия и шаблоны подсказок, характерные для Claude Haiku 5.5.

Выберите модель и уровень effort, оптимизируйте подсказки и используйте потоковую передачу вывода для более быстрых ответов.

Claude Haiku 5.5 сама решает, когда и сколько размышлять. Управляйте глубиной с помощью effort.

1M токенов. Как подсчитывается и управляется контекстное окно.

Справочные материалы

Системная подсказка, которую Claude Haiku 5.5 использует на claude.ai и в приложениях Claude.

Оценки безопасности и решения о развёртывании для Claude Haiku 5.5.

Полный прайс-лист, включая скидки на пакетную обработку и тарифы на кэширование подсказок.

Как работают идентификаторы моделей, псевдонимы и закреплённые снимки.

Статус жизненного цикла и обязательства по выводу из эксплуатации для каждой модели Claude.

Was this page helpful?