Claude Haiku 5.5Latest
For high-volume, latency-sensitive tasks such as classification, extraction, and routing
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- From $0.10/ MTok
- Output pricing
- From $0.50/ MTok
개요
Claude Haiku 5.5는 분류, 라우팅, 추출, 서브에이전트 작업과 같이 대량 처리가 필요하고 "latency"(지연 시간)에 민감한 작업을 위해 설계되었습니다. effort 매개변수를 사용하는 "adaptive thinking"(적응형 사고), 1M 토큰 "context window"(컨텍스트 윈도우), 최대 128k 출력 토큰을 지원합니다. Claude 4.7 이후 모델과 동일한 새로운 "tokenizer"(토크나이저)를 사용하므로, 동일한 텍스트가 Claude Haiku 4.5보다 약 30% 더 많은 토큰으로 계산됩니다. 사고 블록은 해당 블록을 생성한 계정 또는 그 계정에 연결된 계정에서만 작동합니다.
코드 변경 사항은 마이그레이션 가이드를 참조하세요. 모델 ID, 가격 및 제한 사항은 Claude Haiku 5.5 개요를 참조하세요. 프롬프팅 지침은 Claude Haiku 5.5 프롬프팅을 참조하세요.
다른 모델과의 비교
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 5.5This model | 1M | 128K | From $0.10 / $0.50 | Fastest | Adaptive | medium | Jun 2026 |
사양
Model IDs
Pricing
- Input
- $0.10 / MTok for prompts up to 100,000 tokens$0.50 / MTok for prompts over 100,000 tokens
- Output
- $0.50 / MTok for prompts up to 100,000 tokens$2.50 / MTok for prompts over 100,000 tokens
- 5m cache write
- $0.125 / MTok for prompts up to 100,000 tokens$0.625 / MTok for prompts over 100,000 tokens
- 1h cache write
- $0.20 / MTok for prompts up to 100,000 tokens$1 / MTok for prompts over 100,000 tokens
- Cache read
- $0.01 / MTok for prompts up to 100,000 tokens$0.05 / MTok for prompts over 100,000 tokens
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
medium- Comparative latency
- Fastest
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- October 7, 2026
- Retirement
- Not sooner than October 7, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
알아두면 좋은 점
- "Adaptive thinking"(적응형 사고)은 기본적으로 켜져 있습니다. effort 매개변수로 사고 깊이를 제어하세요.
temperature,top_p,top_k는 생략하세요. 이 중 어느 하나라도 기본값이 아닌 값을 지정하면 400 오류가 반환됩니다.- Message Batches API에서 Claude Haiku 5.5는
output-300k-2026-03-24베타 헤더를 사용하여 최대 300k 출력 토큰을 지원합니다. - Models API를 사용하여 한도와 기능을 프로그래밍 방식으로 조회하세요.
리소스
Claude Haiku 5.5에 특화된 동작 차이와 프롬프팅 패턴입니다.
더 빠른 응답을 위해 모델과 effort 수준을 선택하고, 프롬프트를 구성하고, 출력을 스트리밍하세요.
Claude Haiku 5.5는 언제, 얼마나 사고할지 스스로 결정합니다. effort로 깊이를 조정하세요.
1M 토큰. 컨텍스트 윈도우가 계산되고 관리되는 방식입니다.
참고 자료
Claude Haiku 5.5가 claude.ai 및 Claude 앱에서 사용하는 시스템 프롬프트입니다.
Claude Haiku 5.5에 대한 안전성 평가 및 배포 결정 사항입니다.
배치 할인 및 프롬프트 캐싱 요금을 포함한 전체 가격표입니다.
모델 ID, 별칭, 고정 스냅샷이 작동하는 방식입니다.
모든 Claude 모델의 수명 주기 상태와 종료 관련 약속입니다.
Was this page helpful?