Claude Sonnet 5.5Latest
The best combination of speed and intelligence
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $2/ MTok
- Output pricing
- $10/ MTok
Überblick
Claude Sonnet 5.5 bietet die beste Kombination aus Geschwindigkeit und Intelligenz. Fünf „Breaking Changes" (inkompatible Änderungen) betreffen Code, der bereits auf Claude Sonnet 5 läuft:
- Schalte vorgelagertes Nachdenken mit
between_toolsab. - Erzwungene Tool-Nutzung gibt einen Fehler zurück.
- Thinking-Blöcke sind an das Modell und die Konversation gebunden.
- Auf der Claude API und Google Cloud wird das frühere Computer-Use-Tool
computer_20251124nicht akzeptiert. - Das Advisor-Tool lehnt Claude Opus 4.8, Claude Opus 4.7 und Claude Sonnet 5 als Advisor ab.
Eine weitere Änderung verändert die Form der Antwort, ohne dass eine Anfrage fehlschlägt: Text zwischen Tool-Aufrufen kommt in thinking-Blöcken zurück. Eine Anwendung, die diesen Text an ihre Nutzer streamt, verstummt zwischen Tool-Aufrufen, bis sie einen display-Wert setzt, der den Text zurückgibt, oder vorgelagertes Nachdenken mit between_tools abschaltet.
Im Vergleich
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5This model | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Spezifikationen
Model IDs
Pricing
- Input
- $2 / MTok
- Output
- $10 / MTok
- 5m cache write
- $2.50 / MTok
- 1h cache write
- $4 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Fast
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 28, 2026
- Retirement
- Not sooner than September 28, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Gut zu wissen
- „Adaptive thinking" (adaptives Nachdenken) ist standardmäßig aktiviert. Die niedrigste Thinking-Einstellung ist
between_tools, die das vorgelagerte Nachdenken deaktiviert. Sie funktioniert bei einem „effort" (Aufwand) vonhighoder darunter. Siehe Neuerungen in Claude Sonnet 5.5. - Wenn du
temperature,top_podertop_kauf einen vom Standard abweichenden Wert setzt, wird ein 400-Fehler zurückgegeben. - Die minimale cachebare Prompt-Länge beträgt 512 Token. Siehe Prompt-Caching.
- Über die Message Batches API unterstützt Claude Sonnet 5.5 mit dem Beta-Header
output-300k-2026-03-24bis zu 300k Output-Token. - Frage Limits und Fähigkeiten programmatisch über die Models API ab.
Ressourcen
Verhaltensunterschiede und Prompting-Muster speziell für Claude Sonnet 5.5.
Die Steuerung für Nachdenktiefe, Latenz und Kosten. Wähle eine Stufe pro Workload.
Wie adaptives Nachdenken funktioniert, welche Thinking-Einstellungen jedes Modell akzeptiert und wie Thinking-Blöcke erhalten bleiben.
Referenz
Vollständige Preisliste, einschließlich Batch-Rabatten und Prompt-Caching-Tarifen.
Wie Modell-IDs, Aliase und fixierte Snapshots funktionieren.
Lebenszyklusstatus und Zusagen zur Einstellung für jedes Claude-Modell.
Was this page helpful?