Claude Platform Docs
Modelle & PreiseModelle

Claude Sonnet 5.5Latest

The best combination of speed and intelligence

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$2/ MTok
Output pricing
$10/ MTok

Überblick

Claude Sonnet 5.5 bietet die beste Kombination aus Geschwindigkeit und Intelligenz. Fünf „Breaking Changes" (inkompatible Änderungen) betreffen Code, der bereits auf Claude Sonnet 5 läuft:

Eine weitere Änderung verändert die Form der Antwort, ohne dass eine Anfrage fehlschlägt: Text zwischen Tool-Aufrufen kommt in thinking-Blöcken zurück. Eine Anwendung, die diesen Text an ihre Nutzer streamt, verstummt zwischen Tool-Aufrufen, bis sie einen display-Wert setzt, der den Text zurückgibt, oder vorgelagertes Nachdenken mit between_tools abschaltet.

Neuerungen in Claude Sonnet 5.5

Im Vergleich

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.5This model1M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtended—Feb 2025

Spezifikationen

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$2 / MTok
Output
$10 / MTok
5m cache write
$2.50 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fast
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 28, 2026
Retirement
Not sooner than September 28, 2027

Gut zu wissen

  • „Adaptive thinking" (adaptives Nachdenken) ist standardmäßig aktiviert. Die niedrigste Thinking-Einstellung ist between_tools, die das vorgelagerte Nachdenken deaktiviert. Sie funktioniert bei einem „effort" (Aufwand) von high oder darunter. Siehe Neuerungen in Claude Sonnet 5.5.
  • Wenn du temperature, top_p oder top_k auf einen vom Standard abweichenden Wert setzt, wird ein 400-Fehler zurückgegeben.
  • Die minimale cachebare Prompt-Länge beträgt 512 Token. Siehe Prompt-Caching.
  • Über die Message Batches API unterstützt Claude Sonnet 5.5 mit dem Beta-Header output-300k-2026-03-24 bis zu 300k Output-Token.
  • Frage Limits und Fähigkeiten programmatisch über die Models API ab.

Ressourcen

Verhaltensunterschiede und Prompting-Muster speziell für Claude Sonnet 5.5.

Die Steuerung für Nachdenktiefe, Latenz und Kosten. Wähle eine Stufe pro Workload.

Wie adaptives Nachdenken funktioniert, welche Thinking-Einstellungen jedes Modell akzeptiert und wie Thinking-Blöcke erhalten bleiben.

Referenz

Vollständige Preisliste, einschließlich Batch-Rabatten und Prompt-Caching-Tarifen.

Wie Modell-IDs, Aliase und fixierte Snapshots funktionieren.

Lebenszyklusstatus und Zusagen zur Einstellung für jedes Claude-Modell.

Was this page helpful?