Claude Opus 5.5Latest
For long-running agentic coding and knowledge work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $4/ MTok
- Output pricing
- $20/ MTok
Überblick
Claude Opus 5.5 ist für lang laufendes agentisches Coding und Wissensarbeit konzipiert und kostet 4 $ / 20 $ USD pro Million Input-/Output-Token. Vier „Breaking Changes“ (inkompatible Änderungen) betreffen Code, der bereits auf Claude Opus 5 läuft: Denken kann nicht deaktiviert werden, erzwungene Tool-Nutzung gibt einen Fehler zurück, Thinking-Blöcke sind an das Modell und die Konversation gebunden, und auf der Claude API und Google Cloud wird das frühere Computer-Use-Tool computer_20251124 nicht akzeptiert. Die ersten drei gelten auch für Claude Fable 5.1. Eine weitere Änderung verändert die Form der Antwort, ohne dass eine Anfrage fehlschlägt: Text zwischen Tool-Aufrufen wird in thinking-Blöcken zurückgegeben, deren Text bei der Standardeinstellung von display leer ist. Eine Anwendung, die diesen Text als Fortschrittsmeldungen an ihre Nutzer streamt, bleibt zwischen Tool-Aufrufen stumm, bis sie einen display-Wert setzt, der den Text zurückgibt.
Vergleich
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5This model | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Spezifikationen
Model IDs
- Claude API
Pricing
- Input
- $4 / MTok
- Output
- $20 / MTok
- 5m cache write
- $5 / MTok
- 1h cache write
- $8 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
- Full price list
- Pricing
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive (always on)
- Default effort
medium- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 22, 2026
- Retirement
- Not sooner than September 22, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Gut zu wissen
- „Adaptive thinking“ (adaptives Denken) ist immer aktiv und kann nicht deaktiviert werden. Steuere die Denktiefe mit dem Effort-Parameter.
- Über die Message Batches API unterstützt Claude Opus 5.5 mit dem Beta-Header
output-300k-2026-03-24bis zu 300k Ausgabe-Token. - Die minimale cachebare Prompt-Länge beträgt 512 Token. Siehe Prompt-Caching.
- Frage Limits und Fähigkeiten programmatisch mit der Models API ab.
Ressourcen
Verhaltensunterschiede und Prompting-Muster speziell für Claude Opus 5.5.
Die Steuerung für Denktiefe, Latenz und Kosten. Wähle eine Stufe pro Workload.
Wie adaptives Denken funktioniert und wie Thinking-Blöcke erhalten bleiben.
Claude Opus 5.5 mit geringerer Latenz auf der Claude API (Research Preview), separat bepreist.
Referenz
Der System-Prompt, den Claude Opus 5.5 auf claude.ai und in den Claude-Apps verwendet.
Sicherheitsbewertungen und Bereitstellungsentscheidungen für Claude Opus 5.5.
Vollständige Preisliste, einschließlich Batch-Rabatten und Prompt-Caching-Tarifen.
Wie Modell-IDs, Aliase und fixierte Snapshots funktionieren.
Lebenszyklusstatus und Zusagen zur Einstellung für jedes Claude-Modell.
Was this page helpful?