Claude Platform Docs
Modelle & PreiseModelle

Claude Opus 5.5Latest

For long-running agentic coding and knowledge work

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$4/ MTok
Output pricing
$20/ MTok

Überblick

Claude Opus 5.5 ist für lang laufendes agentisches Coding und Wissensarbeit konzipiert und kostet 4 $ / 20 $ USD pro Million Input-/Output-Token. Vier „Breaking Changes“ (inkompatible Änderungen) betreffen Code, der bereits auf Claude Opus 5 läuft: Denken kann nicht deaktiviert werden, erzwungene Tool-Nutzung gibt einen Fehler zurück, Thinking-Blöcke sind an das Modell und die Konversation gebunden, und auf der Claude API und Google Cloud wird das frühere Computer-Use-Tool computer_20251124 nicht akzeptiert. Die ersten drei gelten auch für Claude Fable 5.1. Eine weitere Änderung verändert die Form der Antwort, ohne dass eine Anfrage fehlschlägt: Text zwischen Tool-Aufrufen wird in thinking-Blöcken zurückgegeben, deren Text bei der Standardeinstellung von display leer ist. Eine Anwendung, die diesen Text als Fortschrittsmeldungen an ihre Nutzer streamt, bleibt zwischen Tool-Aufrufen stumm, bis sie einen display-Wert setzt, der den Text zurückgibt.

Neuerungen in Claude Opus 5.5

Vergleich

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.5This model1M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 51M128K$2 / $10FastAdaptivehighJan 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtendedFeb 2025

Spezifikationen

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$4 / MTok
Output
$20 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output
Full price list
Pricing

Capabilities

Max output
128K tokens
Thinking
Adaptive (always on)
Comparative latency
Moderate
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 22, 2026
Retirement
Not sooner than September 22, 2027

Gut zu wissen

  • „Adaptive thinking“ (adaptives Denken) ist immer aktiv und kann nicht deaktiviert werden. Steuere die Denktiefe mit dem Effort-Parameter.
  • Über die Message Batches API unterstützt Claude Opus 5.5 mit dem Beta-Header output-300k-2026-03-24 bis zu 300k Ausgabe-Token.
  • Die minimale cachebare Prompt-Länge beträgt 512 Token. Siehe Prompt-Caching.
  • Frage Limits und Fähigkeiten programmatisch mit der Models API ab.

Ressourcen

Verhaltensunterschiede und Prompting-Muster speziell für Claude Opus 5.5.

Die Steuerung für Denktiefe, Latenz und Kosten. Wähle eine Stufe pro Workload.

Wie adaptives Denken funktioniert und wie Thinking-Blöcke erhalten bleiben.

Claude Opus 5.5 mit geringerer Latenz auf der Claude API (Research Preview), separat bepreist.

Referenz

Der System-Prompt, den Claude Opus 5.5 auf claude.ai und in den Claude-Apps verwendet.

Sicherheitsbewertungen und Bereitstellungsentscheidungen für Claude Opus 5.5.

Vollständige Preisliste, einschließlich Batch-Rabatten und Prompt-Caching-Tarifen.

Wie Modell-IDs, Aliase und fixierte Snapshots funktionieren.

Lebenszyklusstatus und Zusagen zur Einstellung für jedes Claude-Modell.

Was this page helpful?