Claude Platform Docs
Modelle & PreiseModelle

Claude Opus 5Latest

For complex agentic coding and enterprise work

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$5/ MTok
Output pricing
$25/ MTok

Überblick

Claude Opus 5 ist eine sprunghafte Verbesserung gegenüber Claude Opus 4.8, mit den größten Zugewinnen bei „deep reasoning“ (tiefgehendem Schlussfolgern), agentischen Aufgaben und Aufgaben mit langem Zeithorizont sowie „test-time compute scaling“ (Skalierung der Rechenleistung zur Inferenzzeit). Diese Seite fasst alles Neue in Claude Opus 5 zusammen, einschließlich Tool-Änderungen mitten in der Konversation und zweier „breaking changes“ (inkompatibler Änderungen) für Code, der auf Claude Opus 4.8 läuft: „Thinking“ (Denken) ist standardmäßig aktiviert, und Denken kann nur bei einem „effort“ (Aufwand) von high oder niedriger deaktiviert werden.

Was ist neu in Claude Opus 5

Vergleich

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5This model1M128K$5 / $25ModerateAdaptivehighMay 2026
Claude Sonnet 51M128K$2 / $10FastAdaptivehighJan 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtendedFeb 2025

Spezifikationen

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry

Pricing

Input
$5 / MTok
Output
$25 / MTok
5m cache write
$6.25 / MTok
1h cache write
$10 / MTok
Cache read
$0.50 / MTok
Batch API
50% discount on input and output
Full price list
Pricing

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Moderate
Input → output
Text and images → text
Reliable knowledge cutoff
May 2026
Training data cutoff
May 2026

Availability

Status
Active (latest)
Released
July 24, 2026
Retirement
Not sooner than July 24, 2027

Gut zu wissen

  • Auf der Message Batches API unterstützt Claude Opus 5 bis zu 300k Ausgabe-Token mit dem Beta-Header output-300k-2026-03-24.
  • Die minimale cachebare Prompt-Länge beträgt 512 Token. Siehe Prompt-Caching.
  • Frage Limits und Fähigkeiten programmatisch mit der Models API ab.

Ressourcen

Modellspezifische Hinweise zum Prompting.

Effort ist bei Claude Opus 5 standardmäßig auf high gesetzt und spielt eine größere Rolle als bei früheren Modellen. Wähle eine Stufe pro Workload.

Standardmäßig aktiviert. Das Deaktivieren des Denkens erfordert Effort high oder niedriger.

Claude Opus 5 mit geringerer Latenz auf der Claude API (Research Preview), separat bepreist.

Referenz

Der System-Prompt, den Claude Opus 5 auf claude.ai und in den Claude-Apps verwendet.

Sicherheitsevaluierungen und Bereitstellungsentscheidungen für Claude Opus 5.

Vollständige Preisliste, einschließlich Batch-Rabatten und Prompt-Caching-Tarifen.

Wie Modell-IDs, Aliasse und fixierte Snapshots funktionieren.

Lebenszyklusstatus und Zusagen zur Einstellung für jedes Claude-Modell.

Was this page helpful?