Claude Opus 5Latest
For complex agentic coding and enterprise work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $5/ MTok
- Output pricing
- $25/ MTok
Überblick
Claude Opus 5 ist eine sprunghafte Verbesserung gegenüber Claude Opus 4.8, mit den größten Zugewinnen bei „deep reasoning“ (tiefgehendem Schlussfolgern), agentischen Aufgaben und Aufgaben mit langem Zeithorizont sowie „test-time compute scaling“ (Skalierung der Rechenleistung zur Inferenzzeit). Diese Seite fasst alles Neue in Claude Opus 5 zusammen, einschließlich Tool-Änderungen mitten in der Konversation und zweier „breaking changes“ (inkompatibler Änderungen) für Code, der auf Claude Opus 4.8 läuft: „Thinking“ (Denken) ist standardmäßig aktiviert, und Denken kann nur bei einem „effort“ (Aufwand) von high oder niedriger deaktiviert werden.
Vergleich
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5This model | 1M | 128K | $5 / $25 | Moderate | Adaptive | high | May 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Spezifikationen
Model IDs
- Claude API
Pricing
- Input
- $5 / MTok
- Output
- $25 / MTok
- 5m cache write
- $6.25 / MTok
- 1h cache write
- $10 / MTok
- Cache read
- $0.50 / MTok
- Batch API
- 50% discount on input and output
- Full price list
- Pricing
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- May 2026
- Training data cutoff
- May 2026
Availability
- Status
- Active (latest)
- Released
- July 24, 2026
- Retirement
- Not sooner than July 24, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft Foundry
Gut zu wissen
- Auf der Message Batches API unterstützt Claude Opus 5 bis zu 300k Ausgabe-Token mit dem Beta-Header
output-300k-2026-03-24. - Die minimale cachebare Prompt-Länge beträgt 512 Token. Siehe Prompt-Caching.
- Frage Limits und Fähigkeiten programmatisch mit der Models API ab.
Ressourcen
Modellspezifische Hinweise zum Prompting.
Effort ist bei Claude Opus 5 standardmäßig auf high gesetzt und spielt eine größere Rolle als bei früheren Modellen. Wähle eine Stufe pro Workload.
Standardmäßig aktiviert. Das Deaktivieren des Denkens erfordert Effort high oder niedriger.
Claude Opus 5 mit geringerer Latenz auf der Claude API (Research Preview), separat bepreist.
Referenz
Der System-Prompt, den Claude Opus 5 auf claude.ai und in den Claude-Apps verwendet.
Sicherheitsevaluierungen und Bereitstellungsentscheidungen für Claude Opus 5.
Vollständige Preisliste, einschließlich Batch-Rabatten und Prompt-Caching-Tarifen.
Wie Modell-IDs, Aliasse und fixierte Snapshots funktionieren.
Lebenszyklusstatus und Zusagen zur Einstellung für jedes Claude-Modell.
Was this page helpful?