Claude Opus 5Latest
For complex agentic coding and enterprise work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $5/ MTok
- Output pricing
- $25/ MTok
Panoramica
Claude Opus 5 rappresenta un miglioramento radicale rispetto a Claude Opus 4.8, con i progressi maggiori nel ragionamento profondo, nelle attività agentiche e a lungo orizzonte e nello scaling del calcolo in fase di test. Questa pagina riassume tutte le novità di Claude Opus 5, incluse le modifiche degli strumenti a metà conversazione e due modifiche incompatibili per il codice in esecuzione su Claude Opus 4.8: il thinking è attivo per impostazione predefinita e il thinking può essere disabilitato solo con effort high o inferiore.
Come si confronta
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5This model | 1M | 128K | $5 / $25 | Moderate | Adaptive | high | May 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Specifiche
Model IDs
- Claude API
Pricing
- Input
- $5 / MTok
- Output
- $25 / MTok
- 5m cache write
- $6.25 / MTok
- 1h cache write
- $10 / MTok
- Cache read
- $0.50 / MTok
- Batch API
- 50% discount on input and output
- Full price list
- Pricing
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- May 2026
- Training data cutoff
- May 2026
Availability
- Status
- Active (latest)
- Released
- July 24, 2026
- Retirement
- Not sooner than July 24, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft Foundry
Da sapere
- Sulla Message Batches API, Claude Opus 5 supporta fino a 300k token di output con l'header beta
output-300k-2026-03-24. - La lunghezza minima del prompt memorizzabile in cache è di 512 token. Consulta Cache dei prompt.
- Interroga limiti e capacità in modo programmatico con la Models API.
Risorse
Indicazioni di prompting specifiche per il modello.
L'"effort" (impegno) è impostato di default su high in Claude Opus 5 e conta più che nei modelli precedenti. Scegli un livello per ogni carico di lavoro.
Attivo di default. Disattivare il pensiero richiede un effort high o inferiore.
Claude Opus 5 a latenza ridotta sulla Claude API (anteprima di ricerca), con prezzo separato.
Riferimenti
Il prompt di sistema che Claude Opus 5 usa su claude.ai e nelle app Claude.
Valutazioni di sicurezza e decisioni di distribuzione per Claude Opus 5.
Listino prezzi completo, inclusi sconti batch e tariffe della cache dei prompt.
Come funzionano gli ID dei modelli, gli alias e gli snapshot fissati.
Stato del ciclo di vita e impegni di ritiro per ogni modello Claude.
Was this page helpful?