Claude Opus 5.5Latest
For long-running agentic coding and knowledge work
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $4/ MTok
- Output pricing
- $20/ MTok
Panoramica
Claude Opus 5.5 è progettato per il coding agentico di lunga durata e per il lavoro di conoscenza, con un prezzo di $4 / $20 USD per milione di token di input / output. Quattro "breaking changes" (modifiche incompatibili) interessano il codice già in esecuzione su Claude Opus 5: il pensiero non può essere disabilitato, l'uso forzato degli strumenti restituisce un errore, i blocchi di pensiero sono legati al modello e alla conversazione e, sulla Claude API e su Google Cloud, lo strumento di computer use precedente computer_20251124 non è accettato. Le prime tre si applicano anche a Claude Fable 5.1. Un'ulteriore modifica altera la struttura della risposta senza far fallire alcuna richiesta: il testo tra le chiamate agli strumenti viene restituito in blocchi thinking il cui testo è vuoto con l'impostazione display predefinita. Un'applicazione che trasmette in streaming quel testo ai propri utenti come aggiornamenti di avanzamento resta silenziosa tra le chiamate agli strumenti finché non imposta un valore di display che restituisce il testo.
Come si confronta
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5This model | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Specifiche
Model IDs
- Claude API
Pricing
- Input
- $4 / MTok
- Output
- $20 / MTok
- 5m cache write
- $5 / MTok
- 1h cache write
- $8 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
- Full price list
- Pricing
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive (always on)
- Default effort
medium- Comparative latency
- Moderate
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 22, 2026
- Retirement
- Not sooner than September 22, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Da sapere
- L'"adaptive thinking" (pensiero adattivo) è sempre attivo e non può essere disattivato. Controlla la profondità del pensiero con il parametro effort.
- Sulla Message Batches API, Claude Opus 5.5 supporta fino a 300k token di output con l'header beta
output-300k-2026-03-24. - La lunghezza minima di un prompt memorizzabile nella cache è di 512 token. Consulta Cache dei prompt.
- Interroga limiti e capacità in modo programmatico con la Models API.
Risorse
Differenze comportamentali e pattern di prompting specifici di Claude Opus 5.5.
Il controllo per la profondità del pensiero, la "latency" (latenza) e il costo. Scegli un livello per ogni carico di lavoro.
Come funziona il pensiero adattivo e come vengono preservati i blocchi di pensiero.
Claude Opus 5.5 a latenza ridotta sulla Claude API (anteprima di ricerca), con prezzi separati.
Riferimento
Il prompt di sistema che Claude Opus 5.5 utilizza su claude.ai e nelle app Claude.
Valutazioni di sicurezza e decisioni di distribuzione per Claude Opus 5.5.
Listino prezzi completo, inclusi gli sconti batch e le tariffe della cache dei prompt.
Come funzionano gli ID dei modelli, gli alias e gli snapshot fissati.
Stato del ciclo di vita e impegni di ritiro per ogni modello Claude.
Was this page helpful?