Claude Platform Docs
Modelli e prezziModelli

Claude Opus 5.5Latest

For long-running agentic coding and knowledge work

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$4/ MTok
Output pricing
$20/ MTok

Panoramica

Claude Opus 5.5 è progettato per il coding agentico di lunga durata e per il lavoro di conoscenza, con un prezzo di $4 / $20 USD per milione di token di input / output. Quattro "breaking changes" (modifiche incompatibili) interessano il codice già in esecuzione su Claude Opus 5: il pensiero non può essere disabilitato, l'uso forzato degli strumenti restituisce un errore, i blocchi di pensiero sono legati al modello e alla conversazione e, sulla Claude API e su Google Cloud, lo strumento di computer use precedente computer_20251124 non è accettato. Le prime tre si applicano anche a Claude Fable 5.1. Un'ulteriore modifica altera la struttura della risposta senza far fallire alcuna richiesta: il testo tra le chiamate agli strumenti viene restituito in blocchi thinking il cui testo è vuoto con l'impostazione display predefinita. Un'applicazione che trasmette in streaming quel testo ai propri utenti come aggiornamenti di avanzamento resta silenziosa tra le chiamate agli strumenti finché non imposta un valore di display che restituisce il testo.

Novità di Claude Opus 5.5

Come si confronta

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.5This model1M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 51M128K$2 / $10FastAdaptivehighJan 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtendedFeb 2025

Specifiche

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$4 / MTok
Output
$20 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output
Full price list
Pricing

Capabilities

Max output
128K tokens
Thinking
Adaptive (always on)
Comparative latency
Moderate
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 22, 2026
Retirement
Not sooner than September 22, 2027

Da sapere

  • L'"adaptive thinking" (pensiero adattivo) è sempre attivo e non può essere disattivato. Controlla la profondità del pensiero con il parametro effort.
  • Sulla Message Batches API, Claude Opus 5.5 supporta fino a 300k token di output con l'header beta output-300k-2026-03-24.
  • La lunghezza minima di un prompt memorizzabile nella cache è di 512 token. Consulta Cache dei prompt.
  • Interroga limiti e capacità in modo programmatico con la Models API.

Risorse

Differenze comportamentali e pattern di prompting specifici di Claude Opus 5.5.

Il controllo per la profondità del pensiero, la "latency" (latenza) e il costo. Scegli un livello per ogni carico di lavoro.

Come funziona il pensiero adattivo e come vengono preservati i blocchi di pensiero.

Claude Opus 5.5 a latenza ridotta sulla Claude API (anteprima di ricerca), con prezzi separati.

Riferimento

Il prompt di sistema che Claude Opus 5.5 utilizza su claude.ai e nelle app Claude.

Valutazioni di sicurezza e decisioni di distribuzione per Claude Opus 5.5.

Listino prezzi completo, inclusi gli sconti batch e le tariffe della cache dei prompt.

Come funzionano gli ID dei modelli, gli alias e gli snapshot fissati.

Stato del ciclo di vita e impegni di ritiro per ogni modello Claude.

Was this page helpful?