Claude Platform Docs
Modelli e prezziClaude Opus 5

Novità di Claude Opus 5

Panoramica delle nuove funzionalità e delle modifiche di comportamento in Claude Opus 5.

Claude Opus 5 rappresenta un miglioramento radicale rispetto a Claude Opus 4.8, con i progressi maggiori nel ragionamento profondo, nelle attività agentiche e a lungo orizzonte e nello scaling del calcolo in fase di test. Questa pagina riassume tutte le novità di Claude Opus 5, incluse le modifiche degli strumenti a metà conversazione e due modifiche incompatibili per il codice in esecuzione su Claude Opus 4.8: il thinking è attivo per impostazione predefinita e il thinking può essere disabilitato solo con effort high o inferiore.

Nuovo modello

ModelloID modello APIDescrizione
Claude Opus 5claude-opus-5Per attività complesse di coding agentico e lavoro aziendale

Claude Opus 5 ha una "context window" (finestra di contesto) da 1M di token (1M di token è sia il valore predefinito sia il massimo; non esiste una variante con contesto più piccolo), 128k token di output massimi e il thinking attivo per impostazione predefinita. Il Priority Tier non è supportato su Claude Opus 5.

Per prezzi e specifiche complete, consulta la panoramica dei modelli.

Nuove funzionalità

Modifiche degli strumenti a metà conversazione (beta)

Puoi aggiungere o rimuovere strumenti tra i turni di una conversazione preservando la cache dei prompt, invece di reinviare un elenco fisso di strumenti per tutta la durata di una sessione. Le modifiche degli strumenti a metà conversazione sono in beta: includi l'header beta mid-conversation-tool-changes-2026-07-01 nelle tue richieste. Consulta Modifiche degli strumenti a metà conversazione per l'utilizzo.

Modalità fallback predefinita

Il parametro fallbacks supporta una nuova modalità "default", che applica i modelli di fallback raccomandati da Anthropic per categoria di rifiuto invece di un elenco di modelli gestito da te. L'intero parametro fallbacks è in beta. Usa l'header beta server-side-fallback-2026-07-01, che supporta sia la modalità "default" sia gli elenchi espliciti di modelli (il precedente header server-side-fallback-2026-06-01 accetta solo elenchi espliciti). Consulta Rifiuti e fallback.

Minimo inferiore per la cache dei prompt

La lunghezza minima del prompt memorizzabile in cache su Claude Opus 5 è di 512 token, ridotta rispetto ai 1.024 token di Claude Opus 4.8. I prompt che erano troppo brevi per essere memorizzati in cache su Claude Opus 4.8 possono ora creare voci di cache senza modifiche al codice. Consulta "Prompt caching" (cache dei prompt) per i minimi per modello.

Fast mode

La fast mode (anteprima di ricerca) è disponibile per Claude Opus 5 solo sulla Claude API; non è attualmente disponibile su Amazon Bedrock, Claude Platform su AWS, Google Cloud o Microsoft Foundry. La fast mode per Claude Opus 5 ha un prezzo di $10 USD per milione di token di input e $50 USD per milione di token di output. Consulta Fast mode per accesso, modelli supportati e prezzi.

Modifiche di comportamento

Thinking attivo per impostazione predefinita

Su Claude Opus 4.8, le richieste vengono eseguite senza thinking a meno che non imposti thinking: {"type": "adaptive"}. Su Claude Opus 5, le stesse richieste vengono eseguite con l'adaptive thinking (pensiero adattivo) attivo per impostazione predefinita: il modello decide quando e quanto pensare a ogni turno, e il parametro effort è il controllo per la profondità del thinking. Il valore trasmesso è invariato; thinking: {"type": "adaptive"} rimane valido ed equivalente al valore predefinito.

Questa è una modifica incompatibile per il codice che veniva eseguito senza thinking su Claude Opus 4.8. Una risposta può iniziare con uno o più blocchi thinking prima del primo blocco text, restituiti con un campo thinking vuoto con il valore predefinito display: "omitted", quindi il codice che legge content[0].text o tratta il primo blocco di contenuto in streaming come testo deve invece selezionare i blocchi di contenuto in base al loro campo type. I cicli di uso degli strumenti devono restituire i blocchi thinking completi e non modificati insieme ai risultati degli strumenti; consulta Preservare i blocchi thinking.

I token di thinking vengono fatturati come token di output e contano ai fini di max_tokens, un limite rigido sull'output totale (thinking più testo della risposta), quindi rivedi max_tokens e ricalcola la baseline dei costi per i carichi di lavoro che venivano eseguiti senza thinking su Claude Opus 4.8.

L'API mantiene l'opzione per disabilitare il thinking, soggetta alla restrizione sull'effort per la sua disabilitazione.

L'effort conta di più

Claude Opus 5 converte l'effort aggiuntivo in risultati migliori in modo più affidabile di qualsiasi modello Opus precedente, quindi il livello di effort che scegli ha un peso maggiore. L'intera scala è disponibile: low, medium, high, xhigh e max, con max come livello più alto per il ragionamento più profondo possibile. Inizia dal valore predefinito, high, e regola in entrambe le direzioni in base alle tue valutazioni: scendi dove la qualità regge per risparmiare token e latenza, oppure sali per il lavoro più impegnativo. Quando esegui con effort xhigh o max, imposta un max_tokens elevato in modo che il modello abbia spazio per pensare e agire attraverso subagenti e chiamate agli strumenti.

Questa richiesta porta l'effort fino a max:

client = anthropic.Anthropic()

with client.messages.stream(
    model="claude-opus-5",
    max_tokens=64000,
    output_config={"effort": "max"},
    messages=[
        {
            "role": "user",
            "content": "Explain why the sum of two even numbers is always even.",
        }
    ],
) as stream:
    response = stream.get_final_message()

print(response)

Il thinking è attivo per impostazione predefinita su Claude Opus 5, quindi non è necessario alcun campo thinking.

Disabilitare il thinking richiede effort high o inferiore

Su Claude Opus 5, thinking: {"type": "disabled"} è accettato solo quando il livello di effort è high o inferiore. Impostare thinking: {"type": "disabled"} con effort xhigh o max restituisce un errore 400. Questa regola viene applicata a ogni richiesta verso Claude Opus 5 e modelli successivi. È una modifica incompatibile rispetto a Claude Opus 4.8, dove la disabilitazione del thinking era indipendente dal livello di effort. Se le tue richieste a Claude Opus 4.8 disabilitano il thinking con effort xhigh o max, mantieni il thinking disabilitato e imposta l'effort su high o inferiore, oppure mantieni il livello di effort e rimuovi il campo thinking.

Con il thinking disabilitato, Claude Opus 5 può occasionalmente scrivere una chiamata a uno strumento nel suo output di testo invece di emettere un blocco tool_use, oppure includere tag XML interni nella sua risposta visibile. Dove possibile, mantieni il thinking abilitato e controlla il costo dei token con livelli di effort inferiori; per le integrazioni che devono mantenere il thinking disabilitato, consulta Esecuzione con thinking disabilitato per le mitigazioni tramite prompt.

Differenze di comportamento del modello

Oltre a queste modifiche all'API, Claude Opus 5 si comporta diversamente da Claude Opus 4.8 in modi che potresti notare senza modificare alcun codice. Le risposte predefinite rivolte all'utente e i documenti prodotti sono più lunghi. Nelle sessioni agentiche, il modello descrive i propri progressi all'utente più spesso. Nei framework multi-agente, delega ai subagenti più facilmente. Inoltre verifica il proprio lavoro senza che gli venga chiesto, quindi rimuovi le istruzioni di verifica ereditate dai modelli precedenti ("includi un passaggio di verifica finale", "usa un subagente per verificare"); causano una verifica eccessiva su Claude Opus 5. Per i pattern di prompting che regolano ciascuno di questi comportamenti, consulta Prompting per Claude Opus 5.

Miglioramenti delle capacità

Rispetto a Claude Opus 4.8, Claude Opus 5 è un miglioramento radicale piuttosto che incrementale, e offre intelligenza di frontiera a metà del costo di Claude Fable 5. I progressi maggiori riguardano:

  • Ragionamento profondo, sostenendo analisi multistep lungo catene di problemi estese.
  • Coding agentico e attività a lungo orizzonte, rimanendo concentrato sull'attività attraverso cicli prolungati di uso degli strumenti e completando funzionalità multi-file, refactoring più ampi e lavoro end-to-end sulle funzionalità senza lasciare stub o placeholder.
  • Scaling del calcolo in fase di test, convertendo l'effort aggiuntivo (fino al livello max) in risultati migliori.
  • Efficienza a livelli di effort inferiori, con effort low e medium che producono una qualità elevata con una frazione dei token e della latenza delle impostazioni più alte.
  • Code review e individuazione di bug, facendo emergere bug reali con un tasso elevato per passaggio e pochi falsi positivi, e rimanendo accurato a livelli di effort inferiori.
  • Visione, comprendendo grafici, documenti e diagrammi e replicando elementi visivi di UI e frontend, con i risultati migliori quando dispone di strumenti per analizzare, ritagliare e verificare iterativamente il proprio lavoro.
  • Lavoro su contesti lunghi, con una finestra di contesto da 1M di token sia come valore predefinito sia come massimo, e rispetto delle istruzioni, chiamata degli strumenti e ragionamento coerenti lungo tutta la finestra.
  • Attività d'ufficio e sui documenti, generando e modificando fogli di calcolo complessi multi-foglio con formule non banali, e producendo presentazioni ben strutturate.
  • Coordinamento multi-agente, gestendo team di subagenti con pattern scrittore-verificatore efficaci e pochi casi di agenti che sovrascrivono il lavoro degli altri.

Per i pattern di prompting che sfruttano al meglio queste capacità, consulta Prompting per Claude Opus 5.

Prezzi

Claude Opus 5 ha un prezzo di $5 USD per milione di token di input e $25 USD per milione di token di output, invariato rispetto a Claude Opus 4.8. Poiché il thinking è attivo per impostazione predefinita e i token di thinking vengono fatturati come token di output, un carico di lavoro che veniva eseguito senza thinking su Claude Opus 4.8 può produrre più token di output per richiesta alle stesse tariffe per token; consulta Controllo dei costi.

Consulta Prezzi per i prezzi completi, incluse le tariffe per l'elaborazione batch, la cache dei prompt e la fast mode.

Disponibilità

Claude Opus 5 è disponibile su:

Claude Opus 4.8 rimane disponibile su tutte queste piattaforme.

Guida alla migrazione

Per migrare da Claude Opus 4.8, aggiorna il tuo ID modello:

model = "claude-opus-4-8"  # Before
model = "claude-opus-5"  # After

Quindi esamina le due modifiche incompatibili in Modifiche di comportamento: il thinking è attivo per impostazione predefinita (le risposte possono iniziare con blocchi thinking, quindi seleziona i blocchi di contenuto in base a type), e disabilitare il thinking con effort xhigh o max restituisce un errore 400. Consulta la guida alla migrazione per istruzioni passo passo e la checklist completa.

Passaggi successivi

Specifiche e prezzi completi per tutti i modelli Claude attuali.

Differenze comportamentali e pattern di prompting specifici per Claude Opus 5.

Controlla quanti token Claude usa quando risponde, da low a max.

Come funziona il thinking quando è attivo per impostazione predefinita e quando può essere disabilitato.

Fornisci a Claude un budget di token indicativo su cui calibrare il proprio lavoro.

Guida per migrare ai modelli Claude più recenti dalle versioni precedenti di Claude.

Ottieni più token di output al secondo dai modelli Claude Opus a un prezzo premium.

Was this page helpful?