Claude Platform Docs
Modelli e prezziClaude Sonnet 5.5

Novità di Claude Sonnet 5.5

Cosa cambia quando passi da Claude Sonnet 5 a Claude Sonnet 5.5: modifiche che causano incompatibilità, supporto delle funzionalità, differenze di comportamento, prezzi e disponibilità.

Claude Sonnet 5.5 offre la migliore combinazione di velocità e intelligenza. Cinque "breaking changes" (modifiche che causano incompatibilità) interessano il codice già in esecuzione su Claude Sonnet 5:

Un'altra modifica altera la forma della risposta senza far fallire alcuna richiesta: il testo tra le chiamate agli strumenti viene restituito in blocchi thinking. Un'applicazione che trasmette in streaming quel testo ai propri utenti resta silenziosa tra le chiamate agli strumenti finché non imposta un valore display che restituisce il testo, oppure non disattiva il ragionamento anticipato con between_tools.

Nuovo modello

ModelloID API ClaudeDescrizione
Claude Sonnet 5.5La migliore combinazione di velocità e intelligenza

L'"adaptive thinking" (ragionamento adattivo) è attivo per impostazione predefinita, e il parametro "effort" (impegno) controlla la profondità del ragionamento. Il suo valore predefinito sull'API Claude è high. Il "tokenizer" (tokenizzatore) è lo stesso di Claude Sonnet 5, quindi lo stesso testo produce lo stesso numero di token. Per la "context window" (finestra di contesto), i limiti di output, la data limite delle conoscenze e i prezzi, consulta la pagina del modello Claude Sonnet 5.5.

Per tutti i modelli attuali, consulta la panoramica dei modelli.

Modifiche che causano incompatibilità

Disattiva il ragionamento anticipato con between_tools

Per disattivare il ragionamento anticipato su Claude Sonnet 5.5, invia thinking: {"type": "between_tools"} invece di "disabled". È l'impostazione di ragionamento più bassa su questo modello. È disponibile su ogni piattaforma che offre Claude Sonnet 5.5. Non richiede alcun "beta header" (header beta). I brevi "progress updates" (aggiornamenti di avanzamento) che il modello scrive tra le chiamate agli strumenti vengono comunque restituiti come blocchi thinking con il relativo testo di riepilogo. Rimanda indietro quei blocchi invariati insieme al resto del turno dell'assistente. Un blocco di aggiornamento di avanzamento che rimandi indietro fornisce al modello la nota completa che ha scritto, non il riepilogo. Se le tue richieste non usano strumenti, la risposta contiene solo testo, come con disabled su Claude Sonnet 5.

Su Claude Sonnet 5.5, una richiesta che invia thinking: {"type": "disabled"} restituisce un errore 400 invalid_request_error il cui messaggio rimanda a between_tools.

between_tools è accettato con effort low, medium e high. Con effort xhigh o max, una richiesta con between_tools restituisce un errore 400. Per eseguire con xhigh o max, usa il ragionamento adattivo: ometti il campo thinking oppure invia thinking: {"type": "adaptive"}, che è equivalente. Con between_tools, l'effort non può cambiare a metà conversazione: un output_config.effort per messaggio diverso dal livello in vigore restituisce un errore 400. Per variare l'effort a ogni turno, usa il ragionamento adattivo.

between_tools non accetta altri campi: display, budget_tokens o block_binding inviati insieme a esso restituiscono un errore 400. I budget di ragionamento manuali (thinking: {"type": "enabled", "budget_tokens": N}) restituiscono un errore 400. Consulta Ragionamento e il prima e dopo della guida alla migrazione.

L'uso forzato degli strumenti non è supportato

Claude Sonnet 5.5 non supporta l'uso forzato degli strumenti. tool_choice impostato su {"type": "any"} o {"type": "tool", "name": "..."} restituisce un errore 400 invalid_request_error:

tool_choice: type "tool" and "any" are not supported for this model.

tool_choice: {"type": "auto"} (il valore predefinito) e {"type": "none"} sono supportati. Lo stesso controllo si applica all'endpoint di conteggio dei token. Per un input degli strumenti conforme allo schema, mantieni tool_choice: {"type": "auto"} e imposta strict: true con lo "strict tool use" (uso rigoroso degli strumenti), oppure sposta lo schema negli "structured outputs" (output strutturati). Per fare in modo che il modello chiami uno strumento anziché rispondere con del testo, indica nel prompt quando lo strumento è applicabile. La guida alla migrazione mostra il prima e dopo.

I blocchi di ragionamento sono legati al modello e alla conversazione

Ogni blocco di ragionamento registra quale modello lo ha prodotto. Ogni modello legge i propri blocchi e solo quelli di alcuni altri modelli. Claude Sonnet 5.5 legge i blocchi di ragionamento di Claude Sonnet 5, Claude Opus 4.8, Claude Haiku 4.5 e dei modelli precedenti, ma non quelli di Claude Opus 5, Claude Opus 5.5 o di qualsiasi modello Claude Fable o Claude Mythos. Nessun altro modello legge i blocchi di ragionamento di Claude Sonnet 5.5.

Quindi una conversazione che passa da Claude Sonnet 5 a Claude Sonnet 5.5 mantiene il proprio ragionamento, mentre una che passa da Claude Sonnet 5.5 a qualsiasi altro modello esegue i turni successivi al cambio senza di esso. Quando una richiesta contiene un blocco che il modello di destinazione non può leggere, l'API lo scarta prima che il modello lo veda: la richiesta ha esito positivo e i blocchi scartati non vengono fatturati. Con l'header beta thinking-binding-controls-2026-08-01, lo scarto viene segnalato in un array input_transformations di primo livello. Consulta Cambiare modello a metà conversazione.

L'API verifica inoltre se qualcosa che precede un blocco di ragionamento di Claude Sonnet 5.5 è cambiato da quando il blocco è stato prodotto: il prompt system, i tools o un messaggio precedente. Applica questo controllo per impostazione predefinita per gli account creati a partire dal 31 agosto 2026, 00:00 UTC, sull'API Claude, su Amazon Bedrock e su Google Cloud. Su questi account, una richiesta che riproduce un blocco dopo una tale modifica restituisce un errore 400. Per scartare invece i blocchi interessati, invia l'header beta thinking-binding-controls-2026-08-01 e imposta thinking.block_binding.prefix_mismatch_behavior su "drop_block". Sugli account meno recenti, impostare quel campo su uno dei due valori attiva il controllo per la richiesta. block_binding funziona solo con thinking: {"type": "adaptive"}. Con between_tools, mantieni la cronologia "append-only" (in sola aggiunta), oppure rimuovi i blocchi di ragionamento dal turno modificato in poi.

Mantieni la conversazione in sola aggiunta, così che il controllo non fallisca mai: modifica le istruzioni o gli strumenti con i messaggi di sistema a metà conversazione anziché con modifiche. Consulta Ragionamento preservato e la nota su questa modifica della guida alla migrazione.

Lo strumento di uso del computer computer_20251124 non è supportato sull'API Claude e su Google Cloud

Sull'API Claude e su Google Cloud, Claude Sonnet 5.5 supporta l'uso del computer solo tramite il "toolset" (set di strumenti) computer_toolset_20260801. Una richiesta che dichiara il precedente strumento computer_20251124 restituisce un errore 400 invalid_request_error. Sull'API Claude, il messaggio indica il tipo rifiutato, quindi elenca i tipi di strumento che il modello accetta. Inizia così:

'claude-sonnet-5-5' does not support tool types: computer_20251124.

Su Amazon Bedrock, Claude Sonnet 5.5 accetta il precedente strumento computer_20251124.

Per migrare un'integrazione esistente sulla Claude API o su Google Cloud, segui Migrare da computer_20251124, che mostra la richiesta prima e dopo. Rimuovi il beta header, sostituisci la voce tools con {"type": "computer_toolset_20260801"} e aggiorna il ciclo del tuo agente per i blocchi tool_use dei membri, le azioni in batch e toolset_name nei risultati. Il toolset è disponibile sulla Claude API e su Google Cloud. Per le altre piattaforme, consulta la sezione Compatibilità dello strumento di computer use. Le integrazioni che usano già il toolset e lo strumento di browser use non richiedono modifiche.

Alcuni abbinamenti dello strumento advisor non sono supportati

Con lo strumento advisor (beta), un "executor" (esecutore) Claude Sonnet 5.5 richiede come advisor Claude Mythos 5.1, Claude Fable 5.1, Claude Mythos 5, Claude Fable 5, Claude Opus 5.5 o Claude Opus 5, oppure Claude Sonnet 5.5 stesso. Gli advisor Claude Opus 4.8, Claude Opus 4.7 e Claude Sonnet 5 funzionano con un esecutore Claude Sonnet 5, ma con un esecutore Claude Sonnet 5.5 restituiscono un errore 400 invalid_request_error. Ogni advisor accettato da Claude Sonnet 5.5 restituisce il proprio consiglio crittografato, come blocco advisor_redacted_result, quindi il tuo client non può leggere il testo del consiglio. Consulta le sezioni Compatibilità dei modelli e Varianti del risultato dello strumento advisor.

Supporto delle funzionalità

Claude Sonnet 5.5 supporta l'effort per messaggio (beta), i messaggi di sistema a metà conversazione, le modifiche agli strumenti a metà conversazione (beta), il "prompt caching" (cache dei prompt) con un prompt minimo memorizzabile nella cache di 512 token, il "batch processing" (elaborazione in batch), la Files API, il supporto PDF, la "vision" (visione) e gli strumenti lato server e lato client. L'effort per messaggio, i messaggi di sistema a metà conversazione e le modifiche agli strumenti a metà conversazione non sono disponibili su Claude Sonnet 5, il cui prompt minimo memorizzabile nella cache è di 1.024 token. Sull'API Claude e su Google Cloud, l'uso del computer richiede il set di strumenti computer_toolset_20260801 (consulta la modifica che causa incompatibilità). Consulta la pagina di ciascuna funzionalità per la disponibilità dei modelli.

Compattazione su richiesta (beta)

Con l'header beta compact-2026-09-04, una richiesta che invia il parametro di primo livello compaction restituisce un blocco compaction firmato che riassume l'intera conversazione. Invii quindi quel blocco per primo, al posto dei messaggi riassunti. Sei tu a scegliere quando eseguire la "compaction" (compattazione), e i blocchi di ragionamento nei turni che mantieni possono restare validi dopo la sostituzione, alle condizioni descritte in Compattazione e ragionamento preservato. Questo è importante su Claude Sonnet 5.5 perché i suoi blocchi di ragionamento sono legati alla conversazione. Consulta Compattazione su richiesta per la disponibilità sulle piattaforme e il flusso completo della richiesta.

Definire strumenti in un messaggio (beta)

Con l'header beta inline-tools-2026-09-15, un blocco tool_addition in un messaggio di sistema a metà conversazione può contenere una definizione completa dello strumento anziché un riferimento. Puoi aggiungere uno strumento, modificarne lo schema o spostare uno strumento server a una versione più recente a metà conversazione senza modificare tools e senza perdere la cache dei prompt. Consulta Definire strumenti in un messaggio.

I blocchi di ragionamento restano legati all'account che li ha prodotti

I blocchi di ragionamento prodotti da Claude Sonnet 5.5 funzionano solo nell'account che li ha prodotti o in un account collegato a esso. Quando un altro account invia uno di questi blocchi, l'API scarta il blocco prima che il modello lo veda e la richiesta ha esito positivo. Sull'API Claude e su Google Cloud, con l'header beta thinking-binding-controls-2026-08-01, la risposta elenca ogni blocco scartato in input_transformations con reason: "organization_binding_mismatch". I blocchi dei modelli precedenti non sono interessati. Consulta Ragionamento preservato.

Differenze di comportamento

Claude Sonnet 5.5 differisce da Claude Sonnet 5 in diversi modi che si manifestano senza alcuna modifica al codice. Prompting per Claude Sonnet 5.5 contiene indicazioni per ciascuno:

  • I livelli di effort sono ricalibrati. Un livello di effort non produce la stessa quantità di ragionamento che produceva su Claude Sonnet 5. Ripeti la tua valutazione dei livelli di effort anziché riportare un'impostazione esistente. Inizia con high, a meno che il tuo carico di lavoro non sia agentico o sensibile alla "latency" (latenza). Per la programmazione agentica e l'uso degli strumenti in più passaggi, inizia con medium per attività ben specificate e passa a high per quelle più difficili o più lunghe. Per la chat e altri lavori sensibili alla latenza, inizia con medium o low.
  • Il testo tra le chiamate agli strumenti viene restituito in blocchi di ragionamento. Tra le chiamate agli strumenti, le note più lunghe di una o due frasi vengono restituite come blocchi thinking di aggiornamento di avanzamento. Le osservazioni più brevi restano text. Con il valore predefinito display: "omitted", il testo dei blocchi di aggiornamento di avanzamento è vuoto, quindi un'applicazione che trasmette in streaming quelle note ai propri utenti resta silenziosa tra le chiamate agli strumenti, senza alcun errore. Se disattivi il ragionamento anticipato con between_tools, il testo viene restituito. La guida alla migrazione mostra come riceverlo.
  • Categorie di salvaguardia. Le "safeguards" (salvaguardie) del modello possono rifiutare una richiesta in cinque categorie stop_details. "cyber" significa che la richiesta potrebbe favorire danni informatici. "bio" significa che potrebbe favorire danni biologici. "frontier_llm" significa che potrebbe assistere lo sviluppo di modelli di IA concorrenti. "reasoning_extraction" significa che chiede al modello di riprodurre il proprio ragionamento interno nel testo della risposta. "general_harms" significa che rientra in un'altra area delle norme di utilizzo. Consulta Rifiuti, fallback e fatturazione.

Rifiuti, fallback e fatturazione

Tutto quanto descritto in Rifiuti e fallback si applica a Claude Sonnet 5.5. Una richiesta rifiutata restituisce HTTP 200 con stop_reason: "refusal" e un oggetto stop_details che indica l'area delle norme interessata. Gestisci i "refusals" (rifiuti) e configura il "fallback" (ripiego). Il fallback lato server (fallbacks: "default", in beta, sull'API Claude) ritenta su Claude Sonnet 5 i rifiuti "cyber" e "frontier_llm". Non ritenta i rifiuti "bio", "reasoning_extraction" o "general_harms". Puoi anche usare il middleware dell'SDK o un tuo meccanismo di ripetizione. Il fatto che un rifiuto che arriva prima di qualsiasi output venga fatturato dipende dalla sua categoria di rifiuto, e in ogni caso viene conteggiato nei tuoi "rate limits" (limiti di velocità). Consulta Come vengono fatturati i rifiuti.

Prezzi

Claude Sonnet 5.5 ha gli stessi prezzi di Claude Sonnet 5, incluse le tariffe per la cache dei prompt e l'elaborazione in batch. Consulta Prezzi per l'elenco completo, la residenza dei dati e i prezzi degli strumenti.

Disponibilità

Claude Sonnet 5.5 è disponibile su:

Migrare da Claude Sonnet 5

Aggiorna l'ID del modello:

model = "claude-sonnet-5"  # Before
model = "claude-sonnet-5-5"  # After

Quindi verifica sei aspetti:

  1. Se il tuo codice disattiva il ragionamento con disabled, invia invece between_tools, con effort high o inferiore.
  2. Sostituisci i tipi di tool_choice any e tool con auto più l'uso rigoroso degli strumenti.
  3. Mantieni le conversazioni in sola aggiunta. Una richiesta che riproduce un blocco di ragionamento di Claude Sonnet 5.5 dopo una modifica alla cronologia precedente può restituire un errore 400. Consulta I blocchi di ragionamento sono legati al modello e alla conversazione.
  4. Se utilizzi l'uso del computer tramite computer_20251124 sull'API Claude o su Google Cloud, passa al set di strumenti.
  5. Se usi lo strumento advisor con un advisor Claude Opus 4.8, Claude Opus 4.7 o Claude Sonnet 5, passa a un advisor accettato da Claude Sonnet 5.5.
  6. Se la tua interfaccia mostra il testo tra le chiamate agli strumenti, imposta thinking.display quando usi il ragionamento adattivo. Con between_tools, il testo viene restituito anche senza. Consulta Il testo tra le chiamate agli strumenti viene restituito in blocchi di ragionamento.

La guida alla migrazione contiene istruzioni dettagliate per migrare da Claude Sonnet 5 e dai modelli precedenti, oltre alla checklist completa.

Passaggi successivi

Specifiche complete e prezzi di tutti i modelli Claude attuali.

Sposta il codice da Claude Sonnet 5 e dai modelli precedenti a Claude Sonnet 5.5.

Differenze di comportamento e pattern di prompting specifici per Claude Sonnet 5.5.

Controlla quanti token Claude utilizza nel rispondere, da low a max.

Come funziona il ragionamento adattivo e come vengono preservati i blocchi di ragionamento.

Gestisci stop_reason: "refusal" e riprova su un altro modello.

Was this page helpful?