Claude Platform Docs
Modelli e prezziClaude Sonnet 5

Novità in Claude Sonnet 5

Panoramica delle nuove funzionalità e delle modifiche al comportamento in Claude Sonnet 5.

Claude Sonnet 5 è la prossima generazione della famiglia di modelli Sonnet di Anthropic. È un aggiornamento drop-in per Claude Sonnet 4.6 con tre modifiche al comportamento: il pensiero adattivo è attivo per impostazione predefinita, il pensiero esteso manuale ora restituisce un errore 400 (era deprecato su Claude Sonnet 4.6), e l'impostazione dei parametri di campionamento (temperature, top_p, top_k) su valori non predefiniti restituisce un errore 400. Questa pagina riassume tutte le novità al lancio, incluso un nuovo tokenizer.

Nuovo modello

ModelloID modello APIDescrizione
Claude Sonnet 5claude-sonnet-5La migliore combinazione di velocità e intelligenza

Claude Sonnet 5 supporta la finestra di contesto da 1M token per impostazione predefinita (1M token è sia il valore predefinito che il massimo; non esiste una variante di contesto più piccola), 128k token di output massimi, il pensiero adattivo, e lo stesso insieme di strumenti e funzionalità della piattaforma di Claude Sonnet 4.6, ad eccezione del Priority Tier, che non è disponibile su Claude Sonnet 5. Sulla Claude API e su Google Cloud, Claude Sonnet 5 supporta anche il browser use tool e la versione stabile computer_toolset_20260801 del computer use tool, nessuno dei quali è supportato da Claude Sonnet 4.6; la versione precedente computer_20251124 è ancora accettata su entrambi i modelli. Per aggiornare un'integrazione esistente, consulta Migrare da computer_20251124.

Per i prezzi e le specifiche complete, consulta la panoramica dei modelli.

Modifiche al comportamento

Pensiero adattivo attivo per impostazione predefinita

Su Claude Sonnet 4.6, le richieste senza un campo thinking vengono eseguite senza pensiero. Su Claude Sonnet 5, le stesse richieste vengono eseguite con il pensiero adattivo. Per disattivare il pensiero, passa thinking: {type: "disabled"}. Poiché max_tokens è un limite rigido sull'output totale (pensiero più testo di risposta), rivedilo per i carichi di lavoro che venivano eseguiti senza pensiero su Claude Sonnet 4.6.

Parametri di campionamento non accettati

L'impostazione di temperature, top_p o top_k su un valore non predefinito restituisce un errore 400. Rimuovi questi parametri durante la migrazione; il valore predefinito (o l'omissione del parametro) è accettato. Usa le istruzioni del prompt di sistema per guidare il comportamento del modello. Questa è una novità per i modelli di classe Sonnet; lo stesso vincolo era stato precedentemente introdotto su Claude Opus 4.7.

Pensiero esteso manuale rimosso

Il pensiero esteso manuale (thinking: {type: "enabled", budget_tokens: N}) era deprecato su Claude Sonnet 4.6; su Claude Sonnet 5 è rimosso e restituisce un errore 400, lo stesso di Claude Opus 4.8 e Claude Opus 4.7. Usa invece il pensiero adattivo con il parametro effort.

# Non supportato su Claude Sonnet 5 (restituisce 400)
thinking = {"type": "enabled", "budget_tokens": 32000}

# Usa questo invece
thinking = {"type": "adaptive"}

Nuovo tokenizer

Claude Sonnet 5 utilizza un nuovo tokenizer. Lo stesso testo di input produce circa il 30% in più di token rispetto a Claude Sonnet 4.6. L'aumento esatto dipende dal contenuto. Questa non è una modifica dell'API: richieste, risposte ed eventi di streaming mantengono la stessa forma, e non sono necessarie modifiche al codice.

La modifica influisce su tutto ciò che misuri o pianifichi in token:

  • Conteggi dei token: i campi usage e i risultati del conteggio dei token per lo stesso testo sono più alti rispetto a Claude Sonnet 4.6. Non riutilizzare i conteggi misurati rispetto ai modelli precedenti; riconta rispetto a Claude Sonnet 5.
  • Capacità della finestra di contesto in termini di testo: la finestra di contesto è di 1M token, ma ogni token copre in media meno testo, quindi la stessa finestra contiene meno testo rispetto a Claude Sonnet 4.6.
  • Budget di max_tokens: un limite di output ottimizzato per Claude Sonnet 4.6 potrebbe troncare l'output equivalente su Claude Sonnet 5. Rivedi i limiti dimensionati vicino alla lunghezza di output prevista.
  • Costo per richiesta: il prezzo per token è inferiore a quello di Claude Sonnet 4.6 (vedi Prezzi), ma poiché lo stesso testo produce più token, il costo di una richiesta equivalente non diminuisce in proporzione diretta.

Vincoli API ereditati da Claude Sonnet 4.6

Prefilling del messaggio dell'assistente non supportato

Il prefilling del messaggio dell'assistente restituisce un errore 400, invariato rispetto a Claude Sonnet 4.6. Usa invece gli output strutturati, le istruzioni del prompt di sistema, o output_config.format.

Miglioramenti delle capacità

Claude Sonnet 5 è un aggiornamento delle capacità rispetto a Claude Sonnet 4.6 a un prezzo inferiore. È anche un'opzione per i carichi di lavoro che necessitano di più capacità di quanto fornisca Claude Sonnet 4.6 senza passare a un modello di classe Opus.

I maggiori guadagni rispetto a Claude Sonnet 4.6 sono nelle attività di coding e agentiche. Per i risultati dei benchmark, consulta il Transparency Hub di Anthropic.

Salvaguardie di cybersicurezza

Claude Sonnet 5 è il primo modello di livello Sonnet con salvaguardie di cybersicurezza in tempo reale. Le richieste che coinvolgono argomenti di cybersicurezza proibiti o ad alto rischio possono essere rifiutate. I rifiuti vengono restituiti come una risposta HTTP 200 riuscita con stop_reason: "refusal", non come un errore. Consulta Salvaguardie cyber in tempo reale su Claude Opus e Sonnet per sapere cosa bloccano le salvaguardie e come il lavoro di sicurezza legittimo può candidarsi al Cyber Verification Program.

Prezzi

Claude Sonnet 5 ha un prezzo di $2 per milione di token di input e $10 per milione di token di output, un prezzo per token inferiore rispetto a $3/$15 di Claude Sonnet 4.6. Poiché il nuovo tokenizer produce circa il 30% in più di token per lo stesso testo, il costo di una richiesta equivalente non diminuisce in proporzione diretta ai prezzi per token quando si confronta con Claude Sonnet 4.6. La differenza esatta dipende dal contenuto e dalla forma del carico di lavoro.

Consulta Prezzi per i prezzi completi, incluse le tariffe di elaborazione batch e della cache dei prompt.

Disponibilità

Al lancio, Claude Sonnet 5 è disponibile su:

Claude Sonnet 5 supporta la conservazione zero dei dati per le organizzazioni con accordi ZDR.

Guida alla migrazione

Claude Sonnet 5 è un sostituto drop-in per Claude Sonnet 4.6. Aggiorna il tuo ID modello:

model = "claude-sonnet-4-6"  # Before
model = "claude-sonnet-5"  # After

Quindi rivedi quanto segue:

  1. Budget e conteggi dei token: il nuovo tokenizer produce circa il 30% in più di token per lo stesso testo. L'aumento esatto dipende dal contenuto e dalla forma del carico di lavoro. Riconta i prompt con il conteggio dei token, e rivedi i limiti di max_tokens dimensionati vicino alla lunghezza di output prevista.
  2. Pensiero esteso: se imposti ancora budget_tokens, migra al pensiero adattivo. Il pensiero esteso manuale (thinking: {type: "enabled"}) non è supportato e restituisce un errore 400.
  3. Parametri di campionamento: le richieste che impostano i parametri di campionamento (temperature, top_p, top_k) su un valore non predefinito restituiscono un errore 400; rimuovili durante la migrazione. Le definizioni degli strumenti e le forme delle risposte sono invariate, e il prefilling del messaggio dell'assistente era già non supportato su Claude Sonnet 4.6.

Consulta Migrare a Claude Sonnet 5 da Claude Sonnet 4.6 per i dettagli.

Prossimi passi

Specifiche e prezzi completi per tutti i modelli Claude attuali.

Misura i tuoi prompt con il nuovo tokenizer prima di migrare.

La modalità di pensiero attivo consigliata su Claude Sonnet 5.

Come funziona la finestra di contesto da 1M token.

Prezzi completi, incluse le tariffe di elaborazione batch e della cache dei prompt.

Was this page helpful?