Claude Platform Docs
Modelli e prezziClaude Haiku 5.5

Novità di Claude Haiku 5.5

Panoramica delle nuove funzionalità, delle modifiche incompatibili e delle modifiche di comportamento in Claude Haiku 5.5, con un link alla guida di ciascuna funzionalità e alla guida alla migrazione per le modifiche al codice.

Claude Haiku 5.5 è progettato per carichi di lavoro ad alto volume e sensibili alla "latency" (latenza), come classificazione, instradamento, estrazione e attività di subagenti. Supporta l'"adaptive thinking" (ragionamento adattivo) con il parametro effort, una "context window" (finestra di contesto) da 1M token e fino a 128k token di output. Utilizza lo stesso tokenizer più recente di Claude 4.7 e dei modelli successivi, quindi lo stesso testo corrisponde a circa il 30% di token in più rispetto a Claude Haiku 4.5. I suoi blocchi di ragionamento funzionano solo nell'account che li ha prodotti o in un account collegato a esso.

Per le modifiche al codice, consulta la guida alla migrazione. Per ID dei modelli, prezzi e limiti, consulta la panoramica di Claude Haiku 5.5. Per indicazioni sulla scrittura dei prompt, consulta Prompting per Claude Haiku 5.5.

Riepilogo delle modifiche rispetto a Claude Haiku 4.5

Ogni riga indica una modifica, se è nuova, modificata o incompatibile, e cosa deve fare il tuo codice.

ModificaTipoAzione necessaria
Ragionamento adattivo ed effortNuovaFacoltativa: imposta effort per bilanciare la qualità della risposta con velocità e costi.
Finestra di contesto e output più ampiNuovaNessuna. I valori esistenti di max_tokens restano validi, ma i token di ragionamento vengono conteggiati al loro interno.
Strumento browser useNuovaNessuna. Disponibile sulla Claude API e su Google Cloud.
I classificatori di sicurezza possono rifiutare una richiestaNuovaGestisci stop_reason: "refusal" nel tuo client. Il fallback lato server non è disponibile.
Il ragionamento esteso manuale restituisce un erroreIncompatibileSostituisci budget_tokens con il ragionamento adattivo.
I parametri di campionamento non predefiniti restituiscono un erroreIncompatibileOmetti temperature, top_p e top_k.
Il prefill dei messaggi dell'assistente restituisce un erroreIncompatibileTermina messages con un turno dell'utente.
Il computer use richiede il toolset sulla Claude API e su Google CloudIncompatibileSostituisci computer_20250124 con computer_toolset_20260801.
La modifica dei turni precedenti invalida i blocchi di ragionamentoIncompatibileMantieni le conversazioni in sola aggiunta se rinvii i blocchi di ragionamento.
Le risposte possono iniziare con blocchi di ragionamentoModificataSeleziona i blocchi di contenuto in base a type, non in base alla posizione.
Il testo del ragionamento è omesso per impostazione predefinitaModificataPer ricevere il ragionamento riassunto, imposta thinking.display su "summarized".
Lo stesso testo corrisponde a più tokenModificataRiconta i prompt e rivedi max_tokens e le stime dei costi.
Riproduzione dei blocchi di ragionamento tra accountModificataSe riproduci conversazioni memorizzate tramite un account diverso, riproduci ciascuna tramite l'account che l'ha prodotta.

Nuove funzionalità

Ragionamento adattivo ed effort

Con il ragionamento adattivo, Claude Haiku 5.5 decide quando e quanto ragionare. Il ragionamento adattivo è attivo per impostazione predefinita. Sebbene tu possa ancora disattivare il ragionamento con thinking: {"type": "disabled"} con effort high o inferiore, il modo migliore per bilanciare la qualità della risposta con velocità e costi è usare il parametro effort.

Finestra di contesto e output più ampi

Claude Haiku 5.5 ha una finestra di contesto da 1M token e restituisce fino a 128k token di output, rispetto ai 200k e 64k di Claude Haiku 4.5. I valori esistenti di max_tokens restano validi, ma i token di ragionamento vengono conteggiati in max_tokens, quindi un limite ridotto può interrompere la risposta dopo un blocco thinking e prima di qualsiasi testo. Consulta Configura il ragionamento.

Modifiche di comportamento

Le risposte possono iniziare con blocchi di ragionamento

Il ragionamento adattivo è attivo per impostazione predefinita, quindi una risposta può iniziare con uno o più blocchi thinking anche quando la richiesta non menziona il ragionamento. Il codice che legge il primo blocco di contenuto come risposta deve selezionare i blocchi in base al loro campo type. Consulta Configura il ragionamento nella guida alla migrazione.

Lo stesso testo corrisponde a più token

Claude Haiku 5.5 utilizza lo stesso tokenizer più recente di Claude 4.7 e dei modelli successivi. Come per tutti i modelli che utilizzano questo tokenizer, lo stesso testo di input produce circa il 30% di token in più su Claude Haiku 5.5 rispetto a Claude Haiku 4.5. L'aumento esatto dipende dal contenuto. La struttura delle richieste e delle risposte non dipende dal tokenizer, ma tutto ciò che misuri o pianifichi in token cambia. Consulta Riconta i token nella guida alla migrazione.

Riproduzione dei blocchi di ragionamento tra account

I blocchi di ragionamento di Claude Haiku 5.5 funzionano solo nell'account che li ha prodotti o in un account collegato a esso. Questo è rilevante solo se memorizzi le conversazioni e le riproduci tramite un account diverso. Consulta Riproduci i blocchi di ragionamento tramite l'account che li ha prodotti.

Was this page helpful?