Novità di Claude Haiku 5.5
Panoramica delle nuove funzionalità, delle modifiche incompatibili e delle modifiche di comportamento in Claude Haiku 5.5, con un link alla guida di ciascuna funzionalità e alla guida alla migrazione per le modifiche al codice.
Claude Haiku 5.5 è progettato per carichi di lavoro ad alto volume e sensibili alla "latency" (latenza), come classificazione, instradamento, estrazione e attività di subagenti. Supporta l'"adaptive thinking" (ragionamento adattivo) con il parametro effort, una "context window" (finestra di contesto) da 1M token e fino a 128k token di output. Utilizza lo stesso tokenizer più recente di Claude 4.7 e dei modelli successivi, quindi lo stesso testo corrisponde a circa il 30% di token in più rispetto a Claude Haiku 4.5. I suoi blocchi di ragionamento funzionano solo nell'account che li ha prodotti o in un account collegato a esso.
Per le modifiche al codice, consulta la guida alla migrazione. Per ID dei modelli, prezzi e limiti, consulta la panoramica di Claude Haiku 5.5. Per indicazioni sulla scrittura dei prompt, consulta Prompting per Claude Haiku 5.5.
Riepilogo delle modifiche rispetto a Claude Haiku 4.5
Ogni riga indica una modifica, se è nuova, modificata o incompatibile, e cosa deve fare il tuo codice.
| Modifica | Tipo | Azione necessaria |
|---|---|---|
| Ragionamento adattivo ed effort | Nuova | Facoltativa: imposta effort per bilanciare la qualità della risposta con velocità e costi. |
| Finestra di contesto e output più ampi | Nuova | Nessuna. I valori esistenti di max_tokens restano validi, ma i token di ragionamento vengono conteggiati al loro interno. |
| Strumento browser use | Nuova | Nessuna. Disponibile sulla Claude API e su Google Cloud. |
| I classificatori di sicurezza possono rifiutare una richiesta | Nuova | Gestisci stop_reason: "refusal" nel tuo client. Il fallback lato server non è disponibile. |
| Il ragionamento esteso manuale restituisce un errore | Incompatibile | Sostituisci budget_tokens con il ragionamento adattivo. |
| I parametri di campionamento non predefiniti restituiscono un errore | Incompatibile | Ometti temperature, top_p e top_k. |
| Il prefill dei messaggi dell'assistente restituisce un errore | Incompatibile | Termina messages con un turno dell'utente. |
| Il computer use richiede il toolset sulla Claude API e su Google Cloud | Incompatibile | Sostituisci computer_20250124 con computer_toolset_20260801. |
| La modifica dei turni precedenti invalida i blocchi di ragionamento | Incompatibile | Mantieni le conversazioni in sola aggiunta se rinvii i blocchi di ragionamento. |
| Le risposte possono iniziare con blocchi di ragionamento | Modificata | Seleziona i blocchi di contenuto in base a type, non in base alla posizione. |
| Il testo del ragionamento è omesso per impostazione predefinita | Modificata | Per ricevere il ragionamento riassunto, imposta thinking.display su "summarized". |
| Lo stesso testo corrisponde a più token | Modificata | Riconta i prompt e rivedi max_tokens e le stime dei costi. |
| Riproduzione dei blocchi di ragionamento tra account | Modificata | Se riproduci conversazioni memorizzate tramite un account diverso, riproduci ciascuna tramite l'account che l'ha prodotta. |
Nuove funzionalità
Ragionamento adattivo ed effort
Con il ragionamento adattivo, Claude Haiku 5.5 decide quando e quanto ragionare. Il ragionamento adattivo è attivo per impostazione predefinita. Sebbene tu possa ancora disattivare il ragionamento con thinking: {"type": "disabled"} con effort high o inferiore, il modo migliore per bilanciare la qualità della risposta con velocità e costi è usare il parametro effort.
Finestra di contesto e output più ampi
Claude Haiku 5.5 ha una finestra di contesto da 1M token e restituisce fino a 128k token di output, rispetto ai 200k e 64k di Claude Haiku 4.5. I valori esistenti di max_tokens restano validi, ma i token di ragionamento vengono conteggiati in max_tokens, quindi un limite ridotto può interrompere la risposta dopo un blocco thinking e prima di qualsiasi testo. Consulta Configura il ragionamento.
Modifiche di comportamento
Le risposte possono iniziare con blocchi di ragionamento
Il ragionamento adattivo è attivo per impostazione predefinita, quindi una risposta può iniziare con uno o più blocchi thinking anche quando la richiesta non menziona il ragionamento. Il codice che legge il primo blocco di contenuto come risposta deve selezionare i blocchi in base al loro campo type. Consulta Configura il ragionamento nella guida alla migrazione.
Lo stesso testo corrisponde a più token
Claude Haiku 5.5 utilizza lo stesso tokenizer più recente di Claude 4.7 e dei modelli successivi. Come per tutti i modelli che utilizzano questo tokenizer, lo stesso testo di input produce circa il 30% di token in più su Claude Haiku 5.5 rispetto a Claude Haiku 4.5. L'aumento esatto dipende dal contenuto. La struttura delle richieste e delle risposte non dipende dal tokenizer, ma tutto ciò che misuri o pianifichi in token cambia. Consulta Riconta i token nella guida alla migrazione.
Riproduzione dei blocchi di ragionamento tra account
I blocchi di ragionamento di Claude Haiku 5.5 funzionano solo nell'account che li ha prodotti o in un account collegato a esso. Questo è rilevante solo se memorizzi le conversazioni e le riproduci tramite un account diverso. Consulta Riproduci i blocchi di ragionamento tramite l'account che li ha prodotti.
Was this page helpful?