Panoramica della compattazione
Scopri cosa fa la compattazione, come differiscono la compattazione su richiesta e la compattazione a una soglia di token, e quale pagina copre il tuo compito.
La "compaction" (compattazione) sostituisce i turni più vecchi di una conversazione con un riepilogo che Claude scrive sul server, così non hai bisogno di alcun codice di riepilogo tuo. Mantiene una conversazione lunga o un'attività agentica all'interno della "context window" (finestra di contesto) e mantiene piccolo il contesto attivo, perché la qualità delle risposte peggiora man mano che una conversazione cresce.
Se vuoi saltare questa panoramica, inizia con Compattazione su richiesta per aggiungere la compattazione alla tua applicazione. Sebbene sia questa sia Compattazione a una soglia di token siano in beta, la compattazione su richiesta copre più casi d'uso comuni. Per rimuovere vecchi risultati degli strumenti o vecchi blocchi di ragionamento in base a una regola invece di riepilogarli, consulta Modifica del contesto.
Scegli come compattare
Usa la compattazione su richiesta ovunque sia disponibile.
| Compattazione su richiesta | Compattazione a una soglia di token | Il tuo sistema di riepilogo (Compattazione sul client) | |
|---|---|---|---|
| Chi decide quando | Tu, inviando una richiesta | L'API, quando i token di input raggiungono il trigger che imposti | Tu |
| Codice da scrivere | Un ciclo di compattazione che richiede il riepilogo e lo inserisce al posto dei messaggi | Un parametro nelle tue normali richieste | La chiamata di riepilogo, il relativo prompt e la riscrittura della cronologia |
| Cosa rinvii in seguito | Il blocco restituito, per primo in messages, al posto dei messaggi che riassume | La risposta, aggiunta come di consueto. L'API scarta ciò che precede il blocco | Il tuo riepilogo, come un tuo messaggio |
| I turni recenti restano parola per parola | Sì: Compattazione che mantiene i turni recenti | Sì, mettendo in pausa dopo la compattazione e reinserendoli | Sì |
| Viene eseguita in background | Sì: Compattazione in background | No: viene eseguita all'interno della richiesta che raggiunge la soglia | Sì, nel tuo codice |
| I turni mantenuti conservano il loro ragionamento, sui modelli con "preserved thinking" (ragionamento preservato) | Sì, alle condizioni descritte in Compattazione e ragionamento preservato | No: su Claude Fable 5.1, Claude Opus 5.5 e Claude Sonnet 5.5, rimuovi o scarta il ragionamento nei turni che reinserisci (consulta gli esempi di compattazione a soglia) | No: quel ragionamento non supera il controllo |
| Header beta, parametro e piattaforme | compact-2026-09-04 e il parametro di primo livello compaction. Piattaforme: consulta l'elenco di compatibilità della compattazione su richiesta | Consulta l'elenco di compatibilità della compattazione a soglia e Utilizzo di base | Nessuno. Viene eseguito nel tuo codice |
| Quando sceglierla | La tua applicazione deve controllare quando avviene la compattazione, non può mettersi in pausa mentre viene scritto un riepilogo, oppure deve mantenere i turni recenti e il loro ragionamento | Vuoi che l'API gestisca il contesto all'interno delle normali richieste | Usi già un tuo sistema di riepilogo, che sostituisce l'intera cronologia con il riepilogo |
Opzioni di compattazione su richiesta
Compattazione su richiesta mostra un ciclo che riepiloga l'intera conversazione mentre la tua applicazione attende. Le prime due pagine in questo elenco cambiano il modo in cui quel ciclo viene eseguito, e puoi combinarle. La terza si applica se rimandi indietro i blocchi di ragionamento e fai una delle due cose.
- Compattazione che mantiene i turni recenti: quando gli ultimi turni devono raggiungere Claude parola per parola. Il riepilogo copre solo i turni più vecchi.
- Compattazione in background: quando la conversazione non può mettersi in pausa per il riepilogo. La richiesta viene eseguita mentre il lavoro continua, e sostituisci il blocco quando arriva.
- Compattazione e ragionamento preservato: se rimandi indietro i blocchi di ragionamento su un modello con ragionamento preservato e mantieni i turni recenti o compatti in background. Altrimenti saltala.
- Scrivi il tuo prompt di riepilogo: quando il riepilogo predefinito elimina qualcosa di cui un turno successivo ha bisogno. Il tuo prompt sostituisce quello predefinito.
- Compatta di nuovo: quando una conversazione che inizia già con un blocco di compattazione torna a diventare lunga.
Trova questi argomenti su altre pagine:
- Richiedi un riepilogo si trova in Compattazione su richiesta.
- Continua dal riepilogo si trova in Compattazione su richiesta. Le condizioni che mantengono valido il ragionamento nei turni che conservi sono descritte in Compattazione e ragionamento preservato.
- Quando non torna alcun riepilogo: consulta Gestisci un riepilogo mancante o un errore in Compattazione su richiesta.
- Come si integra con il resto dell'API: consulta Limiti e interazioni con altre funzionalità in Compattazione su richiesta.
- Comprendere l'utilizzo: consulta Conteggia l'utilizzo della compattazione per la compattazione su richiesta, o Comprendere l'utilizzo per la compattazione a soglia.
- Compatibilità: ogni tipo ha il proprio header beta, quindi ogni pagina ha il proprio elenco. Consulta l'elenco di compatibilità su richiesta o l'elenco di compatibilità a soglia.
La compattazione a soglia ha una pagina dedicata: Compattazione a una soglia di token.
Was this page helpful?