Vue d'ensemble de la compaction
Découvrez ce que fait la compaction, en quoi la compaction à la demande et la compaction à un seuil de tokens diffèrent, et quelle page couvre votre tâche.
La compaction remplace les anciens tours d'une conversation par un résumé que Claude rédige sur le serveur, de sorte que vous n'avez besoin d'aucun code de résumé de votre part. Elle maintient une longue conversation ou une tâche d'agent à l'intérieur de la fenêtre de contexte, et elle maintient le contexte actif réduit, car la qualité des réponses se dégrade à mesure qu'une conversation s'allonge.
Si vous souhaitez passer directement à l'action sans lire cette vue d'ensemble, commencez par Compaction à la demande pour ajouter la compaction à votre application. Bien que cette fonctionnalité et Compaction à un seuil de tokens soient toutes deux en version bêta, la compaction à la demande couvre davantage de cas d'usage courants. Pour effacer les anciens résultats d'outils ou les anciens blocs de réflexion selon une règle plutôt que de les résumer, consultez Édition du contexte.
Choisir comment compacter
Utilisez la compaction à la demande partout où elle est disponible.
| Compaction à la demande | Compaction à un seuil de tokens | Votre propre outil de résumé (Compacter côté client) | |
|---|---|---|---|
| Qui décide du moment | Vous, en envoyant une requête | L'API, lorsque les tokens d'entrée atteignent le déclencheur que vous avez défini | Vous |
| Code que vous écrivez | Une boucle de compaction qui demande le résumé et le substitue | Un paramètre sur vos requêtes habituelles | L'appel de résumé, son prompt, et la réécriture de l'historique |
| Ce que vous renvoyez ensuite | Le bloc renvoyé, placé en premier dans messages à la place des messages qu'il résume | La réponse, ajoutée comme d'habitude. L'API supprime ce qui précédait le bloc | Votre résumé, sous forme de message de votre part |
| Les tours récents restent mot pour mot | Oui : Compaction qui conserve les tours récents | Oui, en mettant en pause après la compaction et en les réinsérant | Oui |
| S'exécute en arrière-plan | Oui : Compaction en arrière-plan | Non : elle s'exécute à l'intérieur de la requête qui atteint le seuil | Oui, dans votre propre code |
| Les tours conservés gardent leur réflexion, sur les modèles avec réflexion préservée | Oui, dans les conditions décrites dans Compaction et réflexion préservée | Non : sur Claude Fable 5.1 et Claude Opus 5.5, supprimez ou retirez la réflexion dans les tours que vous réinsérez (voir les exemples de compaction par seuil) | Non : cette réflexion échoue à la vérification |
| En-tête bêta, paramètre et plateformes | compact-2026-09-04 et le paramètre de premier niveau compaction. Plateformes : voir la liste de compatibilité de la compaction à la demande | Voir la liste de compatibilité de la compaction par seuil et Utilisation de base | Aucun. Cela s'exécute dans votre code |
| Choisissez cette option quand | Votre application doit contrôler le moment où la compaction se produit, ne peut pas se mettre en pause pendant la rédaction d'un résumé, ou doit conserver les tours récents et leur réflexion | Vous souhaitez que l'API gère le contexte à l'intérieur des requêtes habituelles | Vous exécutez déjà votre propre outil de résumé et il remplace tout l'historique par le résumé |
Options de compaction à la demande
Compaction à la demande présente une boucle qui résume l'ensemble de la conversation pendant que votre application attend. Les deux premières pages de cette liste modifient la façon dont cette boucle s'exécute, et vous pouvez les combiner. La troisième s'applique si vous renvoyez des blocs de réflexion et que vous effectuez l'une ou l'autre des deux précédentes.
- Compaction qui conserve les tours récents : lorsque les derniers tours doivent parvenir à Claude mot pour mot. Le résumé ne couvre que les tours les plus anciens.
- Compaction en arrière-plan : lorsque la conversation ne peut pas se mettre en pause pour le résumé. La requête s'exécute pendant que le travail se poursuit, et vous substituez le bloc dès qu'il arrive.
- Compaction et réflexion préservée : si vous renvoyez des blocs de réflexion sur un modèle avec réflexion préservée et que vous conservez les tours récents ou compactez en arrière-plan. Sinon, ignorez cette page.
- Rédiger votre propre prompt de résumé : lorsque le résumé par défaut omet quelque chose dont un tour ultérieur a besoin. Votre prompt remplace celui par défaut.
- Compacter à nouveau : lorsqu'une conversation qui commence déjà par un bloc de compaction redevient longue.
Retrouvez ces sujets sur d'autres pages :
- Demander un résumé se trouve sur la page Compaction à la demande.
- Poursuivre à partir du résumé se trouve sur la page Compaction à la demande. Les conditions qui maintiennent la validité de la réflexion dans les tours que vous conservez se trouvent sur Compaction et réflexion préservée.
- Lorsqu'aucun résumé ne revient : consultez Gérer un résumé manquant ou une erreur sur la page Compaction à la demande.
- Comment cela s'intègre avec le reste de l'API : consultez Limites et interactions avec d'autres fonctionnalités sur la page Compaction à la demande.
- Comprendre l'utilisation : consultez Comptabiliser l'utilisation de la compaction pour la compaction à la demande, ou Comprendre l'utilisation pour la compaction par seuil.
- Compatibilité : chaque type possède son propre en-tête bêta, donc chaque page possède sa propre liste. Consultez la liste de compatibilité de la compaction à la demande ou la liste de compatibilité de la compaction par seuil.
La compaction par seuil possède sa propre page : Compaction à un seuil de tokens.
Was this page helpful?