Claude Platform Docs
MessagesGestion du contexte

Vue d'ensemble de la compaction

Découvrez ce que fait la compaction, en quoi la compaction à la demande et la compaction à un seuil de tokens diffèrent, et quelle page couvre votre tâche.

La compaction remplace les anciens tours d'une conversation par un résumé que Claude rédige sur le serveur, de sorte que vous n'avez besoin d'aucun code de résumé de votre part. Elle maintient une longue conversation ou une tâche d'agent à l'intérieur de la fenêtre de contexte, et elle maintient le contexte actif réduit, car la qualité des réponses se dégrade à mesure qu'une conversation s'allonge.

Si vous souhaitez passer directement à l'action sans lire cette vue d'ensemble, commencez par Compaction à la demande pour ajouter la compaction à votre application. Bien que cette fonctionnalité et Compaction à un seuil de tokens soient toutes deux en version bêta, la compaction à la demande couvre davantage de cas d'usage courants. Pour effacer les anciens résultats d'outils ou les anciens blocs de réflexion selon une règle plutôt que de les résumer, consultez Édition du contexte.

Choisir comment compacter

Utilisez la compaction à la demande partout où elle est disponible.

Compaction à la demandeCompaction à un seuil de tokensVotre propre outil de résumé (Compacter côté client)
Qui décide du momentVous, en envoyant une requêteL'API, lorsque les tokens d'entrée atteignent le déclencheur que vous avez définiVous
Code que vous écrivezUne boucle de compaction qui demande le résumé et le substitueUn paramètre sur vos requêtes habituellesL'appel de résumé, son prompt, et la réécriture de l'historique
Ce que vous renvoyez ensuiteLe bloc renvoyé, placé en premier dans messages à la place des messages qu'il résumeLa réponse, ajoutée comme d'habitude. L'API supprime ce qui précédait le blocVotre résumé, sous forme de message de votre part
Les tours récents restent mot pour motOui : Compaction qui conserve les tours récentsOui, en mettant en pause après la compaction et en les réinsérantOui
S'exécute en arrière-planOui : Compaction en arrière-planNon : elle s'exécute à l'intérieur de la requête qui atteint le seuilOui, dans votre propre code
Les tours conservés gardent leur réflexion, sur les modèles avec réflexion préservéeOui, dans les conditions décrites dans Compaction et réflexion préservéeNon : sur Claude Fable 5.1 et Claude Opus 5.5, supprimez ou retirez la réflexion dans les tours que vous réinsérez (voir les exemples de compaction par seuil)Non : cette réflexion échoue à la vérification
En-tête bêta, paramètre et plateformescompact-2026-09-04 et le paramètre de premier niveau compaction. Plateformes : voir la liste de compatibilité de la compaction à la demandeVoir la liste de compatibilité de la compaction par seuil et Utilisation de baseAucun. Cela s'exécute dans votre code
Choisissez cette option quandVotre application doit contrôler le moment où la compaction se produit, ne peut pas se mettre en pause pendant la rédaction d'un résumé, ou doit conserver les tours récents et leur réflexionVous souhaitez que l'API gère le contexte à l'intérieur des requêtes habituellesVous exécutez déjà votre propre outil de résumé et il remplace tout l'historique par le résumé

Options de compaction à la demande

Compaction à la demande présente une boucle qui résume l'ensemble de la conversation pendant que votre application attend. Les deux premières pages de cette liste modifient la façon dont cette boucle s'exécute, et vous pouvez les combiner. La troisième s'applique si vous renvoyez des blocs de réflexion et que vous effectuez l'une ou l'autre des deux précédentes.

  • Compaction qui conserve les tours récents : lorsque les derniers tours doivent parvenir à Claude mot pour mot. Le résumé ne couvre que les tours les plus anciens.
  • Compaction en arrière-plan : lorsque la conversation ne peut pas se mettre en pause pour le résumé. La requête s'exécute pendant que le travail se poursuit, et vous substituez le bloc dès qu'il arrive.
  • Compaction et réflexion préservée : si vous renvoyez des blocs de réflexion sur un modèle avec réflexion préservée et que vous conservez les tours récents ou compactez en arrière-plan. Sinon, ignorez cette page.
  • Rédiger votre propre prompt de résumé : lorsque le résumé par défaut omet quelque chose dont un tour ultérieur a besoin. Votre prompt remplace celui par défaut.
  • Compacter à nouveau : lorsqu'une conversation qui commence déjà par un bloc de compaction redevient longue.

Retrouvez ces sujets sur d'autres pages :

La compaction par seuil possède sa propre page : Compaction à un seuil de tokens.

Was this page helpful?