Claude Platform Docs
MessagesGestión de contexto

Descripción general de la compactación

Aprende qué hace la compactación, en qué se diferencian la compactación bajo demanda y la compactación en un umbral de tokens, y qué página cubre tu tarea.

La "compaction" (compactación) reemplaza los turnos más antiguos de una conversación con un resumen que Claude escribe en el servidor, por lo que no necesitas código de resumen propio. Mantiene una conversación larga o una tarea de agente dentro de la "context window" (ventana de contexto), y mantiene pequeño el contexto activo, porque la calidad de las respuestas se degrada a medida que crece una conversación.

Si quieres omitir esta descripción general, comienza con Compactación bajo demanda para agregar compactación a tu aplicación. Aunque tanto esta como Compactación en un umbral de tokens están en beta, la Compactación bajo demanda cubre más casos de uso comunes. Para borrar resultados de herramientas antiguos o bloques de pensamiento antiguos mediante reglas en lugar de resumirlos, consulta Edición de contexto.

Elige cómo compactar

Usa la compactación bajo demanda siempre que esté disponible.

Compactación bajo demandaCompactación en un umbral de tokensTu propio resumidor (Compactar en el cliente)
Quién decide cuándoTú, enviando una solicitudLa API, cuando los tokens de entrada alcanzan el disparador que configurasTú
Código que escribesUn bucle de compactación que solicita el resumen y lo sustituyeUn parámetro en tus solicitudes habitualesLa llamada de resumen, su prompt y la reescritura del historial
Qué envías de vuelta despuésEl bloque devuelto primero en messages, en lugar de los mensajes que resumeLa respuesta, añadida como de costumbre. La API descarta lo que venía antes del bloqueTu resumen, como un mensaje propio
Los turnos recientes se mantienen palabra por palabraSí: Compactación que conserva los turnos recientesSí, pausando después de la compactación y volviéndolos a insertarSí
Se ejecuta en segundo planoSí: Compactación en segundo planoNo: se ejecuta dentro de la solicitud que alcanza el umbralSí, en tu propio código
Los turnos conservados mantienen su pensamiento, en modelos con pensamiento preservadoSí, bajo las condiciones de Compactación y pensamiento preservadoNo: en Claude Fable 5.1, Claude Opus 5.5 y Claude Sonnet 5.5, elimina o descarta el pensamiento en los turnos que vuelves a insertar (consulta los ejemplos de compactación por umbral)No: ese pensamiento no supera la verificación
Encabezado beta, parámetro y plataformascompact-2026-09-04 y el parámetro de nivel superior compaction. Plataformas: consulta la lista de compatibilidad bajo demandaConsulta la lista de compatibilidad por umbral y Uso básicoNinguno. Se ejecuta en tu código
Elígela cuandoTu aplicación necesita controlar cuándo ocurre la compactación, no puede pausarse mientras se escribe un resumen, o debe conservar los turnos recientes y su pensamientoQuieres que la API gestione el contexto dentro de las solicitudes habitualesYa ejecutas tu propio resumidor y este reemplaza todo el historial con el resumen

Opciones de compactación bajo demanda

Compactación bajo demanda muestra un bucle que resume toda la conversación mientras tu aplicación espera. Las dos primeras páginas de esta lista cambian cómo se ejecuta ese bucle, y puedes combinarlas. La tercera aplica si envías bloques de pensamiento de vuelta y haces cualquiera de las dos.

Encuentra estos temas en otras páginas:

La compactación por umbral tiene su propia página: Compactación en un umbral de tokens.

Was this page helpful?