Descripción general de la compactación
Aprende qué hace la compactación, en qué se diferencian la compactación bajo demanda y la compactación en un umbral de tokens, y qué página cubre tu tarea.
La "compaction" (compactación) reemplaza los turnos más antiguos de una conversación con un resumen que Claude escribe en el servidor, por lo que no necesitas código de resumen propio. Mantiene una conversación larga o una tarea de agente dentro de la "context window" (ventana de contexto), y mantiene pequeño el contexto activo, porque la calidad de las respuestas se degrada a medida que crece una conversación.
Si quieres omitir esta descripción general, comienza con Compactación bajo demanda para agregar compactación a tu aplicación. Aunque tanto esta como Compactación en un umbral de tokens están en beta, la Compactación bajo demanda cubre más casos de uso comunes. Para borrar resultados de herramientas antiguos o bloques de pensamiento antiguos mediante reglas en lugar de resumirlos, consulta Edición de contexto.
Elige cómo compactar
Usa la compactación bajo demanda siempre que esté disponible.
| Compactación bajo demanda | Compactación en un umbral de tokens | Tu propio resumidor (Compactar en el cliente) | |
|---|---|---|---|
| Quién decide cuándo | Tú, enviando una solicitud | La API, cuando los tokens de entrada alcanzan el disparador que configuras | Tú |
| Código que escribes | Un bucle de compactación que solicita el resumen y lo sustituye | Un parámetro en tus solicitudes habituales | La llamada de resumen, su prompt y la reescritura del historial |
| Qué envías de vuelta después | El bloque devuelto primero en messages, en lugar de los mensajes que resume | La respuesta, añadida como de costumbre. La API descarta lo que venía antes del bloque | Tu resumen, como un mensaje propio |
| Los turnos recientes se mantienen palabra por palabra | Sí: Compactación que conserva los turnos recientes | Sí, pausando después de la compactación y volviéndolos a insertar | Sí |
| Se ejecuta en segundo plano | Sí: Compactación en segundo plano | No: se ejecuta dentro de la solicitud que alcanza el umbral | Sí, en tu propio código |
| Los turnos conservados mantienen su pensamiento, en modelos con pensamiento preservado | Sí, bajo las condiciones de Compactación y pensamiento preservado | No: en Claude Fable 5.1, Claude Opus 5.5 y Claude Sonnet 5.5, elimina o descarta el pensamiento en los turnos que vuelves a insertar (consulta los ejemplos de compactación por umbral) | No: ese pensamiento no supera la verificación |
| Encabezado beta, parámetro y plataformas | compact-2026-09-04 y el parámetro de nivel superior compaction. Plataformas: consulta la lista de compatibilidad bajo demanda | Consulta la lista de compatibilidad por umbral y Uso básico | Ninguno. Se ejecuta en tu código |
| Elígela cuando | Tu aplicación necesita controlar cuándo ocurre la compactación, no puede pausarse mientras se escribe un resumen, o debe conservar los turnos recientes y su pensamiento | Quieres que la API gestione el contexto dentro de las solicitudes habituales | Ya ejecutas tu propio resumidor y este reemplaza todo el historial con el resumen |
Opciones de compactación bajo demanda
Compactación bajo demanda muestra un bucle que resume toda la conversación mientras tu aplicación espera. Las dos primeras páginas de esta lista cambian cómo se ejecuta ese bucle, y puedes combinarlas. La tercera aplica si envías bloques de pensamiento de vuelta y haces cualquiera de las dos.
- Compactación que conserva los turnos recientes: cuando los últimos turnos deben llegar a Claude palabra por palabra. El resumen cubre solo los turnos más antiguos.
- Compactación en segundo plano: cuando la conversación no puede pausarse para el resumen. La solicitud se ejecuta mientras el trabajo continúa, y sustituyes el bloque cuando llega.
- Compactación y pensamiento preservado: si envías bloques de pensamiento de vuelta en un modelo con pensamiento preservado y conservas los turnos recientes o compactas en segundo plano. De lo contrario, omítela.
- Escribir tu propio prompt de resumen: cuando el resumen predeterminado omite algo que un turno posterior necesita. Tu prompt reemplaza al predeterminado.
- Compactar de nuevo: cuando una conversación que ya comienza con un bloque de compactación vuelve a crecer.
Encuentra estos temas en otras páginas:
- Solicitar un resumen está en Compactación bajo demanda.
- Continuar a partir del resumen está en Compactación bajo demanda. Las condiciones que mantienen válido el pensamiento en los turnos que conservas están en Compactación y pensamiento preservado.
- Cuando no se devuelve ningún resumen: consulta Manejar un resumen faltante o un error en Compactación bajo demanda.
- Cómo encaja con el resto de la API: consulta Límites e interacciones con otras funciones en Compactación bajo demanda.
- Comprender el uso: consulta Contar el uso de la compactación para la compactación bajo demanda, o Comprender el uso para la compactación por umbral.
- Compatibilidad: cada tipo tiene su propio encabezado beta, por lo que cada página tiene su propia lista. Consulta la lista de compatibilidad bajo demanda o la lista de compatibilidad por umbral.
La compactación por umbral tiene su propia página: Compactación en un umbral de tokens.
Was this page helpful?