Contenido
- 1. La respuesta corta — púlsalo en un corte del trabajo, no con temporizador
- 2. La compactación funciona en tres etapas — lo que dice de verdad la documentación
- 3. Qué sobrevive y qué desaparece
- 4. El coste no lo decide el tamaño de tu contexto
- 5. /compact, /clear, /rewind y /recap — cuál elegir
- 6. Puedes mover tú mismo la ventana de la compactación automática
- 7. Tres situaciones en las que la rutina fija sale cara
- 8. En la práctica — lo que haces antes de pulsarlo importa más
- 9. Dos mensajes con los que te puedes topar
- Resumen
- FAQ
El /compact de Claude Code no es algo que se pulse con temporizador. El momento de pulsarlo es un corte en el trabajo — una tarea terminada y la siguiente a punto de empezar. La documentación oficial lo dice con todas las letras: ejecuta /compact en un corte natural del trabajo, por ejemplo entre tareas, en lugar de esperar a que la compactación automática se dispare en mitad de una tarea (documentación de Claude Code, "Prompt caching").
Reglas del tipo "lo pulso cada 30 minutos" o "lo pulso cuando el contexto pasa del 70%" apuntan al blanco equivocado. El resto del artículo explica por qué, pero la versión breve es esta: el coste y la pérdida de una compactación los decide no cuándo la pulsaste, sino qué tiraste a la basura y si la caché estaba caliente.
📌 De dónde salen estos datos: cada especificación, número de versión y nombre de ajuste que aparece más abajo se comprobó el 8 de agosto de 2026 contra la documentación de Claude Code y las notas de versión (la última en ese momento: v2.1.226, 8 de agosto de 2026). Claude Code avanza rápido y el área de compactación ha ganado comportamiento incluso en versiones recientes (/autocompact requiere v2.1.221 o posterior). Comprueba tu propia build con claude --version.
1. La respuesta corta — púlsalo en un corte del trabajo, no con temporizador
Empecemos por la tabla de decisión. Existe para que decidas por situación y no por reloj.
✅ Cuándo pulsarlo
Acabas de terminar una tarea y vas a empezar otra larga. Da igual que todavía te sobre contexto. La idea es adelantar la ejecución automática en tus propios términos para que nada te interrumpa a mitad de tarea.
🟡 Cuándo es mejor /clear
El siguiente trabajo no tiene nada que ver con el anterior. Si ni siquiera necesitas el resumen, no hay razón para pagar por generarlo. La documentación lo dice sin rodeos: si lo que quieres es empezar de cero y no continuidad, /clear es gratis.
🔵 Cuándo es mejor /rewind
Quieres tirar toda la dirección que tomaste. Rebobinar trunca hasta un punto que ya está en caché, así que sale más barato que una compactación, que tiene que construir un prefijo nuevo entero.
❌ Cuándo no pulsarlo
En mitad de una tarea. Los detalles que todavía ibas a usar quedan aplastados dentro de un resumen. Cada compactación "por si acaso" te compra el trabajo de releer los mismos archivos justo después.
Una sola pregunta separa esos cuatro casos. ¿Vas a seguir necesitando aquello que estás a punto de tirar? Tomando prestado el planteamiento de la propia documentación, la compactación ayuda cuando el contexto que descartas ya no hace falta de verdad. Una rutina fija es una forma de renunciar a ese juicio, así que unas veces acierta y otras no — y las veces que falla cuestan más de lo que ganan las que aciertan.
2. La compactación funciona en tres etapas — lo que dice de verdad la documentación
Antes de preguntarte si conviene pulsarlo a mano, necesitas conocer la maquinaria que funciona pulses o no pulses nada. Cuando el contexto empieza a llenarse, Claude Code no salta directamente a resumir la conversación. La documentación lo describe así.
"Claude Code gestiona el contexto automáticamente a medida que te acercas al límite: primero descarta las salidas de herramientas antiguas y luego, si hace falta, resume la conversación. Tus peticiones y los fragmentos de código importantes se conservan, pero las instrucciones detalladas del principio de la conversación se pueden perder. Pon las reglas permanentes en CLAUDE.md en vez de confiar en el historial de conversación." (How Claude Code works)
Es decir, hay etapas: (1) se descartan las salidas de herramientas antiguas, (2) la conversación se resume automáticamente, (3) tú pulsas /compact.
1. Descarte de salidas de herramientas
La conversación queda intacta y solo caen los resultados de herramientas antiguos. Tú no haces nada. Esta capa trabaja antes de que se llegue a resumir.
2. Compactación automática
Cuando la etapa 1 no basta, la conversación misma se sustituye por un resumen. Es exactamente el mismo procesamiento que un /compact manual; lo único que cambia es cuándo se ejecuta.
3. /compact manual
Su única función real es adelantar la etapa 2 a un momento que te venga bien. Además, puedes decirle qué conservar, la otra diferencia respecto a la etapa 2.
Aquí está el núcleo de la respuesta. Un /compact manual adelanta algo que iba a ocurrir de todos modos. No es una palanca que ahorre más contexto cuanto más veces la acciones. Vale la pena pulsarlo solo cuando elegir tú el momento vale algo.
⚠️ Una nota sobre terminología. Varios artículos llaman a la etapa 1 "microcompactación", pero a fecha de 8 de agosto de 2026 la documentación oficial no usa ese nombre. Lo que da la documentación es una descripción del comportamiento: las salidas de herramientas antiguas se descartan primero. Si buscas el término y no encuentras nada oficial, esta es la razón.
3. Qué sobrevive y qué desaparece
Lo que le pasa a tus reglas durante una compactación depende por completo de cómo se cargaron. La documentación publica una lista mecanismo por mecanismo, así que aquí la tienes, ordenada.
| Mecanismo | Tras la compactación | Qué significa en la práctica |
|---|---|---|
| System prompt y estilo de salida | Sin cambios | No forman parte del historial de conversación |
| CLAUDE.md en la raíz del proyecto y reglas sin ámbito | Se reinyectan desde disco | El sitio más seguro para poner cosas. También es donde tus ediciones acaban surtiendo efecto (ver sección 8) |
| Memoria automática | Se reinyecta desde disco | Está diseñada para persistir entre sesiones, así que sobrevivir a una compactación es lo mínimo |
Reglas que llevan paths: |
Se pierden (hasta que se vuelva a leer un archivo que encaje) | Para conservarlas, quita la clave paths: o mueve la regla al CLAUDE.md de la raíz |
| CLAUDE.md anidado en un subdirectorio | Se pierde (hasta que se vuelva a leer un archivo de ese directorio) | Igual que arriba, y la ausencia más fácil de pasar por alto |
| Cuerpo de las skills que invocaste | Se reinyecta, pero con tope | 5.000 tokens por skill y 25.000 en total, descartando primero las más antiguas |
| Hooks | No aplica | Se ejecutan como código, no como contexto |
De esa tabla salen tres conclusiones prácticas.
Primera: si cuentas con que te van a compactar, pon las reglas que no puedes permitirte perder en el CLAUDE.md de la raíz del proyecto. Es el punto que la documentación no deja de repetir. Las reglas con paths: y los CLAUDE.md anidados compran comodidad al precio de caerse en cada compactación — y nada en pantalla te avisa de que se han ido.
Segunda: lo que importa de una skill es su principio. El truncado durante la reinyección conserva el comienzo del archivo, así que las instrucciones importantes de un SKILL.md van arriba. Además, las notas oficiales sobre contexto señalan que la lista de skills cargada al inicio de la sesión no se reinyecta tras un /compact; solo se conservan las skills que llegaste a invocar.
Tercera: nada anuncia lo que se ha perdido. Que es justamente por lo que el principio se sostiene: si perder algo te va a doler, guárdalo en un archivo y no en la conversación.
4. El coste no lo decide el tamaño de tu contexto
Suponer que "cuanto más grande es el contexto, más caro sale /compact" es natural, y solo la mitad de cierto. Lo que de verdad marca el precio es si la caché de prompts está caliente. Esta es la explicación de la documentación.
"Para producir el resumen, Claude Code envía una petición aparte con el mismo system prompt, las mismas herramientas y el mismo historial, más una instrucción de resumen al final. Mientras la caché esté caliente, esa petición lee tu prefijo desde la caché, así que cuesta mucho menos de lo que sugeriría el tamaño del contexto y la mayor parte del tiempo se va en generar el resumen. [...] Tras una pausa más larga que la vida de la caché no queda caché que leer, así que la petición de resumen reprocesa todo el historial como entrada no cacheada. Por eso /compact es más caro que nunca cuando retomas una sesión antigua." (Prompt caching)
Ese único párrafo es el argumento más fuerte contra ejecutar la compactación con horario fijo.
Pulsado en plena sesión (caché caliente)
El prefijo se lee desde la caché. Lo único que notas es el tiempo que tarda en escribir el resumen. Una compactación aquí es barata.
Pulsado tras una pausa (caché fría)
Todo el historial se reprocesa antes de resumir nada. El momento más caro posible para el mismo comando. "Voy a ordenar a primera hora de la mañana" puede ser la peor jugada.
El turno justo después de pulsarlo
La caché se reconstruye a partir de un resumen corto, así que esta parte no es pesada. La impresión de que "todo va lento después de compactar" suele venir de los dos casos anteriores, no de aquí.
La vida de la caché depende de cómo te autentiques. Con una suscripción de Claude se solicita automáticamente un TTL de una hora; a través de una clave de API o de un proveedor de nube el valor por defecto son cinco minutos (ENABLE_PROMPT_CACHING_1H=1 lo sube a una hora). Lo que significa que el "vuelvo de comer y lo primero es un /compact" es casi con seguridad una ejecución en frío si trabajas con clave de API.
Que /compact sea en sí mismo una petición grande también queda subrayado en la documentación de costes: "/compact lee la conversación que está resumiendo, así que compactar un contexto grande es en sí una petición grande. Si lo que quieres es empezar de cero y no continuidad, /clear es gratis." (Manage costs effectively). Visto también desde la óptica del ahorro de tokens, hay muchos momentos en los que /clear le gana a un /compact pulsado por inercia.
5. /compact, /clear, /rewind y /recap — cuál elegir
/compact no es la única forma de aligerar el contexto. Si confundes comandos que existen para propósitos distintos, acabas pagando el caro.
| Comando | Historial de conversación | Caché | Cuándo elegirlo |
|---|---|---|---|
/compact [instrucción] |
Se sustituye por un resumen | La capa de conversación se invalida | Vas a continuar, pero ya no necesitas los detalles del historial |
/clear [nombre] |
Se vacía | Se reconstruye (sin coste alguno de resumen) | El siguiente trabajo es ajeno. Ponle nombre y /resume te lo devuelve |
/rewind |
Se trunca hasta un punto anterior | Acierta en la caché antigua | Quieres que desaparezca la dirección entera. El código puede volver atrás con ella |
/recap |
Intacto (solo muestra un resumen) | Se mantiene tal cual | Solo quieres leer "por dónde vamos" |
/context [all] |
Intacto | Se mantiene | Mide antes de pulsar nada. Una vista con código de colores de qué está ocupando sitio |
/recap merece la pena recordarlo. Mucha gente pulsa /compact porque "esta conversación se está haciendo larga, me gustaría un resumen" — y para eso no hace falta destruir el historial. Según la documentación, /recap se limita a añadir un resumen como salida del comando, de modo que el prefijo cacheado queda intacto.
La naturaleza de /rewind importa igual de mucho. La documentación explica que rebobinar te devuelve al mismo contenido que quedó cacheado en aquel punto, así que la siguiente petición acierta en la caché antigua. Cuando has tomado la dirección equivocada, la respuesta correcta es /rewind, no /compact — la compactación construye un prefijo nuevo, mientras que rebobinar solo vuelve a uno que ya existe. Los checkpoints y el rebobinado tienen su propio artículo.
6. Puedes mover tú mismo la ventana de la compactación automática
Antes de agonizar sobre si pulsarlo a mano, conviene saber que puedes mover el punto en el que se dispara la ejecución automática. Desde la v2.1.221, el comando /autocompact te deja especificar cuánto tiene que llenarse el contexto para que entre la compactación automática.
Fijar la ventana en 500K tokens (se guarda en los ajustes de usuario, así que también vale para sesiones posteriores)
/autocompact 500k
Volver al valor por defecto adecuado para el modelo
/autocompact auto
El rango aceptado va de 100K a 1M tokens. Puedes escribir un número simple como 200000, un valor con sufijo como 500k o 1M, o un número pelado entre 100 y 1000 como 200 (se lee como miles). El ajuste puede llegar desde cuatro sitios, y la precedencia es fija.
1. Variable de entorno (la más alta)
CLAUDE_CODE_AUTO_COMPACT_WINDOW. Mientras esté puesta, gana al comando, al flag y al archivo de ajustes
2. Flag de arranque
claude --autocompact 500k. Vale solo para ese arranque y no toca tus ajustes guardados
3. El comando
/autocompact. Escribe en autoCompactWindow dentro de tus ajustes de usuario
4. Archivo de ajustes
autoCompactWindow. Si tu organización tiene un ajuste gestionado por encima, gana ese
⚠️ La variable de entorno es la que tiene otro formato. La documentación dice explícitamente que CLAUDE_CODE_AUTO_COMPACT_WINDOW acepta únicamente un entero simple, y que un valor como 500k se lee como 500 y se recorta al mínimo de 100K. Escríbela como escribes el comando y habrás pedido la milésima parte de lo que querías para acabar recortado hacia arriba y compactando mucho más a menudo.
Hay un segundo aviso en el mismo sitio. El used_percentage de la línea de estado siempre se mide contra la ventana de contexto completa del modelo, así que en cuanto pones esta variable ese porcentaje deja de decirte cuándo se disparará la compactación. Aquí es exactamente donde se rompe el método de "miro el porcentaje y lo pulso a mano".
El valor por defecto, cuando no fijas ninguna ventana, también está documentado. Sin nada configurado, la compactación ocurre al alcanzar el límite de contexto del modelo, con excepciones: las sesiones en la nube compactan antes según se acercan al límite, Sonnet 4.6 y Opus 4.6 sin contexto extendido compactan en la frontera de los 200K, Opus 4.8 y Opus 5 ejecutándose con contexto de 200K en Amazon Bedrock, en Agent Platform de Google Cloud o en Microsoft Foundry se comportan igual, y Sonnet 5 se dispara en el umbral por defecto de ese modelo.
También puedes desactivar la compactación automática por completo, mediante el ajuste autoCompactEnabled (por defecto true, mostrado como "Auto-compact" en /config) o la variable de entorno DISABLE_AUTO_COMPACT. No es recomendable. Apagarla no encoge nada: el contexto choca sin más contra el techo y cambias la compactación por el error "Prompt is too long". La compactación automática es una función que te protege, no una que te estorba.
7. Tres situaciones en las que la rutina fija sale cara
Con estos detalles en la mano, queda claro dónde pierde dinero el "púlsalo cada tanto y ya está".
1. Pulsarlo a mitad de tarea
Los detalles que todavía ibas a usar quedan aplastados en el resumen. Encima se caen las reglas con paths: y los CLAUDE.md anidados, así que el trabajo inmediatamente posterior empieza a saltarse tus reglas en silencio. Es el tipo de degradación cuya causa cuesta ver.
2. Pulsarlo nada más volver de una pausa
La caché ha caducado, así que se reprocesa todo el historial antes de resumirlo. Es el momento más caro para el mismo /compact — y la buena intención de "déjame ordenar antes de empezar" cae justo ahí.
3. Pulsarlo en una sesión corta
Sin historial que merezca resumirse, lo único que obtienes es Not enough messages to compact. También pasa cuando un único pegado enorme ha llenado el contexto — y ahí la respuesta correcta es /clear, no un resumen.
Dale la vuelta y sale la regla: la compactación manual de mayor valor es la que haces justo antes de empezar un trabajo largo. Pulsarlo ahí reduce las probabilidades de que la compactación automática te interrumpa a media faena. El valor está en el momento, no en la cantidad de veces.
8. En la práctica — lo que haces antes de pulsarlo importa más
Lo que de verdad mueve la aguja con /compact no es cómo lo pulsas, sino qué dejas escrito en archivos antes de hacerlo. Como muestra la tabla de la sección 3, el CLAUDE.md de la raíz del proyecto y tu memoria automática se reinyectan desde disco. Todo lo que esté escrito ahí sobrevive a cualquier número de compactaciones.
Hay otra propiedad que se pasa por alto. Editar CLAUDE.md durante una sesión no surte efecto en ese momento. La documentación lo formula así: "las ediciones no invalidan la caché, pero tampoco surten efecto. El contenido nuevo se carga en el siguiente /clear, /compact o reinicio." Leído al revés, eso significa que /compact es también la operación que hace que las reglas decididas a mitad de sesión pasen a aplicarse de verdad.
Lista de comprobación antes de pulsarlo
- ¿Has pasado a un archivo las reglas y decisiones de esta sesión? (Lo que solo existe en la conversación se diluye en el resumen)
- ¿Le has dicho qué conservar? Puedes pasarle un foco, como en
/compact conserva el plan del arreglo de autenticación y los resultados de los tests - ¿El siguiente trabajo es realmente una continuación? Si no tiene relación,
/clearsale más barato - ¿Está caliente la caché ahora mismo? (Evita el momento justo después de una pausa larga)
- Ante la duda, ejecuta
/contexty mide qué está ocupando sitio de verdad
Y aquí está el punto que más se le escapa a quien se plantea compactar a mano. La costumbre de "lo pulso yo, por adelantado, porque me da miedo que me compacten a mis espaldas y perder el hilo" es bastante común. Pero la documentación dice esto justo después de explicar la compactación automática: para controlar qué se conserva a través de una compactación, añade una sección "Compact Instructions" a tu CLAUDE.md, o ejecuta /compact con un foco (How Claude Code works).
Dicho de otro modo, especificar un foco no es un privilegio de pulsarlo tú. Ponlo en CLAUDE.md y se aplica también a la compactación que se ejecuta mientras estás lejos del teclado. Si el objetivo de tu rutina manual preventiva es decidir cómo se recorta el contexto, esta es la versión que funciona de verdad — la rutina manual solo ayuda mientras estás mirando.
Escribirlo no tiene dificultad. El propio ejemplo de la documentación es este.
Instrucciones de compactación por defecto puestas en CLAUDE.md (ejemplo de la documentación oficial)
# Compact instructions
When you are using compact, please focus on test output and code changes
Por lo que pueda valer, así lo lleva este sitio. El CLAUDE.md del repositorio de este blog arrastra dos reglas desde hace tiempo: "sugiere /compact al usuario cuando el contexto se haga largo" y "antes de ejecutar /compact, guarda en memoria todo lo que deba convertirse en regla: feedback, decisiones de enfoque". Este mismo artículo se escribió en una sesión que pasó por una compactación. En el día a día no es la primera regla la que se gana el sueldo, es la segunda. Sacar a archivos lo que merece conservarse, antes de nada, funciona mucho mejor que esforzarse en moldear el resumen.
Una cosa más que vale la pena añadir: /compact no es la única forma de reducir contexto. La guía oficial de costes recomienda delegar en subagentes el trabajo con salida pesada: ejecutar tests, traer documentación, procesar logs. Un subagente tiene su propia ventana de contexto y devuelve solo un resumen, de modo que el contexto principal no llega a hincharse. Organizarse para no necesitar compactar es mejor que compactar bien.
9. Dos mensajes con los que te puedes topar
Hay dos mensajes que puedes encontrarte en la práctica y que no se explican solos.
| Mensaje | Qué significa | Qué hacer |
|---|---|---|
Not enough messages to compact. |
No hay conversación que merezca resumirse. También pasa cuando un único pegado enorme llenó el contexto | Empezar de cero con /clear |
Autocompact is thrashing: the context refilled to the limit... |
La compactación funcionó, pero un archivo o una salida de herramienta enormes volvieron a llenar el contexto justo después, varias veces seguidas. Se ha detenido para evitar un bucle infinito | Los cuatro pasos de la derecha (el orden recomendado por la documentación) |
La recuperación del segundo viene detallada en orden en la documentación. (1) Lee los archivos enormes por partes, por rangos de líneas o por funciones. (2) Compacta con una instrucción que nombre la salida que quieres descartar (por ejemplo /compact keep only the plan and the diff). (3) Mueve ese trabajo a un subagente para que se ejecute en una ventana de contexto aparte. (4) Si la conversación anterior ya no hace falta, /clear. Lo revelador es que el paso 1 va primero: la documentación está diciendo, en la práctica, que esto no es un problema de compactación sino de cómo lees.
Resumen
No necesitas ejecutar /compact a mano de forma periódica. La compactación automática se ejecuta lo hagas tú o no, y es el mismo procesamiento. Pulsarlo tú compra exactamente dos cosas — elegir el momento y especificar qué conservar — y ambas rinden en un solo sitio: entre tareas.
En coste, la rutina fija también pierde. El precio de una compactación lo fija si la caché está caliente, así que el "déjame ordenar antes de empezar" de después de una pausa es su versión más cara. Si te vale con empezar de cero, /clear es gratis; si estás cambiando de rumbo, /rewind sale más barato porque vuelve a una caché que ya existe; y si solo quieres leer un resumen, /recap deja el historial en paz. Elegir bien entre los cuatro rinde más que pulsar el mismo más veces.
La conclusión más práctica, sin embargo, queda fuera de la cuestión de cómo pulsarlo. Lo que no puedas permitirte perder va en un archivo, no en la conversación. El CLAUDE.md de la raíz del proyecto y tu memoria automática se reinyectan desde disco, mientras que las reglas con paths: y los CLAUDE.md anidados se caen en silencio. Conocer esa asimetría es lo que separa una sesión larga que aguanta de otra que se degrada sin avisar.
FAQ
Q1. Entonces, ¿cada cuántos minutos debería pulsar /compact?
No debería decidirse por tiempo en absoluto. El único momento recomendado es justo después de terminar una tarea y antes de empezar la siguiente larga. La documentación habla de "un corte natural del trabajo, por ejemplo entre tareas" y no da ningún umbral de tiempo ni de porcentaje.
Q2. ¿Pasa algo por dejarlo todo en manos de la compactación automática?
La automática y la manual son el mismo procesamiento; solo cambia el momento. La pega es que la automática puede interrumpirte a mitad de tarea. Pulsarlo una vez a mano antes de un tramo largo de trabajo reduce las probabilidades de esa interrupción. Y a la automática también puedes darle instrucciones: escríbelas en CLAUDE.md bajo un encabezado # Compact instructions y se aplican a la compactación que se ejecute mientras estás lejos del teclado (ver sección 8).
Q2-2. Después de que compactara por su cuenta, mis instrucciones parecen no calar
No te lo estás imaginando. La documentación afirma que "las instrucciones detalladas del principio de la conversación se pueden perder". Además, las reglas con paths: y los CLAUDE.md anidados se caen hasta que se vuelve a leer un archivo que encaje, y las skills invocadas se descartan de la más antigua a la más nueva en cuanto superan los 25.000 tokens en total. Más que desaparecer contenido, lo que ocurre es que las reglas que se estaban siguiendo se adelgazan en silencio, así que el trabajo continúa y lo único que cae es la precisión. Tres contramedidas: (1) mueve al CLAUDE.md de la raíz las reglas que quieras que persistan, ahí se reinyectan; (2) nombra qué conservar con # Compact instructions; (3) usa /autocompact para que se dispare antes y la compactación no ocurra pegada al techo.
Q3. ¿Debería usar /compact o /clear?
/compact si el siguiente trabajo continúa el anterior, /clear si no. La documentación de costes afirma sin rodeos que "si lo que quieres es empezar de cero y no continuidad, /clear es gratis". Pásale un nombre a /clear y podrás volver a esa sesión desde la lista de /resume, así que no hay nada que temer perder.
Q4. ¿La compactación borra mis reglas de CLAUDE.md?
El CLAUDE.md de la raíz del proyecto no se borra: se reinyecta desde disco. Lo que sí se va son las reglas con front matter paths: y los CLAUDE.md anidados en subdirectorios, que no vuelven hasta que se lee de nuevo un archivo que encaje. Para las reglas que quieras que persistan, quita la clave paths: o muévelas al CLAUDE.md de la raíz.
Q5. ¿Puedo desactivar la compactación automática?
Puedes (con el ajuste autoCompactEnabled en false, con "Auto-compact" en /config o con la variable de entorno DISABLE_AUTO_COMPACT). No es recomendable. Apagarla no reduce tu contexto: simplemente chocas contra el techo y obtienes un error. Si lo que quieres es que se ejecute antes, la jugada correcta no es desactivarla sino estrechar la ventana con /autocompact.
Q6. ¿Cuántos tokens consume /compact?
Varía enormemente según si la caché está caliente. Púlsalo en plena sesión y el prefijo se lee desde la caché, costando, en palabras de la documentación, mucho menos de lo que sugiere el tamaño del contexto. Púlsalo tras una pausa más larga que la vida de la caché y todo el historial se reprocesa sin cachear, con lo que el mismo comando sale lo más caro que puede llegar a salir. La vida de la caché es de una hora con suscripción y de cinco minutos por defecto a través de una clave de API o de un proveedor de nube.
Q7. ¿Puedo especificar qué se conserva?
Sí. Escribe una instrucción después de /compact y el resumen se produce con ese foco (por ejemplo /compact conserva el plan del arreglo de autenticación y los resultados de los tests). Si te sirve la misma instrucción siempre, crea un encabezado # Compact instructions en CLAUDE.md y se aplicará como valor por defecto.
Q8. ¿Por qué las respuestas van lentas justo después de una compactación?
El turno inmediatamente posterior a una compactación no es pesado. Según la documentación, ese turno reconstruye la caché a partir de un resumen corto, así que no es la parte lenta. Lo que notas suele ser la propia ejecución de la compactación, mientras se genera el resumen, o un caso en el que lo pulsaste con la caché ya fría.
Q9. ¿Existe una función llamada "microcompactación"?
El comportamiento existe: la documentación explica que primero se descartan las salidas de herramientas antiguas y que la conversación se resume solo si hace falta, lo que es una afirmación explícita de que algo ocurre antes de resumir. Pero a fecha de 8 de agosto de 2026 la documentación oficial no usa el nombre "microcompactación". El término viene de artículos de terceros, no de Anthropic, así que trátalo en consecuencia.
Artículos relacionados
- Error "Prompt is too long" de Claude Code — cómo arreglar un contexto que ha chocado con el techo
- Qué es una ventana de contexto — cuánto mide la ventana y por qué más grande no es automáticamente mejor
- Ahorro de tokens en Claude Code — qué funciona además de la compactación
- Checkpoints y rebobinado — para un cambio de rumbo,
/rewindle gana a/compact