Claude Code: cuándo usar /compact y cuándo /clear

`/clear` comienza con un contexto vacío y no cuesta tokens. `/compact` conserva un resumen del historial, pero escribir ese resumen exige otra petición que lee la conversación acumulada.

/clear abre una conversación nueva sin historial. /compact mantiene la sesión y sustituye el historial por un resumen. La regla es sencilla: usa /clear para una tarea distinta y /compact si sigues en la misma tarea y necesitas recordar el camino recorrido.

Ambos comandos responden al mismo problema: una sesión larga de Claude Code encarece cada turno y puede empeorar las respuestas. Lo hacen de forma diferente y su coste tampoco es el mismo.

Qué cambia cada comando en el contexto

/clear termina la conversación y abre otra con el historial vacío. La memoria del proyecto está fuera de ese historial: CLAUDE.md y la memoria automática vuelven a cargarse al iniciar la conversación nueva.

La conversación anterior no se borra. /resume permite recuperarla; /clear release-prep le pone un nombre en el selector de sesiones. /reset y /new son alias.

/clear

Abre una conversación sin historial; la anterior sigue disponible mediante /resume.

/compact reemplaza el historial por un resumen estructurado y continúa en la misma sesión. Según la documentación de Claude Code, conserva tus peticiones, conceptos técnicos, archivos vistos o modificados con fragmentos importantes, errores, soluciones y trabajo pendiente. Desaparecen las salidas completas de herramientas y el razonamiento intermedio; las instrucciones dadas solo en el chat pueden perderse.

Algunos elementos se reconstruyen: se releen CLAUDE.md de la raíz y memoria automática, regresan hasta cinco archivos leídos o editados, empezando por los modificados más recientemente, y las skills invocadas se vuelven a insertar hasta un límite. Las reglas por ruta y los CLAUDE.md de subdirectorios quedan resumidos hasta que Claude vuelve a leer un archivo al que se aplican.

/compact focus on the auth bug fix

La indicación de enfoque especifica qué debe conservar el resumen.

Si siempre quieres conservar ciertos datos, añade una sección # Compact instructions a CLAUDE.md, por ejemplo para pedir la lista de archivos modificados y los comandos de pruebas.

Por qué cada turno de una sesión larga cuesta más

El modelo no recuerda las peticiones anteriores. Claude Code reenvía el prompt de sistema, el contexto del proyecto, cada mensaje y resultado de herramienta, y tu mensaje nuevo. Cada llamada a herramienta provoca otra petición con el historial completo. Una pregunta breve al final de una sesión larga lleva detrás todo lo anterior.

La caché de prompts reduce el precio de la parte repetida, sin eliminarla. A septiembre de 2026, las lecturas cuestan una décima parte o menos de la entrada normal en los modelos Claude actuales. Esa fracción de un contexto creciente sigue consumiendo recursos y cuenta para los límites de uso de una suscripción.

La caché vence. A septiembre de 2026, dura una hora en la conversación principal de una suscripción y cinco minutos por defecto con clave de API. Tras una pausa mayor, la siguiente petición reprocesa el historial completo.

También se degrada la calidad. La guía de buenas prácticas de Claude Code advierte que, al llenarse la ventana, Claude puede olvidar instrucciones anteriores o cometer más errores. Un historial lleno de intentos fallidos agrava esa degradación.

El coste real de /compact y /clear

/clear no tiene coste de compactación. La primera petición posterior sí envía la parte fija del contexto, como prompt de sistema, herramientas, CLAUDE.md y memoria, además de tu nuevo mensaje.

/compact hace una petición al modelo. Envía el prompt de sistema, herramientas e historial de la sesión junto a una instrucción para resumir. La entrada contiene todo lo acumulado; la salida es el resumen, y los tokens de salida son los más caros.

El momento importa. Mientras la caché está activa, la petición de resumen lee el historial a tarifa reducida. Tras una pausa superior a su duración, todo se procesa sin caché; compactar una sesión recién retomada es el caso más caro.

Se compensa con peticiones posteriores más cortas, que llevan el resumen en lugar del historial. Merece la pena si aún quedan muchos turnos y el resumen puede descartar material innecesario. Si solo quieres eliminar un desvío, /rewind vuelve a un punto anterior sin crear resumen.

Cuándo se activa la compactación automática

Está activada por defecto. Al acercarse al límite, Claude Code elimina primero salidas antiguas de herramientas y, si no basta, resume la conversación. Permite continuar cuando se llena la ventana, pero no hace baratos los turnos que ya se enviaron.

Normalmente llega tarde. A septiembre de 2026, la documentación indica que se compacta al alcanzar el límite del modelo, o alrededor de 967.000 tokens en modelos con una ventana de un millón en la API de Anthropic. El umbral exacto depende del modelo, proveedor y ajustes. Para entonces los turnos anteriores ya pagaron el historial creciente y el resumen lee una ventana casi llena.

Puedes adelantarla con /autocompact 500k y restaurar el valor del modelo con /autocompact auto, desde Claude Code v2.1.221. El ajuste Auto-compact de /config desactiva el proceso automático, pero deja disponible /compact.

Cómo comprobar el espacio disponible

/context muestra la ocupación de la ventana por categorías, incluidos los archivos CLAUDE.md y de memoria cargados, y señala elementos que ocupan demasiado. Consúltalo antes de decidir.

/context

Muestra qué ocupa la ventana de contexto ahora mismo.

Para seguir el porcentaje continuamente, /statusline permite configurar una línea de estado y un script puede leer context_window.used_percentage. /usage muestra otra medida: el consumo de la sesión y la situación frente a los límites del plan.

Cuál conviene usar

  • La tarea siguiente no tiene relación: /clear. El historial anterior quita espacio y se paga en cada petición.
  • Es la misma tarea y el historial todavía importa: /compact con enfoque, en una pausa natural entre pasos.
  • Solo sobra una parte: /rewind. Vuelve a un mensaje anterior y restaura la conversación conservando el código, o resume hasta ese punto y conserva los mensajes recientes.
  • Has intentado dos correcciones del mismo problema: /clear y plantea de nuevo la tarea con lo aprendido.
  • Solo necesitas resolver una duda lateral: /btw responde sin incorporar la respuesta al historial.
  • Si dudas, /clear cuesta menos. La sesión anterior se recupera con /resume.

Una sesión por tarea evita ambas reparaciones

Lo más barato suele ser empezar una conversación por tarea y cerrarla cuando acaba. Así no hay que reparar un historial enorme al cambiar de asunto.

Lo que debe sobrevivir a la conversación pertenece a un archivo: reglas en CLAUDE.md y el estado de un trabajo largo en unas notas que Claude escriba antes de limpiar. Redactarlas cuesta un turno, pero tú eliges qué conservar y el archivo persiste.

capsul usa la sesión de Claude Code en la que ya has iniciado sesión y trata cada capsul ask como una tarea bajo el presupuesto de tokens que fijas. Envía lo que pide el trabajo, no el repositorio, y avisa de lo que dejó fuera al llegar al límite.

capsul ask 'fix the flaky checkout test' --budget 3000

Una tarea por comando con el límite de tokens que elijas.

Preguntas

¿Uso /compact o /clear en Claude Code?

Usa /clear cuando empieza una tarea sin relación: deja el contexto limpio, no tiene coste de resumen y la conversación anterior sigue disponible con /resume. Usa /compact a mitad de una tarea cuyo historial importa, preferiblemente en una pausa y con indicaciones de enfoque. Si dudas, /clear cuesta menos.

¿/compact consume tokens?

Sí. Claude Code envía otra petición con toda la conversación para escribir el resumen, que vuelve como tokens de salida. Con la caché activa gran parte de la entrada cuesta menos; tras una pausa larga se reprocesa el historial sin caché. Los turnos posteriores ahorran porque llevan el resumen.

¿Cuándo compacta Claude Code automáticamente?

Al acercarse al límite de la ventana, con la compactación automática activada por defecto. A septiembre de 2026, la documentación menciona unos 967.000 tokens para modelos de ventana de un millón en la API de Anthropic. /autocompact ajusta el umbral y Auto-compact en /config desactiva el proceso automático.

¿/clear borra CLAUDE.md o la conversación anterior?

No. Vacía el historial de la conversación, pero vuelve a cargar CLAUDE.md y la memoria automática. La conversación previa queda guardada y se abre con /resume. Puedes ponerle nombre con un argumento de /clear para identificarla en el selector.

¿Cómo veo cuánto se ha llenado la ventana de Claude Code?

Ejecuta /context: muestra la ocupación por categorías y señala componentes grandes. Para una lectura continua, configura una línea de estado con context_window.used_percentage mediante /statusline. /usage indica el consumo de la sesión y los límites del plan, que son medidas distintas.

$ npm i -g @penra/capsul

← Todas las guías