Los límites de uso de Claude Code y cómo dejar de alcanzarlos
El límite no es un fallo y tampoco va realmente de cuánto trabajas. Va de cuánto contexto carga cada turno.
Las suscripciones de Claude se miden por uso, no por mensajes. Dos personas pueden enviar el mismo número de prompts en una semana y acabar en situaciones completamente distintas, porque una envía un repositorio con cada pregunta y la otra no.
Qué cuenta el límite
A grandes rasgos, el contador corre sobre tokens procesados, ponderados por modelo. Eso significa tres cosas, y la tercera sorprende:
- Una sesión larga cuesta más por turno que una corta, porque todo el hilo se reenvía cada vez.
- Un modelo más grande cuesta más por token que uno más pequeño a igualdad de trabajo.
- Leer archivos no es gratis. Un agente que abre seis para responder a una pregunta de una línea ha gastado seis veces el valor de una pregunta de una línea.
Por eso el límite tiende a llegar la tarde de un día productivo antes que al final de una semana tranquila. Productivo aquí significa sesiones largas, y las sesiones largas son cuadráticas: cada turno paga por todos los anteriores.
Por qué siempre cae a mitad de tarea
Porque los turnos caros son los del medio. El primer turno de una sesión es barato. El vigésimo carga diecinueve turnos de hilo, más cada archivo leído por el camino, más cada salida de pruebas. Nunca te cortan mientras planificas; te cortan mientras terminas.
Los cuatro hábitos que sí ayudan
Por orden de lo que valen a lo largo de una semana:
- Una sesión nueva por tarea. Este es el grande. Nada más en esta lista se le acerca.
- Nombrar el archivo en vez de describirlo. La exploración es lo más caro que hace un agente.
- Usar el modelo pequeño para el trabajo mecánico: renombrados, formato, ediciones de un solo archivo.
- Mantener las salidas ruidosas lejos del hilo. Fíltralas antes de que lleguen.
Hacerlo sin cambiar tu forma de trabajar
Los hábitos anteriores funcionan, pero exigen disciplina en cada turno, que es exactamente el tipo de cosa que la gente deja de hacer el miércoles. La alternativa es poner un techo al contexto y dejar que se sostenga solo.
npm i -g @penra/capsulcapsul ask 'arregla la prueba de autenticación que falla' --budget 3000Conduce la CLI de Claude en la que ya has iniciado sesión. Sin clave de API, sin segunda factura.
Cuando ya lo has alcanzado
No hay forma de comprar la salida de un límite de sesión a mitad de ventana, y ninguna opción lo reinicia. Lo que sí puedes es hacer que la próxima ventana dure más que la anterior, y eso es cuestión de lo que carga cada turno, no de cuántos turnos das.
Preguntas
¿Por qué alcanzo el límite antes que un compañero con el mismo plan?
Casi siempre la longitud de las sesiones y la exploración de archivos. Una sesión larga que ha leído treinta archivos cuesta mucho más por turno que diez sesiones cortas que leen dos cada una, aun con el mismo número de prompts.
¿El límite semanal se reinicia si cambio de modelo?
No. El contador es compartido. Elegir un modelo más pequeño baja el ritmo al que lo consumes, que es otra cosa y más útil.
¿capsul necesita mi clave de API de Anthropic?
No. Conduce la CLI de Claude en la que ya has iniciado sesión, así que responde tu suscripción Pro o Max existente. Las claves de API son una opción por sesión, no un requisito.
¿Enviar menos contexto da peores respuestas?
No automáticamente, y se mide en lugar de suponerse. El banco publica las comprobaciones de respuesta junto a los recuentos de tokens en cada fila, de modo que un ahorro comprado a costa de la corrección se ve en lugar de esconderse.
$ npm i -g @penra/capsul