$ glosario de capsul

Glosario

Las palabras que deciden el coste de un agente de código, definidas en una frase cada una y luego explicadas.

Token
Un token es la unidad que un modelo de lenguaje lee y factura: una palabra común, un fragmento de palabra o un signo de puntuación, unos tres o cuatro caracteres de media.
Ventana de contexto
La ventana de contexto es el número máximo de tokens que un modelo puede considerar a la vez, incluidas las instrucciones, la conversación y todo lo que acompaña a la pregunta.
Tokens de entrada y de salida
Los tokens de entrada son todo lo que se envía al modelo en una petición; los de salida son lo que escribe de vuelta, y en el trabajo con agentes la entrada domina la factura por un orden de magnitud o más.
Presupuesto de tokens
Un presupuesto de tokens es un techo duro sobre cuánto contexto puede entrar en una petición, aplicado antes de enviarla en vez de negociado con el modelo.
Caché de prompts
La caché de prompts permite a un proveedor reutilizar la forma ya procesada de un prefijo repetido entre peticiones, facturando esos tokens a una fracción de la tarifa nueva.
Tasa de acierto de caché
La tasa de acierto de caché es la proporción de tokens de entrada de una petición servidos desde una caché de prompts en lugar de procesados de nuevo.
Degradación del contexto
La degradación del contexto es el empeoramiento de las respuestas de un modelo a medida que su contexto crece, por dilución del material relevante, contradicciones entre lo viejo y lo nuevo, y callejones sin salida acumulados.
Bucle de agente
Un bucle de agente es el ciclo en el que un modelo llama a una herramienta, lee el resultado y decide qué hacer después, repitiendo hasta producir una respuesta.
Llamada a herramienta
Una llamada a herramienta es una petición estructurada de un modelo para ejecutar algo fuera de sí mismo, como leer un archivo o correr un comando, cuyo resultado vuelve al contexto.
Mapa del repositorio
Un mapa del repositorio es un esquema comprimido de una base de código que lista sus archivos y los símbolos que definen, para que un modelo localice cosas sin leerlo todo.
Límite de uso
Un límite de uso pone tope a cuánto puedes enviar en una ventana de tiempo, medido sobre tokens procesados y no sobre el número de mensajes enviados.
Agente de código de línea de comandos
Un agente de código de línea de comandos es un programa de terminal que permite a un modelo leer, ejecutar y modificar cosas en un directorio de trabajo, bajo las reglas de aprobación que tú fijes.

Leer las guías