$ glosario de capsul
Glosario
Las palabras que deciden el coste de un agente de código, definidas en una frase cada una y luego explicadas.
- Token
- Un token es la unidad que un modelo de lenguaje lee y factura: una palabra común, un fragmento de palabra o un signo de puntuación, unos tres o cuatro caracteres de media.
- Ventana de contexto
- La ventana de contexto es el número máximo de tokens que un modelo puede considerar a la vez, incluidas las instrucciones, la conversación y todo lo que acompaña a la pregunta.
- Tokens de entrada y de salida
- Los tokens de entrada son todo lo que se envía al modelo en una petición; los de salida son lo que escribe de vuelta, y en el trabajo con agentes la entrada domina la factura por un orden de magnitud o más.
- Presupuesto de tokens
- Un presupuesto de tokens es un techo duro sobre cuánto contexto puede entrar en una petición, aplicado antes de enviarla en vez de negociado con el modelo.
- Caché de prompts
- La caché de prompts permite a un proveedor reutilizar la forma ya procesada de un prefijo repetido entre peticiones, facturando esos tokens a una fracción de la tarifa nueva.
- Tasa de acierto de caché
- La tasa de acierto de caché es la proporción de tokens de entrada de una petición servidos desde una caché de prompts en lugar de procesados de nuevo.
- Degradación del contexto
- La degradación del contexto es el empeoramiento de las respuestas de un modelo a medida que su contexto crece, por dilución del material relevante, contradicciones entre lo viejo y lo nuevo, y callejones sin salida acumulados.
- Bucle de agente
- Un bucle de agente es el ciclo en el que un modelo llama a una herramienta, lee el resultado y decide qué hacer después, repitiendo hasta producir una respuesta.
- Llamada a herramienta
- Una llamada a herramienta es una petición estructurada de un modelo para ejecutar algo fuera de sí mismo, como leer un archivo o correr un comando, cuyo resultado vuelve al contexto.
- Mapa del repositorio
- Un mapa del repositorio es un esquema comprimido de una base de código que lista sus archivos y los símbolos que definen, para que un modelo localice cosas sin leerlo todo.
- Límite de uso
- Un límite de uso pone tope a cuánto puedes enviar en una ventana de tiempo, medido sobre tokens procesados y no sobre el número de mensajes enviados.
- Agente de código de línea de comandos
- Un agente de código de línea de comandos es un programa de terminal que permite a un modelo leer, ejecutar y modificar cosas en un directorio de trabajo, bajo las reglas de aprobación que tú fijes.