gpt-5.5 en Codex CLI: tokens por pregunta

Esta versión anterior de GPT ofrece a los usuarios de Codex CLI una referencia frente a las variantes más recientes de la familia.

Las cifras

Codex CLI solo
47.200

tokens de entrada ponderados por caché por pregunta

Con capsul
8130

tokens de entrada ponderados por caché por pregunta

menos entrada enviada
x5.81

Intervalo del 90 %: x4.29 a x7.89

respuestas correctas de cinco, sin y con capsul
4 / 4
tokens de salida por pregunta, sin y con capsul
1500 / 81,2

Codex CLI informa de tokens, no de dólares, con un plan ChatGPT: no se muestra ningún coste para los modelos GPT.

Elegir un modelo influye en cómo aborda el agente una pregunta de código, pero el contexto que la rodea sigue formando parte de cada petición. Usa esta fila para examinar la entrada enviada por Codex CLI solo y por la misma tarea con capsul. Resulta especialmente útil si este modelo ya está disponible en tu configuración diaria.

El banco registra tokens y comprobaciones de respuesta, no una factura en dólares de una suscripción ChatGPT. Compara las filas por tarea antes de atribuir una diferencia a la antigüedad o al nivel del modelo. Las observaciones describen preguntas breves con un protocolo fijo, no todas las sesiones largas que podrías ejecutar.

Pregunta por pregunta

Cinco preguntas de una línea sobre un repositorio TypeScript real, cada una repetida 2 veces por brazo. Entrada ponderada por pregunta, media de las repeticiones.

PreguntaSin capsulcapsulMenos entradaRespuestas correctas, sin / con capsul
P163.8008500x7.500 / 0
P240.90012.300x3.312 / 2
P321.5003700x5.792 / 2
P483.00010.200x8.132 / 2
P527.0005910x4.562 / 2

Cómo se midió

Dos brazos con el mismo modelo: Codex CLI tal como se usa habitualmente y la misma pregunta a través de capsul. La unidad es la entrada ponderada por caché: tokens nuevos con peso completo, lecturas de caché a una décima parte. Campaña del 4 de septiembre de 2026, 2 repeticiones por pregunta y brazo.

20 / 20 cells · /benchmarks/2026-09-04-codex.json

Preguntas

¿Cuántos tokens usa gpt-5.5 por pregunta en Codex CLI?

En el banco de pruebas del 4 de septiembre de 2026, una sesión de Codex CLI sin capsul con gpt-5.5 envió una media de 47.200 tokens de entrada ponderados por caché por pregunta de código de una línea. Con capsul en el mismo modelo, 8130.

¿Está demostrado el ahorro en gpt-5.5?

Sí. El intervalo del 90 % va de x4.29 a x7.89, completamente por encima de uno, en 20 celdas medidas.

¿Cambia capsul las respuestas de gpt-5.5?

No en este protocolo: gpt-5.5 superó 4 de cinco comprobaciones de respuesta sin capsul y 4 de cinco con capsul.