gpt-5.5 en Codex CLI: tokens por pregunta
Esta versión anterior de GPT ofrece a los usuarios de Codex CLI una referencia frente a las variantes más recientes de la familia.
Las cifras
- Codex CLI solo
- 47.200
- Con capsul
- 8130
- menos entrada enviada
- x5.81
- respuestas correctas de cinco, sin y con capsul
- 4 / 4
- tokens de salida por pregunta, sin y con capsul
- 1500 / 81,2
tokens de entrada ponderados por caché por pregunta
tokens de entrada ponderados por caché por pregunta
Intervalo del 90 %: x4.29 a x7.89
Codex CLI informa de tokens, no de dólares, con un plan ChatGPT: no se muestra ningún coste para los modelos GPT.
Elegir un modelo influye en cómo aborda el agente una pregunta de código, pero el contexto que la rodea sigue formando parte de cada petición. Usa esta fila para examinar la entrada enviada por Codex CLI solo y por la misma tarea con capsul. Resulta especialmente útil si este modelo ya está disponible en tu configuración diaria.
El banco registra tokens y comprobaciones de respuesta, no una factura en dólares de una suscripción ChatGPT. Compara las filas por tarea antes de atribuir una diferencia a la antigüedad o al nivel del modelo. Las observaciones describen preguntas breves con un protocolo fijo, no todas las sesiones largas que podrías ejecutar.
Pregunta por pregunta
Cinco preguntas de una línea sobre un repositorio TypeScript real, cada una repetida 2 veces por brazo. Entrada ponderada por pregunta, media de las repeticiones.
| Pregunta | Sin capsul | capsul | Menos entrada | Respuestas correctas, sin / con capsul |
|---|---|---|---|---|
| P1 | 63.800 | 8500 | x7.50 | 0 / 0 |
| P2 | 40.900 | 12.300 | x3.31 | 2 / 2 |
| P3 | 21.500 | 3700 | x5.79 | 2 / 2 |
| P4 | 83.000 | 10.200 | x8.13 | 2 / 2 |
| P5 | 27.000 | 5910 | x4.56 | 2 / 2 |
Cómo se midió
Dos brazos con el mismo modelo: Codex CLI tal como se usa habitualmente y la misma pregunta a través de capsul. La unidad es la entrada ponderada por caché: tokens nuevos con peso completo, lecturas de caché a una décima parte. Campaña del 4 de septiembre de 2026, 2 repeticiones por pregunta y brazo.
20 / 20 cells · /benchmarks/2026-09-04-codex.json
Preguntas
¿Cuántos tokens usa gpt-5.5 por pregunta en Codex CLI?
En el banco de pruebas del 4 de septiembre de 2026, una sesión de Codex CLI sin capsul con gpt-5.5 envió una media de 47.200 tokens de entrada ponderados por caché por pregunta de código de una línea. Con capsul en el mismo modelo, 8130.
¿Está demostrado el ahorro en gpt-5.5?
Sí. El intervalo del 90 % va de x4.29 a x7.89, completamente por encima de uno, en 20 celdas medidas.
¿Cambia capsul las respuestas de gpt-5.5?
No en este protocolo: gpt-5.5 superó 4 de cinco comprobaciones de respuesta sin capsul y 4 de cinco con capsul.