gpt-5.6-sol en Codex CLI: tokens por pregunta
Sol es el modelo principal de esta familia GPT en Codex CLI, destinado a tareas de código exigentes.
Las cifras
- Codex CLI solo
- 33.100
- Con capsul
- 14.700
- menos entrada enviada
- x2.26
- respuestas correctas de cinco, sin y con capsul
- 3 / 3
- tokens de salida por pregunta, sin y con capsul
- 1020 / 225
tokens de entrada ponderados por caché por pregunta
tokens de entrada ponderados por caché por pregunta
Intervalo del 90 %: x1.81 a x3.01
Codex CLI informa de tokens, no de dólares, con un plan ChatGPT: no se muestra ningún coste para los modelos GPT.
Es el nivel a considerar para un error ambiguo, una implementación compleja o una revisión que demande criterio sostenido. Estas tareas también pueden llevar a explorar muchos archivos; por eso la entrada que envía el agente importa junto a la elección del modelo. Las cifras de abajo comparan las mismas preguntas breves en Codex CLI solo y con capsul.
Esta ejecución usó una suscripción ChatGPT, así que la página informa de tokens y no de dólares por pregunta. Examina el intervalo y las comprobaciones de respuesta antes de cambiar tu flujo por la diferencia medida. Un proyecto largo puede acumular contexto de otra manera que estas tareas breves.
Pregunta por pregunta
Cinco preguntas de una línea sobre un repositorio TypeScript real, cada una repetida 2 veces por brazo. Entrada ponderada por pregunta, media de las repeticiones.
| Pregunta | Sin capsul | capsul | Menos entrada | Respuestas correctas, sin / con capsul |
|---|---|---|---|---|
| P1 | 36.000 | 19.200 | x1.88 | 0 / 0 |
| P2 | 23.900 | 9850 | x2.43 | 1 / 2 |
| P3 | 24.600 | 7830 | x3.14 | 2 / 2 |
| P4 | 61.400 | 21.900 | x2.80 | 0 / 0 |
| P5 | 19.400 | 14.500 | x1.34 | 2 / 2 |
Cómo se midió
Dos brazos con el mismo modelo: Codex CLI tal como se usa habitualmente y la misma pregunta a través de capsul. La unidad es la entrada ponderada por caché: tokens nuevos con peso completo, lecturas de caché a una décima parte. Campaña del 4 de septiembre de 2026, 2 repeticiones por pregunta y brazo.
20 / 20 cells · /benchmarks/2026-09-04-codex.json
Preguntas
¿Cuántos tokens usa gpt-5.6-sol por pregunta en Codex CLI?
En el banco de pruebas del 4 de septiembre de 2026, una sesión de Codex CLI sin capsul con gpt-5.6-sol envió una media de 33.100 tokens de entrada ponderados por caché por pregunta de código de una línea. Con capsul en el mismo modelo, 14.700.
¿Está demostrado el ahorro en gpt-5.6-sol?
Sí. El intervalo del 90 % va de x1.81 a x3.01, completamente por encima de uno, en 20 celdas medidas.
¿Cambia capsul las respuestas de gpt-5.6-sol?
No en este protocolo: gpt-5.6-sol superó 3 de cinco comprobaciones de respuesta sin capsul y 3 de cinco con capsul.