gpt-5.6-terra en Codex CLI: tokens por pregunta

Terra es el modelo equilibrado de esta familia GPT, entre la capacidad del modelo principal y un rendimiento de menor coste.

Las cifras

Codex CLI solo
24.000

tokens de entrada ponderados por caché por pregunta

Con capsul
11.100

tokens de entrada ponderados por caché por pregunta

menos entrada enviada
x2.16

Intervalo del 90 %: x1.57 a x3.20

respuestas correctas de cinco, sin y con capsul
3 / 4
tokens de salida por pregunta, sin y con capsul
582 / 142

Codex CLI informa de tokens, no de dólares, con un plan ChatGPT: no se muestra ningún coste para los modelos GPT.

Puede ser una opción habitual para la implementación, la reparación de pruebas y la revisión cuando la tarea exige más criterio que un cambio mecánico. En una sesión del agente, el contexto reunido para entender un repositorio puede pesar más que el prompt del usuario. Las filas por pregunta muestran cómo cambió ese tráfico en el protocolo medido.

Codex CLI se ejecutó aquí con una suscripción ChatGPT, por lo que no se atribuye ningún coste en dólares a este modelo. Lo útil es la diferencia de tokens junto a las comprobaciones de respuesta. Si tu trabajo es más largo o exploratorio, mídelo antes de suponer que el resultado de estas preguntas breves se trasladará a él.

Pregunta por pregunta

Cinco preguntas de una línea sobre un repositorio TypeScript real, cada una repetida 2 veces por brazo. Entrada ponderada por pregunta, media de las repeticiones.

PreguntaSin capsulcapsulMenos entradaRespuestas correctas, sin / con capsul
P126.6006100x4.370 / 0
P221.8009960x2.192 / 2
P315.7009620x1.632 / 2
P433.30024.400x1.370 / 2
P522.4005480x4.082 / 2

Cómo se midió

Dos brazos con el mismo modelo: Codex CLI tal como se usa habitualmente y la misma pregunta a través de capsul. La unidad es la entrada ponderada por caché: tokens nuevos con peso completo, lecturas de caché a una décima parte. Campaña del 4 de septiembre de 2026, 2 repeticiones por pregunta y brazo.

20 / 20 cells · /benchmarks/2026-09-04-codex.json

Preguntas

¿Cuántos tokens usa gpt-5.6-terra por pregunta en Codex CLI?

En el banco de pruebas del 4 de septiembre de 2026, una sesión de Codex CLI sin capsul con gpt-5.6-terra envió una media de 24.000 tokens de entrada ponderados por caché por pregunta de código de una línea. Con capsul en el mismo modelo, 11.100.

¿Está demostrado el ahorro en gpt-5.6-terra?

Sí. El intervalo del 90 % va de x1.57 a x3.20, completamente por encima de uno, en 20 celdas medidas.

¿Cambia capsul las respuestas de gpt-5.6-terra?

Superó más: 3 de cinco sin capsul, 4 de cinco con capsul. Cinco comprobaciones son una muestra pequeña: indica que no hubo pérdida, no que se haya demostrado una mejora.