gpt-5.6-terra dans Codex CLI : tokens par question
Terra est le modèle équilibré de cette famille GPT, entre les capacités du modèle phare et un débit moins coûteux.
Les chiffres
- Codex CLI seul
- 24 000
- Avec capsul
- 11 100
- d'entrée envoyée en moins
- x2.16
- réponses vérifiées sur cinq, sans puis avec capsul
- 3 / 4
- tokens de sortie par question, sans puis avec capsul
- 582 / 142
tokens d'entrée pondérés par le cache par question
tokens d'entrée pondérés par le cache par question
Intervalle à 90 % : x1.57 à x3.20
Codex CLI indique des tokens, pas des dollars, avec un forfait ChatGPT : aucun coût n'est affiché pour les modèles GPT.
Il peut convenir par défaut à l'implémentation courante, à la réparation de tests et à la revue de code lorsque la tâche demande plus de jugement qu'une modification mécanique. Dans une session d'agent, le contexte réuni pour comprendre un dépôt peut peser davantage que le prompt de l'utilisateur. Les lignes par question montrent comment ce trafic a changé dans le protocole mesuré.
Codex CLI utilisait ici un abonnement ChatGPT : aucun coût en dollars n'est attribué à ce modèle. Les éléments utiles sont l'écart de tokens et les vérifications de réponse. Si votre travail est plus long ou plus exploratoire, mesurez-le avant de supposer que le résultat de ces questions courtes s'appliquera aussi.
Question par question
Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 2 fois par bras. Entrée pondérée par question, moyenne des répétitions.
| Question | Sans capsul | capsul | Entrée en moins | Réponses correctes, sans / avec capsul |
|---|---|---|---|---|
| Q1 | 26 600 | 6 100 | x4.37 | 0 / 0 |
| Q2 | 21 800 | 9 960 | x2.19 | 2 / 2 |
| Q3 | 15 700 | 9 620 | x1.63 | 2 / 2 |
| Q4 | 33 300 | 24 400 | x1.37 | 0 / 2 |
| Q5 | 22 400 | 5 480 | x4.08 | 2 / 2 |
Comment ces mesures ont été faites
Deux bras sur le même modèle : Codex CLI tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 4 septembre 2026, 2 répétitions par question et par bras.
20 / 20 cells · /benchmarks/2026-09-04-codex.json
Questions
Combien de tokens gpt-5.6-terra utilise-t-il par question dans Codex CLI ?
Dans le banc du 4 septembre 2026, une session Codex CLI sans capsul sur gpt-5.6-terra a envoyé en moyenne 24 000 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 11 100.
L'économie mesurée sur gpt-5.6-terra est-elle établie ?
Oui. L'intervalle à 90 % va de x1.57 à x3.20, entièrement au-dessus de un, sur 20 cellules mesurées.
capsul change-t-il les réponses de gpt-5.6-terra ?
Il en a passé davantage : 3 sur cinq sans capsul, 4 sur cinq avec capsul. Cinq vérifications restent un petit échantillon : il faut y voir une absence de perte, pas un gain établi.