gpt-5.4-mini dans Codex CLI : tokens par question
Mini est le plus petit modèle de cette ancienne famille GPT, adapté au code bien délimité.
Les chiffres
- Codex CLI seul
- 42 300
- Avec capsul
- 12 100
- d'entrée envoyée en moins
- x3.49
- réponses vérifiées sur cinq, sans puis avec capsul
- 3 / 4
- tokens de sortie par question, sans puis avec capsul
- 2 390 / 904
tokens d'entrée pondérés par le cache par question
tokens d'entrée pondérés par le cache par question
Intervalle à 90 % : x3.05 à x4.03
Codex CLI indique des tokens, pas des dollars, avec un forfait ChatGPT : aucun coût n'est affiché pour les modèles GPT.
Il peut servir à retrouver du code, effectuer une modification mécanique ou examiner l'échec d'un test précis. Un petit modèle ne donne pas automatiquement la réponse correcte au moindre coût s'il faut multiplier les tentatives ou explorer davantage. C'est pourquoi les vérifications de réponse figurent à côté des tokens.
Codex CLI utilisait un abonnement ChatGPT dans cette campagne : la page ne transforme donc pas les tokens en dollars. Les questions individuelles révèlent celles que le modèle a résolues et celles qu'il n'a pas résolues. Lisez-les avec l'intervalle avant d'étendre le résultat mesuré à votre travail.
Question par question
Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 2 fois par bras. Entrée pondérée par question, moyenne des répétitions.
| Question | Sans capsul | capsul | Entrée en moins | Réponses correctes, sans / avec capsul |
|---|---|---|---|---|
| Q1 | 45 700 | 11 500 | x3.97 | 1 / 0 |
| Q2 | 35 600 | 21 800 | x1.63 | 2 / 2 |
| Q3 | 7 920 | 7 110 | x1.11 | 0 / 2 |
| Q4 | 81 200 | 10 400 | x7.78 | 0 / 2 |
| Q5 | 41 200 | 9 770 | x4.22 | 2 / 2 |
Comment ces mesures ont été faites
Deux bras sur le même modèle : Codex CLI tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 4 septembre 2026, 2 répétitions par question et par bras.
20 / 20 cells · /benchmarks/2026-09-04-codex.json
Questions
Combien de tokens gpt-5.4-mini utilise-t-il par question dans Codex CLI ?
Dans le banc du 4 septembre 2026, une session Codex CLI sans capsul sur gpt-5.4-mini a envoyé en moyenne 42 300 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 12 100.
L'économie mesurée sur gpt-5.4-mini est-elle établie ?
Oui. L'intervalle à 90 % va de x3.05 à x4.03, entièrement au-dessus de un, sur 20 cellules mesurées.
capsul change-t-il les réponses de gpt-5.4-mini ?
Il en a passé davantage : 3 sur cinq sans capsul, 4 sur cinq avec capsul. Cinq vérifications restent un petit échantillon : il faut y voir une absence de perte, pas un gain établi.