gpt-5.4-mini dans Codex CLI : tokens par question

Mini est le plus petit modèle de cette ancienne famille GPT, adapté au code bien délimité.

Les chiffres

Codex CLI seul
42 300

tokens d'entrée pondérés par le cache par question

Avec capsul
12 100

tokens d'entrée pondérés par le cache par question

d'entrée envoyée en moins
x3.49

Intervalle à 90 % : x3.05 à x4.03

réponses vérifiées sur cinq, sans puis avec capsul
3 / 4
tokens de sortie par question, sans puis avec capsul
2 390 / 904

Codex CLI indique des tokens, pas des dollars, avec un forfait ChatGPT : aucun coût n'est affiché pour les modèles GPT.

Il peut servir à retrouver du code, effectuer une modification mécanique ou examiner l'échec d'un test précis. Un petit modèle ne donne pas automatiquement la réponse correcte au moindre coût s'il faut multiplier les tentatives ou explorer davantage. C'est pourquoi les vérifications de réponse figurent à côté des tokens.

Codex CLI utilisait un abonnement ChatGPT dans cette campagne : la page ne transforme donc pas les tokens en dollars. Les questions individuelles révèlent celles que le modèle a résolues et celles qu'il n'a pas résolues. Lisez-les avec l'intervalle avant d'étendre le résultat mesuré à votre travail.

Question par question

Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 2 fois par bras. Entrée pondérée par question, moyenne des répétitions.

QuestionSans capsulcapsulEntrée en moinsRéponses correctes, sans / avec capsul
Q145 70011 500x3.971 / 0
Q235 60021 800x1.632 / 2
Q37 9207 110x1.110 / 2
Q481 20010 400x7.780 / 2
Q541 2009 770x4.222 / 2

Comment ces mesures ont été faites

Deux bras sur le même modèle : Codex CLI tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 4 septembre 2026, 2 répétitions par question et par bras.

20 / 20 cells · /benchmarks/2026-09-04-codex.json

Questions

Combien de tokens gpt-5.4-mini utilise-t-il par question dans Codex CLI ?

Dans le banc du 4 septembre 2026, une session Codex CLI sans capsul sur gpt-5.4-mini a envoyé en moyenne 42 300 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 12 100.

L'économie mesurée sur gpt-5.4-mini est-elle établie ?

Oui. L'intervalle à 90 % va de x3.05 à x4.03, entièrement au-dessus de un, sur 20 cellules mesurées.

capsul change-t-il les réponses de gpt-5.4-mini ?

Il en a passé davantage : 3 sur cinq sans capsul, 4 sur cinq avec capsul. Cinq vérifications restent un petit échantillon : il faut y voir une absence de perte, pas un gain établi.