gpt-5.4 dans Codex CLI : tokens par question
Cette ancienne version de GPT constitue un autre point de référence pour les sessions de code dans Codex CLI.
Les chiffres
- Codex CLI seul
- 31 800
- Avec capsul
- 8 220
- d'entrée envoyée en moins
- x3.86
- réponses vérifiées sur cinq, sans puis avec capsul
- 4 / 4
- tokens de sortie par question, sans puis avec capsul
- 1 660 / 467
tokens d'entrée pondérés par le cache par question
tokens d'entrée pondérés par le cache par question
Intervalle à 90 % : x2.88 à x5.47
Codex CLI indique des tokens, pas des dollars, avec un forfait ChatGPT : aucun coût n'est affiché pour les modèles GPT.
Même un modèle familier peut consommer des quantités d'entrée très différentes selon ce que l'agent lit avant de répondre. Les mesures ci-dessous gardent les questions de code constantes et changent la manière de fournir le contexte. La ligne permet ainsi d'évaluer le trafic de tokens sans le déduire du nom du modèle.
Aucun montant en dollars par question n'est fourni pour cette campagne sur abonnement. Lisez l'intervalle avec les vérifications de réponse et les tâches individuelles. Si vous employez ce modèle pour de grandes modifications ou de longues conversations, l'entrée accumulée dans ces sessions mérite sa propre mesure.
Question par question
Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 2 fois par bras. Entrée pondérée par question, moyenne des répétitions.
| Question | Sans capsul | capsul | Entrée en moins | Réponses correctes, sans / avec capsul |
|---|---|---|---|---|
| Q1 | 36 800 | 10 400 | x3.53 | 0 / 0 |
| Q2 | 30 600 | 5 970 | x5.12 | 2 / 2 |
| Q3 | 17 000 | 3 310 | x5.12 | 1 / 2 |
| Q4 | 56 000 | 15 900 | x3.53 | 2 / 2 |
| Q5 | 18 500 | 5 520 | x3.35 | 2 / 2 |
Comment ces mesures ont été faites
Deux bras sur le même modèle : Codex CLI tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 4 septembre 2026, 2 répétitions par question et par bras.
20 / 20 cells · /benchmarks/2026-09-04-codex.json
Questions
Combien de tokens gpt-5.4 utilise-t-il par question dans Codex CLI ?
Dans le banc du 4 septembre 2026, une session Codex CLI sans capsul sur gpt-5.4 a envoyé en moyenne 31 800 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 8 220.
L'économie mesurée sur gpt-5.4 est-elle établie ?
Oui. L'intervalle à 90 % va de x2.88 à x5.47, entièrement au-dessus de un, sur 20 cellules mesurées.
capsul change-t-il les réponses de gpt-5.4 ?
Pas dans ce protocole : gpt-5.4 a passé 4 vérifications sur cinq sans capsul et 4 sur cinq avec capsul.