gpt-5.5 dans Codex CLI : tokens par question

Cette version antérieure de GPT donne aux utilisateurs de Codex CLI une référence face aux variantes plus récentes de la famille.

Les chiffres

Codex CLI seul
47 200

tokens d'entrée pondérés par le cache par question

Avec capsul
8 130

tokens d'entrée pondérés par le cache par question

d'entrée envoyée en moins
x5.81

Intervalle à 90 % : x4.29 à x7.89

réponses vérifiées sur cinq, sans puis avec capsul
4 / 4
tokens de sortie par question, sans puis avec capsul
1 500 / 81,2

Codex CLI indique des tokens, pas des dollars, avec un forfait ChatGPT : aucun coût n'est affiché pour les modèles GPT.

Le choix du modèle influence la façon dont l'agent aborde une question de code, mais le contexte qui l'entoure fait toujours partie de chaque requête. Cette ligne permet d'examiner l'entrée envoyée par Codex CLI seul et par la même tâche avec capsul. Elle est particulièrement utile si ce modèle fait déjà partie de votre configuration quotidienne.

Le banc enregistre les tokens et les vérifications de réponse, pas une facture en dollars pour un abonnement ChatGPT. Comparez les tâches avant d'attribuer un écart à l'âge ou à la gamme du modèle. Ces observations décrivent des questions courtes dans un protocole fixe, pas toutes les longues sessions possibles.

Question par question

Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 2 fois par bras. Entrée pondérée par question, moyenne des répétitions.

QuestionSans capsulcapsulEntrée en moinsRéponses correctes, sans / avec capsul
Q163 8008 500x7.500 / 0
Q240 90012 300x3.312 / 2
Q321 5003 700x5.792 / 2
Q483 00010 200x8.132 / 2
Q527 0005 910x4.562 / 2

Comment ces mesures ont été faites

Deux bras sur le même modèle : Codex CLI tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 4 septembre 2026, 2 répétitions par question et par bras.

20 / 20 cells · /benchmarks/2026-09-04-codex.json

Questions

Combien de tokens gpt-5.5 utilise-t-il par question dans Codex CLI ?

Dans le banc du 4 septembre 2026, une session Codex CLI sans capsul sur gpt-5.5 a envoyé en moyenne 47 200 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 8 130.

L'économie mesurée sur gpt-5.5 est-elle établie ?

Oui. L'intervalle à 90 % va de x4.29 à x7.89, entièrement au-dessus de un, sur 20 cellules mesurées.

capsul change-t-il les réponses de gpt-5.5 ?

Pas dans ce protocole : gpt-5.5 a passé 4 vérifications sur cinq sans capsul et 4 sur cinq avec capsul.