gpt-5.6-sol dans Codex CLI : tokens par question

Sol est le modèle phare de cette famille GPT dans Codex CLI, destiné aux tâches de code exigeantes.

Les chiffres

Codex CLI seul
33 100

tokens d'entrée pondérés par le cache par question

Avec capsul
14 700

tokens d'entrée pondérés par le cache par question

d'entrée envoyée en moins
x2.26

Intervalle à 90 % : x1.81 à x3.01

réponses vérifiées sur cinq, sans puis avec capsul
3 / 3
tokens de sortie par question, sans puis avec capsul
1 020 / 225

Codex CLI indique des tokens, pas des dollars, avec un forfait ChatGPT : aucun coût n'est affiché pour les modèles GPT.

Cette gamme mérite d'être envisagée pour un bug ambigu, une implémentation complexe ou une revue qui demande un jugement soutenu. Ces tâches invitent aussi à explorer de nombreux fichiers : l'entrée envoyée par l'agent compte donc autant que le choix du modèle. Les chiffres ci-dessous comparent les mêmes questions courtes dans Codex CLI seul et avec capsul.

Cette campagne utilisait un abonnement ChatGPT : la page indique donc les tokens, sans montant en dollars par question. Vérifiez l'intervalle et les réponses avant de modifier votre méthode à partir de l'écart mesuré. Un long projet peut accumuler le contexte autrement que ces tâches brèves.

Question par question

Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 2 fois par bras. Entrée pondérée par question, moyenne des répétitions.

QuestionSans capsulcapsulEntrée en moinsRéponses correctes, sans / avec capsul
Q136 00019 200x1.880 / 0
Q223 9009 850x2.431 / 2
Q324 6007 830x3.142 / 2
Q461 40021 900x2.800 / 0
Q519 40014 500x1.342 / 2

Comment ces mesures ont été faites

Deux bras sur le même modèle : Codex CLI tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 4 septembre 2026, 2 répétitions par question et par bras.

20 / 20 cells · /benchmarks/2026-09-04-codex.json

Questions

Combien de tokens gpt-5.6-sol utilise-t-il par question dans Codex CLI ?

Dans le banc du 4 septembre 2026, une session Codex CLI sans capsul sur gpt-5.6-sol a envoyé en moyenne 33 100 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 14 700.

L'économie mesurée sur gpt-5.6-sol est-elle établie ?

Oui. L'intervalle à 90 % va de x1.81 à x3.01, entièrement au-dessus de un, sur 20 cellules mesurées.

capsul change-t-il les réponses de gpt-5.6-sol ?

Pas dans ce protocole : gpt-5.6-sol a passé 3 vérifications sur cinq sans capsul et 3 sur cinq avec capsul.