Claude Code ou Codex CLI : qui consomme le plus ?

Le modèle, la configuration et la tâche influent plus sur les tokens que le choix de l'agent. Voici ce que chacun envoie, affiche et facture, et ce que révèlent les mesures.

Claude Code et Codex CLI fonctionnent selon la même boucle : un modèle lit des fichiers, exécute des commandes et modifie du code dans le répertoire de départ. Ils dépensent donc les tokens de façon comparable. Chaque requête transporte bien plus que votre question, qui en est souvent la plus petite part.

Aucun des deux n'utilise systématiquement moins de tokens. Le modèle choisi, les instructions et outils actifs, ainsi que l'ampleur des recherches, font davantage varier le total que le choix de l'agent.

Où partent les tokens des deux agents

Chaque requête contient trois couches d'entrée :

  • Entrée ambiante : les instructions de l'agent, les outils accessibles au modèle, les consignes du projet (CLAUDE.md ou AGENTS.md), les skills, plugins et serveurs MCP actifs. Elle existe avant votre première demande.
  • Exploration : chaque fichier lu, recherche et sortie de commande rejoint la conversation et y reste jusqu'à la fin de la session.
  • Historique : toute la conversation est renvoyée à chaque requête, résultats d'outils compris. Une question exige souvent plusieurs appels, un par étape de l'agent.

Le cache des prompts atténue le prix de l'historique chez les deux fournisseurs. Un préfixe déjà traité est facturé comme lecture du cache, au dixième du tarif frais pour la plupart des modèles en septembre 2026, sur les grilles Anthropic comme OpenAI. Les deux agents résument aussi leur historique quand la fenêtre se remplit ; /compact permet de le faire à la demande.

Ce que chacun charge avant votre première demande

Claude Code place en tête ses instructions et outils, puis le contexte du projet (CLAUDE.md, mémoire automatique et règles), enfin la conversation. Sur les modèles compatibles, les outils MCP sont différés par défaut : un serveur inactif ne coûte d'abord que ses noms d'outils et instructions, pas tous ses schémas. Un skill ne coûte que sa courte description avant d'être invoqué.

Codex CLI compose au démarrage une chaîne de fichiers AGENTS.md, depuis son répertoire global puis la racine du projet jusqu'au répertoire courant. Il cesse de charger à 32 Kio par défaut. Il ajoute un catalogue de skills dont le budget par défaut représente deux pour cent de la fenêtre du modèle. Les outils des serveurs MCP dans config.toml sont différés derrière une recherche sur les modèles compatibles, et envoyés en entier sinon. enabled_tools et disabled_tools en limitent la liste.

Aucune de ces listes n'est universelle : elle dépend de votre installation. C'est une première raison pour laquelle une comparaison réalisée sur un autre ordinateur ne prédit pas votre résultat.

Ce que chacun affiche

Claude Code rapporte des tokens et une estimation en dollars :

/usage

Claude Code affiche les tokens par modèle, le cache, une estimation aux tarifs publics et l'usage du plan sur abonnement.

/context

Claude Code : contenu actuel de la fenêtre, ventilé par catégorie.

Codex CLI montre ses tokens et, sous connexion ChatGPT, la part de vos limites déjà utilisée :

/status

Codex : modèle, fenêtre utilisée et restante, part des limites sur cinq heures et sur la semaine encore disponible.

codex debug prompt-input 'where is the retry limit set'

Affiche en JSON la liste d'entrée préparée pour ce prompt, sans appeler le modèle.

/usage dans Codex montre l'activité du compte en tokens par jour, par semaine ou au total ; la sortie de l'application affiche les tokens de la session. debug prompt-input omet les instructions de base et les schémas d'outils, envoyés à côté de la liste : son compte est un plancher, pas la requête entière.

Comment chaque agent facture

Les deux peuvent fonctionner sur abonnement ou à la consommation, avec des compteurs différents :

  • Claude Code sur Pro ou Max : l'usage compte dans une limite de session renouvelée toutes les cinq heures et une limite hebdomadaire, partagées avec Claude. Team et Enterprise suivent une logique semblable. Le montant de /usage est une estimation aux prix API, sans effet sur la facturation de Pro et Max.
  • Claude Code avec une clé API ou Claude Console : facturation au token selon les tarifs API, cache compris. Une variable ANTHROPIC_API_KEY laissée dans l'environnement prend la place de l'abonnement après votre accord, et claude -p l'utilise sans demander.
  • Codex CLI connecté à ChatGPT : usage décompté de l'allocation du plan. La page tarifaire OpenAI l'estime en messages locaux par fenêtre de cinq heures, avec d'éventuelles limites hebdomadaires ; des crédits permettent de continuer au-delà. Sur Plus et Pro, Codex affiche tokens et pourcentages de limites, pas des dollars.
  • Codex CLI avec une clé API : facturation du compte OpenAI Platform aux tarifs API ordinaires.

Ce que notre banc d'essai a mesuré

Nous avons exécuté chaque agent seul, comme on l'utilise normalement (claude -p et codex exec avec leur configuration habituelle, sans mode --bare de Claude Code), sur cinq mêmes questions d'une ligne relatives à un dépôt. L'unité est l'entrée pondérée par le cache et par question : tout ce que l'agent a envoyé à travers ses requêtes, entrée fraîche au plein poids et lectures du cache à un dixième. Chaque ligne correspond à un modèle.

Pour chaque modèle, les tableaux donnent l'agent seul, chiffre à lire pour comparer les agents, et la même question via capsul sur le même modèle, objet principal du banc. Les vérifications comptent, sur cinq, les réponses contenant l'élément attendu selon un contrôle automatique.

ModèleEntrée seuleEntrée avec capsulCoût seulCoût avec capsulEntrée en moins
Claude Haiku 4.555 50019 3000,0812 $US0,0265 $USx2.88
Claude Sonnet 554 20018 9000,153 $US0,0487 $USx2.86
Claude Sonnet 4.631 40016 6000,139 $US0,0613 $USx1.89
Claude Opus 4.645 70016 4000,332 $US0,101 $USx2.78
Claude Opus 4.738 70020 1000,28 $US0,126 $USx1.92
Claude Opus 4.865 80013 8000,498 $US0,0825 $USx4.75
Claude Opus 545 30016 2000,343 $US0,101 $USx2.80
Claude Opus 5.542 30015 9000,222 $US0,0696 $USx2.66
Claude Fable 541 40017 6000,633 $US0,219 $USx2.35
Claude Fable 5.149 70023 4000,636 $US0,279 $USx2.12
Modèles Claude dans Claude Code : tokens d'entrée pondérés par le cache et coût équivalent API par question de programmation en une ligne, agent seul ou avec capsul. Calculé à partir des jeux publiés : campagne Claude du 22 septembre 2026, campagne Codex du 4 septembre 2026.

Le tableau Claude ajoute le coût par question que Claude Code estime lui-même aux prix publics API. Sur abonnement, vous ne payez pas ce montant.

ModèleEntrée seuleEntrée avec capsulEntrée en moins
gpt-5.6-sol33 10014 700x2.26
gpt-5.6-terra24 00011 100x2.16
gpt-5.6-luna32 10013 600x2.36
gpt-5.547 2008 130x5.81
gpt-5.431 8008 220x3.86
gpt-5.4-mini42 30012 100x3.49
Modèles GPT dans Codex CLI : tokens d'entrée pondérés par le cache par question de programmation en une ligne, seul ou avec capsul. Codex fournit des tokens, pas des dollars. Calculé à partir des jeux publiés : campagne Claude du 22 septembre 2026, campagne Codex du 4 septembre 2026.

Le tableau Codex n'a pas de colonne de coût : sous le plan ChatGPT utilisé pour ces mesures, Codex rapporte des tokens, pas des dollars.

Pourquoi les tableaux ne forment pas un classement

Leur lecture côte à côte reste indicative pour cinq raisons :

  • Dates et code différents. Les lignes Claude datent du 22 septembre 2026, la campagne Codex principale du 4 septembre 2026, chacune avec les versions des agents et de capsul de ce jour.
  • Modèles différents. Aucun modèle ne figure dans les deux tableaux : comparer les agents revient aussi à comparer leurs modèles.
  • Tokeniseurs différents. Chaque fournisseur découpe le texte à sa façon ; Anthropic indique que ses nouveaux modèles comptent environ 30 % de tokens de plus que les précédents pour le même texte. Un token n'est pas une longueur fixe.
  • Comptabilité différente. Claude rapporte les écritures du cache, pondérées au-dessus de l'entrée fraîche selon leur prix. Les exécutions Codex n'en ont pas rapporté, et la grille de crédits ChatGPT ne facture pas séparément ces écritures.
  • Répétitions différentes. Chaque question Claude a été exécutée trois fois par bras, chaque question Codex deux fois. La première exécution écrit le cache que les suivantes peuvent relire.

Ces réserves laissent un constat utile : sur une question d'une ligne, les deux agents seuls envoient des dizaines de milliers de tokens d'entrée pondérés, presque tous liés au contexte. Dans chaque tableau, l'écart entre modèles est large : choisir le modèle change au moins autant le total que choisir l'agent dans cette campagne.

Qu'en faire pour votre travail

Si vous payez déjà l'un des deux plans, changer d'agent dans le seul but d'économiser des tokens agit rarement sur le facteur principal. Les leviers utiles sont communs :

  • Une nouvelle session pour chaque tâche. /clear existe dans les deux agents et arrête le renvoi de l'ancien historique.
  • Le nom du fichier concerné. La recherche est la couche qui varie le plus d'une exécution à l'autre.
  • Une entrée ambiante courte : CLAUDE.md ou AGENTS.md concis, sans serveurs MCP ni plugins inutiles.
  • Un modèle et un effort adaptés : /model et /effort dans Claude Code ; /model dans Codex, qui règle les deux lorsque le modèle le permet.

Pour comparer les deux sur votre code, mesurez une vraie tâche, pas seulement notre tableau. Répétez-la trois fois par agent, dans des sessions neuves du même dépôt : la première exécution écrit le cache, les suivantes peuvent le lire. Avec claude -p --output-format json, additionnez entrée, lectures et écritures par modèle ; cette ventilation inclut les sous-agents, contrairement au simple champ usage. Avec codex exec --json, lisez l'usage du dernier événement turn.completed et retirez la part en cache de l'entrée. Pondérez l'entrée fraîche au plein poids, les lectures à un dixième et les écritures éventuelles à leur majoration : vous obtenez une mesure comparable par tâche.

Si vous utilisez les deux agents, capsul pilote l'un ou l'autre avec la même commande, sous le budget de tokens choisi, et garde un relevé local de leur usage.

capsul burn

Dépense locale ventilée par agent, modèle et projet.

Questions

Claude Code ou Codex CLI consomme-t-il moins de tokens ?

Aucun ne gagne systématiquement. Le modèle, les instructions et outils actifs ainsi que l'exploration font davantage varier le total, et chaque fournisseur découpe le texte différemment. Dans notre banc d'essai où les agents travaillent seuls, la dispersion entre modèles d'un même agent est au moins aussi grande que l'écart entre agents.

Codex CLI coûte-t-il moins cher que Claude Code ?

Sur abonnement, le prix est celui du plan et la différence porte sur le temps avant d'atteindre ses limites. Avec une clé API, les deux facturent au token selon leurs tarifs publics ; la lecture en cache vaut environ un dixième de l'entrée fraîche sur la plupart des modèles. Le moins cher pour vous est celui qui termine vos tâches avec moins de contexte et un modèle adapté, ce qu'une mesure sur votre code peut montrer.

Pourquoi Claude Code affiche-t-il des dollars sur Pro ou Max ?

/usage valorise les tokens de la session aux prix publics API : ce que le même travail aurait coûté avec une clé. Anthropic précise que ce chiffre ne sert pas à facturer Pro ou Max. Les barres d'usage sur le même écran montrent ce qui compte pour votre plan.

Comment voir les tokens de Codex CLI avec ChatGPT ?

/status affiche la fenêtre utilisée et restante, ainsi que la part des limites sur cinq heures et sur la semaine encore disponible. /usage montre l'activité du compte par jour, par semaine ou au total. À la sortie, Codex imprime les comptes de la session : son total additionne entrée fraîche et sortie, avec l'entrée en cache à part.

Peut-on comparer directement leurs comptes de tokens ?

Pas tels qu'affichés. Claude sépare entrée, lectures et écritures du cache ; input_tokens dans le JSON de Codex inclut déjà sa part en cache. Convertissez les deux en entrée pondérée, avec l'entrée fraîche au plein poids et les lectures à un dixième, puis comparez la même tâche répétée sur chaque agent.

$ npm i -g @penra/capsul

← Tous les guides