Coût de Claude Opus, Sonnet et Haiku par tâche de code

Le prix par million de tokens n'explique qu'une partie du coût d'une tâche. L'autre est le nombre de tokens que le modèle utilise pour la terminer, absent des grilles tarifaires.

La facture d'une tâche de code combine deux facteurs : le prix d'un token sur le modèle choisi et le nombre de tokens nécessaires pour finir le travail. La grille tarifaire donne le premier. Le second dépend de la manière dont le modèle s'y prend.

Un modèle deux fois plus cher par token qui termine avec deux fois moins de tokens revient au même prix. Un modèle meilleur marché qui ouvre trois fichiers supplémentaires, se trompe et doit recommencer peut coûter davantage.

Les prix publics en septembre 2026

Anthropic facture chaque modèle au million de tokens, avec des tarifs distincts pour l'entrée fraîche, les écritures et lectures du cache et la sortie. Voici ses prix publics API en septembre 2026.

ModèleEntréeSortieLecture du cacheÉcriture cache 5 minÉcriture cache 1 hContexte
Claude Haiku 4.51,005,000,101,252,00200 000
Claude Sonnet 52,0010,000,202,504,001 000 000
Claude Sonnet 4.63,0015,000,303,756,001 000 000
Claude Opus 4.65,0025,000,506,2510,001 000 000
Claude Opus 4.75,0025,000,506,2510,001 000 000
Claude Opus 4.85,0025,000,506,2510,001 000 000
Claude Opus 55,0025,000,506,2510,001 000 000
Claude Opus 5.54,0020,000,205,008,001 000 000
Claude Fable 510,0050,001,0012,5020,001 000 000
Claude Fable 5.110,0050,000,2512,5020,001 000 000
Tarifs publics de l'API Claude Anthropic, en dollars US par million de tokens, vérifiés le 23 septembre 2026.

Pour un agent de code, trois points comptent plus que le prix d'entrée mis en avant :

  • Lectures du cache. L'agent renvoie toute la conversation à chaque tour ; l'essentiel revient du cache. La plupart des modèles le lisent au dixième du tarif d'entrée et Fable 5.1 au quarantième. Opus 5.5 le lit au vingtième, soit 0,20 $ par million, exactement comme Sonnet 5.
  • Sortie, réflexion comprise. La sortie coûte cinq fois l'entrée sur tous les modèles, et les tokens de réflexion sont facturés comme sortie.
  • Prix de Sonnet 5. Les tarifs de 2 $ et 10 $ avaient été annoncés comme promotionnels ; Anthropic les a rendus permanents. La hausse à 3 $ et 15 $ prévue au 1er septembre 2026 n'a pas eu lieu.

L'autre facteur : les tokens par tâche achevée

Le nombre de tokens varie selon le modèle, indépendamment du prix. Celui qui explore davantage lit plus de fichiers ; chacun reste dans le contexte et se repaie aux tours suivants. Une mauvaise réponse dépense ses tokens puis impose une nouvelle tentative. Un raisonnement plus long est facturé au tarif de sortie.

Le guide des coûts d'Anthropic le montre aussi : un modèle plus capable peut terminer en moins de tours, de recherches et de retours en arrière, ce qui compense un prix au token plus élevé. Sur un sous-ensemble de SWE-bench Pro, Fable 5.1 à effort faible résout 88,6 % des tâches à 0,54 $ par tâche réussie, contre 77,4 % à 0,84 $ pour Sonnet 5 avec son effort par défaut, malgré un prix au token cinq fois plus haut. D'autres tâches inversent le classement : aucune grille ne prédit à elle seule le gagnant.

Coût mesuré par question et par modèle

Le tableau suivant mesure ces deux facteurs dans un vrai dépôt : les mêmes questions d'une ligne posées via Claude Code à chaque modèle, trois fois chacune, au coût que Claude Code rapporte lui-même aux tarifs publics API. Les tokens d'entrée y sont pondérés : une lecture du cache compte pour un dixième de token frais, tarif de la plupart des modèles. Le tableau montre aussi les mêmes questions envoyées via capsul au même modèle ; la méthode complète figure sur la page du banc d'essai.

ModèleEntrée seuleEntrée avec capsulCoût seulCoût avec capsulEntrée en moins
Claude Haiku 4.555 50019 3000,0812 $US0,0265 $USx2.88
Claude Sonnet 554 20018 9000,153 $US0,0487 $USx2.86
Claude Sonnet 4.631 40016 6000,139 $US0,0613 $USx1.89
Claude Opus 4.645 70016 4000,332 $US0,101 $USx2.78
Claude Opus 4.738 70020 1000,28 $US0,126 $USx1.92
Claude Opus 4.865 80013 8000,498 $US0,0825 $USx4.75
Claude Opus 545 30016 2000,343 $US0,101 $USx2.80
Claude Opus 5.542 30015 9000,222 $US0,0696 $USx2.66
Claude Fable 541 40017 6000,633 $US0,219 $USx2.35
Claude Fable 5.149 70023 4000,636 $US0,279 $USx2.12
Modèles Claude dans Claude Code : tokens d'entrée pondérés par le cache et coût équivalent API par question de programmation en une ligne, agent seul ou avec capsul. Calculé à partir des jeux publiés : campagne Claude du 22 septembre 2026, campagne Codex du 4 septembre 2026.

Pour lire le tableau :

  • Commencez par Claude Code seul : le coût de ses réponses sur chaque modèle, à son tarif public.
  • Comparez les modèles de même grille. Opus 4.6, 4.7, 4.8 et Opus 5 coûtent tous 5 $ en entrée et 25 $ en sortie par million. Les écarts entre eux viennent donc des tokens, pas du tarif, et ils sont importants dans ces données. Le banc de code d'Anthropic montre le même phénomène.
  • Comparez les dollars entre générations, pas les tokens. Depuis 4.7, le même texte compte davantage de tokens ; les comptes bruts avantagent artificiellement Haiku 4.5, Sonnet 4.6 et Opus 4.6.
  • Lisez le coût avec les vérifications de réponse. Une ligne peu chère par question qui retrouve moins d'éléments attendus n'est pas peu chère par bonne réponse.
  • Ne supposez pas que le tarif inférieur gagne. Sonnet 5 affiche un prix au token inférieur à Sonnet 4.6, mais dans cette campagne il coûte davantage sur Claude Code seul, car il a dépensé plus de tokens. Sur le banc de code d'Anthropic, la baisse de tarif l'emporte. Même paire de modèles, autre travail, autre résultat.

Le tokeniseur a changé avec Claude 4.7

Selon la page tarifaire d'Anthropic, Claude 4.7 et les modèles suivants utilisent un nouveau tokeniseur qui produit environ 30 % de tokens de plus pour le même texte, avec une variation selon le contenu. Dans le tableau, cela touche Opus 4.7, 4.8, 5 et 5.5, Sonnet 5 et les deux Fable. Opus 4.6, Sonnet 4.6 et Haiku 4.5 utilisent l'ancien.

Une comparaison au token de part et d'autre de ce changement n'est donc pas homogène. Le même prompt est déjà plus long en tokens sur les modèles récents avant qu'ils n'agissent. Anthropic conseille de comparer le coût par tâche résolue.

L'effort est un deuxième réglage

Pour un même modèle, l'effort influe sur le temps de réflexion, le nombre d'appels d'outils et la longueur de sortie. Les niveaux vont de low à max, avec medium, high et xhigh. Un effort plus faible tend à réduire les appels et la réflexion, facturée au tarif de sortie.

En septembre 2026, Claude Code règle par défaut les modèles compatibles sur high, sauf Opus 5.5 sur medium et Opus 4.7 sur xhigh. Comparer Sonnet 5 et Opus 5.5 à leurs réglages par défaut n'isole donc pas le modèle. Haiku 4.5 n'a pas de réglage d'effort. Opus 5.5 et Fable réfléchissent toujours ; on règle leur profondeur plutôt que de couper la réflexion.

Anthropic décrit Sonnet 5 à medium comme comparable à Sonnet 4.6 à high. Elle constate que les longues tâches de code bénéficient réellement d'un effort accru, alors que les niveaux les plus hauts dépensent inutilement des tokens sur les tâches faciles pour le modèle.

/effort medium

Fixe l'effort dans Claude Code ; /effort seul ouvre un curseur.

Quel modèle pour quel travail

  • Haiku 4.5 pour les modifications mécaniques : renommage, formatage, changement ciblé que vous vérifierez ou recherche rapide. C'est le moins cher au token, à la moitié du prix de Sonnet 5. Anthropic le réserve surtout aux travaux nombreux aux résultats vérifiables, pas aux longues boucles d'agent. Sa fenêtre compte 200 000 tokens et sa disponibilité n'est promise que jusqu'au 15 octobre 2026 au minimum : vérifiez les dépréciations avant d'en dépendre.
  • Sonnet 5 pour le quotidien. La documentation Claude Code lui attribue la plupart des tâches de code à moindre prix qu'Opus. Au token, il coûte la moitié d'Opus 5.5 sauf en lecture du cache, où les deux sont à égalité.
  • Opus pour les problèmes difficiles : refonte de plusieurs modules, débogage délicat et décisions d'architecture. Opus 5.5 est aussi le modèle par défaut de Claude Code sur Pro, Max, Team, Enterprise et l'API en septembre 2026 : sans choix explicite, c'est celui que vous utilisez.
  • Fable pour les tâches les plus difficiles ou longues. C'est le plus cher au token, même si le guide d'Anthropic propose de commencer Fable 5.1 à low puis de monter l'effort là où il échoue. Selon le plan et le siège, Claude Code peut décompter Fable des crédits d'usage plutôt que des limites incluses ; le sélecteur /model l'indique.

Changer de modèle dans Claude Code

Dans une session, /model suivi d'un alias change immédiatement de modèle ; /model seul ouvre un sélecteur où les flèches règlent aussi l'effort. claude --model choisit le modèle au lancement. Le champ model des réglages ou la variable ANTHROPIC_MODEL rendent ce choix permanent. Les alias principaux sont haiku, sonnet, opus, fable et opusplan, qui utilise Opus en mode plan puis Sonnet en exécution.

/model sonnet

Passe la session au dernier Sonnet.

claude --model haiku

Démarre une session sur Haiku.

Changez au début d'une tâche, pas au milieu. Chaque modèle possède son cache ; après un changement, la requête suivante relit toute la conversation sans lecture du cache. Claude Code demande confirmation si le cache est encore actif. Chaque bascule du mode plan sous opusplan a ce coût, tout comme un changement d'effort sur la plupart des modèles. Pour les sous-agents chargés de tâches simples, Anthropic suggère model: haiku.

Si votre objectif est de réduire ce que porte chaque question, plutôt que le prix d'un token, capsul accepte les mêmes noms de modèle et envoie de courts extraits utiles à la demande. Sa colonne dans le tableau en donne la mesure.

capsul ask 'rename userId to accountId in the auth module' --model haiku

Pilote le CLI Claude auquel vous êtes déjà connecté, sur le modèle choisi.

Questions

Claude Opus vaut-il son prix pour coder ?

Souvent sur les problèmes difficiles : un modèle plus capable peut finir avec moins de tours, de recherches et de corrections. Sur les modifications ordinaires, on paie surtout une profondeur inutile. En septembre 2026, Opus 5.5 est le modèle par défaut de Claude Code sur Pro, Max, Team, Enterprise et l'API ; vérifiez /model avant de supposer que vous utilisez moins cher.

Quel est le modèle Claude le moins cher pour coder ?

Au token, Haiku 4.5 : en septembre 2026, l'API Anthropic le facture 1 $ par million de tokens d'entrée et 5 $ de sortie. Par tâche, cela dépend des tokens dépensés et de la justesse, car une mauvaise réponse suivie d'une correction se paie deux fois. Anthropic le destine aux travaux nombreux et vérifiables, plutôt qu'à toutes les longues tâches d'agent.

Claude Sonnet 5 coûte-t-il moins cher qu'Opus 5.5 ?

Au token, Sonnet 5 coûte moitié moins en entrée fraîche, écriture du cache et sortie en septembre 2026. La lecture du cache est au même tarif pour les deux : 0,20 $ par million. Comme cette lecture occupe une grande part de l'usage d'un agent, l'écart réel est moindre que celui des prix affichés. Le moins cher par tâche dépend ensuite du nombre de tours et de tokens nécessaires.

Pourquoi un même prompt utilise-t-il plus de tokens sur les nouveaux Claude ?

Selon Anthropic, Claude 4.7 et les modèles suivants utilisent un nouveau tokeniseur qui produit environ 30 % de tokens de plus pour le même texte, selon son contenu. Opus 4.6, Sonnet 4.6 et Haiku 4.5 utilisent l'ancien. Comparez le coût par tâche plutôt que les comptes bruts : ces derniers désavantagent les modèles récents avant même qu'ils commencent à travailler.

Le niveau d'effort change-t-il le coût d'une tâche ?

Oui. Il règle la réflexion, les appels d'outils et la longueur de sortie ; la réflexion est facturée au tarif de sortie. Dans Claude Code, /effort ou les flèches de /model le modifient. En septembre 2026, la plupart des modèles démarrent sur high, Opus 5.5 sur medium, et Haiku 4.5 n'offre pas ce réglage.

$ npm i -g @penra/capsul

← Tous les guides