Coût de Claude Opus, Sonnet et Haiku par tâche de code
Le prix par million de tokens n'explique qu'une partie du coût d'une tâche. L'autre est le nombre de tokens que le modèle utilise pour la terminer, absent des grilles tarifaires.
La facture d'une tâche de code combine deux facteurs : le prix d'un token sur le modèle choisi et le nombre de tokens nécessaires pour finir le travail. La grille tarifaire donne le premier. Le second dépend de la manière dont le modèle s'y prend.
Un modèle deux fois plus cher par token qui termine avec deux fois moins de tokens revient au même prix. Un modèle meilleur marché qui ouvre trois fichiers supplémentaires, se trompe et doit recommencer peut coûter davantage.
Les prix publics en septembre 2026
Anthropic facture chaque modèle au million de tokens, avec des tarifs distincts pour l'entrée fraîche, les écritures et lectures du cache et la sortie. Voici ses prix publics API en septembre 2026.
| Modèle | Entrée | Sortie | Lecture du cache | Écriture cache 5 min | Écriture cache 1 h | Contexte |
|---|---|---|---|---|---|---|
| Claude Haiku 4.5 | 1,00 | 5,00 | 0,10 | 1,25 | 2,00 | 200 000 |
| Claude Sonnet 5 | 2,00 | 10,00 | 0,20 | 2,50 | 4,00 | 1 000 000 |
| Claude Sonnet 4.6 | 3,00 | 15,00 | 0,30 | 3,75 | 6,00 | 1 000 000 |
| Claude Opus 4.6 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1 000 000 |
| Claude Opus 4.7 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1 000 000 |
| Claude Opus 4.8 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1 000 000 |
| Claude Opus 5 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1 000 000 |
| Claude Opus 5.5 | 4,00 | 20,00 | 0,20 | 5,00 | 8,00 | 1 000 000 |
| Claude Fable 5 | 10,00 | 50,00 | 1,00 | 12,50 | 20,00 | 1 000 000 |
| Claude Fable 5.1 | 10,00 | 50,00 | 0,25 | 12,50 | 20,00 | 1 000 000 |
Pour un agent de code, trois points comptent plus que le prix d'entrée mis en avant :
- Lectures du cache. L'agent renvoie toute la conversation à chaque tour ; l'essentiel revient du cache. La plupart des modèles le lisent au dixième du tarif d'entrée et Fable 5.1 au quarantième. Opus 5.5 le lit au vingtième, soit 0,20 $ par million, exactement comme Sonnet 5.
- Sortie, réflexion comprise. La sortie coûte cinq fois l'entrée sur tous les modèles, et les tokens de réflexion sont facturés comme sortie.
- Prix de Sonnet 5. Les tarifs de 2 $ et 10 $ avaient été annoncés comme promotionnels ; Anthropic les a rendus permanents. La hausse à 3 $ et 15 $ prévue au 1er septembre 2026 n'a pas eu lieu.
L'autre facteur : les tokens par tâche achevée
Le nombre de tokens varie selon le modèle, indépendamment du prix. Celui qui explore davantage lit plus de fichiers ; chacun reste dans le contexte et se repaie aux tours suivants. Une mauvaise réponse dépense ses tokens puis impose une nouvelle tentative. Un raisonnement plus long est facturé au tarif de sortie.
Le guide des coûts d'Anthropic le montre aussi : un modèle plus capable peut terminer en moins de tours, de recherches et de retours en arrière, ce qui compense un prix au token plus élevé. Sur un sous-ensemble de SWE-bench Pro, Fable 5.1 à effort faible résout 88,6 % des tâches à 0,54 $ par tâche réussie, contre 77,4 % à 0,84 $ pour Sonnet 5 avec son effort par défaut, malgré un prix au token cinq fois plus haut. D'autres tâches inversent le classement : aucune grille ne prédit à elle seule le gagnant.
Coût mesuré par question et par modèle
Le tableau suivant mesure ces deux facteurs dans un vrai dépôt : les mêmes questions d'une ligne posées via Claude Code à chaque modèle, trois fois chacune, au coût que Claude Code rapporte lui-même aux tarifs publics API. Les tokens d'entrée y sont pondérés : une lecture du cache compte pour un dixième de token frais, tarif de la plupart des modèles. Le tableau montre aussi les mêmes questions envoyées via capsul au même modèle ; la méthode complète figure sur la page du banc d'essai.
| Modèle | Entrée seule | Entrée avec capsul | Coût seul | Coût avec capsul | Entrée en moins |
|---|---|---|---|---|---|
| Claude Haiku 4.5 | 55 500 | 19 300 | 0,0812 $US | 0,0265 $US | x2.88 |
| Claude Sonnet 5 | 54 200 | 18 900 | 0,153 $US | 0,0487 $US | x2.86 |
| Claude Sonnet 4.6 | 31 400 | 16 600 | 0,139 $US | 0,0613 $US | x1.89 |
| Claude Opus 4.6 | 45 700 | 16 400 | 0,332 $US | 0,101 $US | x2.78 |
| Claude Opus 4.7 | 38 700 | 20 100 | 0,28 $US | 0,126 $US | x1.92 |
| Claude Opus 4.8 | 65 800 | 13 800 | 0,498 $US | 0,0825 $US | x4.75 |
| Claude Opus 5 | 45 300 | 16 200 | 0,343 $US | 0,101 $US | x2.80 |
| Claude Opus 5.5 | 42 300 | 15 900 | 0,222 $US | 0,0696 $US | x2.66 |
| Claude Fable 5 | 41 400 | 17 600 | 0,633 $US | 0,219 $US | x2.35 |
| Claude Fable 5.1 | 49 700 | 23 400 | 0,636 $US | 0,279 $US | x2.12 |
Pour lire le tableau :
- Commencez par Claude Code seul : le coût de ses réponses sur chaque modèle, à son tarif public.
- Comparez les modèles de même grille. Opus 4.6, 4.7, 4.8 et Opus 5 coûtent tous 5 $ en entrée et 25 $ en sortie par million. Les écarts entre eux viennent donc des tokens, pas du tarif, et ils sont importants dans ces données. Le banc de code d'Anthropic montre le même phénomène.
- Comparez les dollars entre générations, pas les tokens. Depuis 4.7, le même texte compte davantage de tokens ; les comptes bruts avantagent artificiellement Haiku 4.5, Sonnet 4.6 et Opus 4.6.
- Lisez le coût avec les vérifications de réponse. Une ligne peu chère par question qui retrouve moins d'éléments attendus n'est pas peu chère par bonne réponse.
- Ne supposez pas que le tarif inférieur gagne. Sonnet 5 affiche un prix au token inférieur à Sonnet 4.6, mais dans cette campagne il coûte davantage sur Claude Code seul, car il a dépensé plus de tokens. Sur le banc de code d'Anthropic, la baisse de tarif l'emporte. Même paire de modèles, autre travail, autre résultat.
Le tokeniseur a changé avec Claude 4.7
Selon la page tarifaire d'Anthropic, Claude 4.7 et les modèles suivants utilisent un nouveau tokeniseur qui produit environ 30 % de tokens de plus pour le même texte, avec une variation selon le contenu. Dans le tableau, cela touche Opus 4.7, 4.8, 5 et 5.5, Sonnet 5 et les deux Fable. Opus 4.6, Sonnet 4.6 et Haiku 4.5 utilisent l'ancien.
Une comparaison au token de part et d'autre de ce changement n'est donc pas homogène. Le même prompt est déjà plus long en tokens sur les modèles récents avant qu'ils n'agissent. Anthropic conseille de comparer le coût par tâche résolue.
L'effort est un deuxième réglage
Pour un même modèle, l'effort influe sur le temps de réflexion, le nombre d'appels d'outils et la longueur de sortie. Les niveaux vont de low à max, avec medium, high et xhigh. Un effort plus faible tend à réduire les appels et la réflexion, facturée au tarif de sortie.
En septembre 2026, Claude Code règle par défaut les modèles compatibles sur high, sauf Opus 5.5 sur medium et Opus 4.7 sur xhigh. Comparer Sonnet 5 et Opus 5.5 à leurs réglages par défaut n'isole donc pas le modèle. Haiku 4.5 n'a pas de réglage d'effort. Opus 5.5 et Fable réfléchissent toujours ; on règle leur profondeur plutôt que de couper la réflexion.
Anthropic décrit Sonnet 5 à medium comme comparable à Sonnet 4.6 à high. Elle constate que les longues tâches de code bénéficient réellement d'un effort accru, alors que les niveaux les plus hauts dépensent inutilement des tokens sur les tâches faciles pour le modèle.
/effort mediumFixe l'effort dans Claude Code ; /effort seul ouvre un curseur.
Quel modèle pour quel travail
- Haiku 4.5 pour les modifications mécaniques : renommage, formatage, changement ciblé que vous vérifierez ou recherche rapide. C'est le moins cher au token, à la moitié du prix de Sonnet 5. Anthropic le réserve surtout aux travaux nombreux aux résultats vérifiables, pas aux longues boucles d'agent. Sa fenêtre compte 200 000 tokens et sa disponibilité n'est promise que jusqu'au 15 octobre 2026 au minimum : vérifiez les dépréciations avant d'en dépendre.
- Sonnet 5 pour le quotidien. La documentation Claude Code lui attribue la plupart des tâches de code à moindre prix qu'Opus. Au token, il coûte la moitié d'Opus 5.5 sauf en lecture du cache, où les deux sont à égalité.
- Opus pour les problèmes difficiles : refonte de plusieurs modules, débogage délicat et décisions d'architecture. Opus 5.5 est aussi le modèle par défaut de Claude Code sur Pro, Max, Team, Enterprise et l'API en septembre 2026 : sans choix explicite, c'est celui que vous utilisez.
- Fable pour les tâches les plus difficiles ou longues. C'est le plus cher au token, même si le guide d'Anthropic propose de commencer Fable 5.1 à
lowpuis de monter l'effort là où il échoue. Selon le plan et le siège, Claude Code peut décompter Fable des crédits d'usage plutôt que des limites incluses ; le sélecteur/modell'indique.
Changer de modèle dans Claude Code
Dans une session, /model suivi d'un alias change immédiatement de modèle ; /model seul ouvre un sélecteur où les flèches règlent aussi l'effort. claude --model choisit le modèle au lancement. Le champ model des réglages ou la variable ANTHROPIC_MODEL rendent ce choix permanent. Les alias principaux sont haiku, sonnet, opus, fable et opusplan, qui utilise Opus en mode plan puis Sonnet en exécution.
/model sonnetPasse la session au dernier Sonnet.
claude --model haikuDémarre une session sur Haiku.
Changez au début d'une tâche, pas au milieu. Chaque modèle possède son cache ; après un changement, la requête suivante relit toute la conversation sans lecture du cache. Claude Code demande confirmation si le cache est encore actif. Chaque bascule du mode plan sous opusplan a ce coût, tout comme un changement d'effort sur la plupart des modèles. Pour les sous-agents chargés de tâches simples, Anthropic suggère model: haiku.
Si votre objectif est de réduire ce que porte chaque question, plutôt que le prix d'un token, capsul accepte les mêmes noms de modèle et envoie de courts extraits utiles à la demande. Sa colonne dans le tableau en donne la mesure.
capsul ask 'rename userId to accountId in the auth module' --model haikuPilote le CLI Claude auquel vous êtes déjà connecté, sur le modèle choisi.
Questions
Claude Opus vaut-il son prix pour coder ?
Souvent sur les problèmes difficiles : un modèle plus capable peut finir avec moins de tours, de recherches et de corrections. Sur les modifications ordinaires, on paie surtout une profondeur inutile. En septembre 2026, Opus 5.5 est le modèle par défaut de Claude Code sur Pro, Max, Team, Enterprise et l'API ; vérifiez /model avant de supposer que vous utilisez moins cher.
Quel est le modèle Claude le moins cher pour coder ?
Au token, Haiku 4.5 : en septembre 2026, l'API Anthropic le facture 1 $ par million de tokens d'entrée et 5 $ de sortie. Par tâche, cela dépend des tokens dépensés et de la justesse, car une mauvaise réponse suivie d'une correction se paie deux fois. Anthropic le destine aux travaux nombreux et vérifiables, plutôt qu'à toutes les longues tâches d'agent.
Claude Sonnet 5 coûte-t-il moins cher qu'Opus 5.5 ?
Au token, Sonnet 5 coûte moitié moins en entrée fraîche, écriture du cache et sortie en septembre 2026. La lecture du cache est au même tarif pour les deux : 0,20 $ par million. Comme cette lecture occupe une grande part de l'usage d'un agent, l'écart réel est moindre que celui des prix affichés. Le moins cher par tâche dépend ensuite du nombre de tours et de tokens nécessaires.
Pourquoi un même prompt utilise-t-il plus de tokens sur les nouveaux Claude ?
Selon Anthropic, Claude 4.7 et les modèles suivants utilisent un nouveau tokeniseur qui produit environ 30 % de tokens de plus pour le même texte, selon son contenu. Opus 4.6, Sonnet 4.6 et Haiku 4.5 utilisent l'ancien. Comparez le coût par tâche plutôt que les comptes bruts : ces derniers désavantagent les modèles récents avant même qu'ils commencent à travailler.
Le niveau d'effort change-t-il le coût d'une tâche ?
Oui. Il règle la réflexion, les appels d'outils et la longueur de sortie ; la réflexion est facturée au tarif de sortie. Dans Claude Code, /effort ou les flèches de /model le modifient. En septembre 2026, la plupart des modèles démarrent sur high, Opus 5.5 sur medium, et Haiku 4.5 n'offre pas ce réglage.
$ npm i -g @penra/capsul