Claude Sonnet 5 dans Claude Code : tokens par question

Sonnet occupe le milieu de la gamme Claude pour les tâches de code qui exigent plus de jugement qu'une simple recherche.

Les chiffres

Claude Code seul
54 200

tokens d'entrée pondérés par le cache par question

Avec capsul
18 900

tokens d'entrée pondérés par le cache par question

d'entrée envoyée en moins
x2.86

Intervalle à 90 % : x2.02 à x4.52

réponses vérifiées sur cinq, sans puis avec capsul
4 / 4
étapes d'outil par question, sans puis avec capsul
3,2 / 3,2
tokens de sortie par question, sans puis avec capsul
1 640 / 551
coût équivalent API par question, sans puis avec capsul
0,153 $US / 0,0487 $US

Cette version affiche un tarif public API inférieur à celui de l'ancienne ligne Sonnet du site. Elle mérite d'être envisagée pour l'implémentation courante, les tests et la revue de code quand Haiku demande trop de guidage et qu'Opus serait un choix coûteux par défaut. Le tableau des tarifs distingue l'entrée fraîche, l'entrée lue dans le cache et la sortie, qui n'évoluent pas forcément ensemble.

Le banc pose les mêmes questions courtes sur un dépôt aux deux bras. Les colonnes de tokens et de vérification des réponses permettent de juger ce type de travail. Une refonte longue ou un code peu familier peuvent demander une autre exploration : le gain mesuré est un repère, pas une promesse pour toute session.

Question par question

Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 3 fois par bras. Entrée pondérée par question, moyenne des répétitions.

QuestionSans capsulcapsulEntrée en moinsRéponses correctes, sans / avec capsul
Q174 10021 900x3.380 / 0
Q246 40024 100x1.922 / 3
Q333 10011 700x2.843 / 3
Q482 60021 900x3.773 / 3
Q534 70015 100x2.303 / 3

Tarifs publics

ModèleEntréeSortieLecture du cacheÉcriture cache 5 minÉcriture cache 1 hContexte
Claude Haiku 4.51,005,000,101,252,00200 000
Claude Sonnet 52,0010,000,202,504,001 000 000
Claude Sonnet 4.63,0015,000,303,756,001 000 000
Claude Opus 4.65,0025,000,506,2510,001 000 000
Claude Opus 4.75,0025,000,506,2510,001 000 000
Claude Opus 4.85,0025,000,506,2510,001 000 000
Claude Opus 55,0025,000,506,2510,001 000 000
Claude Opus 5.54,0020,000,205,008,001 000 000
Claude Fable 510,0050,001,0012,5020,001 000 000
Claude Fable 5.110,0050,000,2512,5020,001 000 000
Tarifs publics de l'API Claude Anthropic, en dollars US par million de tokens, vérifiés le 23 septembre 2026.

Tarifs publics d'Anthropic, vérifiés le 23 septembre 2026.

Comment ces mesures ont été faites

Deux bras sur le même modèle : Claude Code tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 22 septembre 2026, 3 répétitions par question et par bras.

30 / 30 cells · /benchmarks/2026-09-22-claude.json

Questions

Combien de tokens Claude Sonnet 5 utilise-t-il par question dans Claude Code ?

Dans le banc du 22 septembre 2026, une session Claude Code sans capsul sur Claude Sonnet 5 a envoyé en moyenne 54 200 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 18 900.

Combien coûte une question de code avec Claude Sonnet 5 ?

Aux tarifs publics d'Anthropic, le trafic de l'agent seul équivaut à 0,153 $US par question, contre 0,0487 $US avec capsul. Un abonnement Claude ne facture pas au token : ces montants servent à comparer la consommation entre modèles.

L'économie mesurée sur Claude Sonnet 5 est-elle établie ?

Oui. L'intervalle à 90 % va de x2.02 à x4.52, entièrement au-dessus de un, sur 30 cellules mesurées.

capsul change-t-il les réponses de Claude Sonnet 5 ?

Pas dans ce protocole : Claude Sonnet 5 a passé 4 vérifications sur cinq sans capsul et 4 sur cinq avec capsul.