Claude Sonnet 4.6 dans Claude Code : tokens par question

Cette version antérieure de Sonnet sert de référence pour comparer les modèles Claude du milieu de gamme sur le code.

Les chiffres

Claude Code seul
31 400

tokens d'entrée pondérés par le cache par question

Avec capsul
16 600

tokens d'entrée pondérés par le cache par question

d'entrée envoyée en moins
x1.89

Intervalle à 90 % : x1.30 à x2.79

réponses vérifiées sur cinq, sans puis avec capsul
4 / 4
étapes d'outil par question, sans puis avec capsul
3,8 / 3
tokens de sortie par question, sans puis avec capsul
748 / 344
coût équivalent API par question, sans puis avec capsul
0,139 $US / 0,0613 $US

Son tarif public API dépasse celui de la version Sonnet plus récente. Si vous utilisez encore cette version pour sa compatibilité ou parce qu'elle est disponible sur votre compte, le coût pertinent combine son tarif et l'entrée réellement envoyée par l'agent. Un nombre de tokens inférieur sur un autre modèle ne dit pas à lui seul lequel termine mieux la tâche.

Les questions ci-dessous montrent la quantité de contexte envoyée par l'agent seul et par capsul sur les mêmes tâches du dépôt. Lisez les vérifications de réponse avec l'intervalle de tokens. Elles évitent de confondre une exécution apparemment moins chère avec une meilleure exécution lorsqu'elle n'a pas trouvé les éléments nécessaires.

Question par question

Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 3 fois par bras. Entrée pondérée par question, moyenne des répétitions.

QuestionSans capsulcapsulEntrée en moinsRéponses correctes, sans / avec capsul
Q141 10020 500x2.010 / 0
Q232 40024 700x1.312 / 3
Q323 0009 500x2.423 / 3
Q435 60016 300x2.183 / 2
Q524 90012 200x2.053 / 3

Tarifs publics

ModèleEntréeSortieLecture du cacheÉcriture cache 5 minÉcriture cache 1 hContexte
Claude Haiku 4.51,005,000,101,252,00200 000
Claude Sonnet 52,0010,000,202,504,001 000 000
Claude Sonnet 4.63,0015,000,303,756,001 000 000
Claude Opus 4.65,0025,000,506,2510,001 000 000
Claude Opus 4.75,0025,000,506,2510,001 000 000
Claude Opus 4.85,0025,000,506,2510,001 000 000
Claude Opus 55,0025,000,506,2510,001 000 000
Claude Opus 5.54,0020,000,205,008,001 000 000
Claude Fable 510,0050,001,0012,5020,001 000 000
Claude Fable 5.110,0050,000,2512,5020,001 000 000
Tarifs publics de l'API Claude Anthropic, en dollars US par million de tokens, vérifiés le 23 septembre 2026.

Tarifs publics d'Anthropic, vérifiés le 23 septembre 2026.

Comment ces mesures ont été faites

Deux bras sur le même modèle : Claude Code tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 22 septembre 2026, 3 répétitions par question et par bras.

30 / 30 cells · /benchmarks/2026-09-22-claude.json

Questions

Combien de tokens Claude Sonnet 4.6 utilise-t-il par question dans Claude Code ?

Dans le banc du 22 septembre 2026, une session Claude Code sans capsul sur Claude Sonnet 4.6 a envoyé en moyenne 31 400 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 16 600.

Combien coûte une question de code avec Claude Sonnet 4.6 ?

Aux tarifs publics d'Anthropic, le trafic de l'agent seul équivaut à 0,139 $US par question, contre 0,0613 $US avec capsul. Un abonnement Claude ne facture pas au token : ces montants servent à comparer la consommation entre modèles.

L'économie mesurée sur Claude Sonnet 4.6 est-elle établie ?

Oui. L'intervalle à 90 % va de x1.30 à x2.79, entièrement au-dessus de un, sur 30 cellules mesurées.

capsul change-t-il les réponses de Claude Sonnet 4.6 ?

Pas dans ce protocole : Claude Sonnet 4.6 a passé 4 vérifications sur cinq sans capsul et 4 sur cinq avec capsul.