Claude Sonnet 4.6 dans Claude Code : tokens par question
Cette version antérieure de Sonnet sert de référence pour comparer les modèles Claude du milieu de gamme sur le code.
Les chiffres
- Claude Code seul
- 31 400
- Avec capsul
- 16 600
- d'entrée envoyée en moins
- x1.89
- réponses vérifiées sur cinq, sans puis avec capsul
- 4 / 4
- étapes d'outil par question, sans puis avec capsul
- 3,8 / 3
- tokens de sortie par question, sans puis avec capsul
- 748 / 344
- coût équivalent API par question, sans puis avec capsul
- 0,139 $US / 0,0613 $US
tokens d'entrée pondérés par le cache par question
tokens d'entrée pondérés par le cache par question
Intervalle à 90 % : x1.30 à x2.79
Son tarif public API dépasse celui de la version Sonnet plus récente. Si vous utilisez encore cette version pour sa compatibilité ou parce qu'elle est disponible sur votre compte, le coût pertinent combine son tarif et l'entrée réellement envoyée par l'agent. Un nombre de tokens inférieur sur un autre modèle ne dit pas à lui seul lequel termine mieux la tâche.
Les questions ci-dessous montrent la quantité de contexte envoyée par l'agent seul et par capsul sur les mêmes tâches du dépôt. Lisez les vérifications de réponse avec l'intervalle de tokens. Elles évitent de confondre une exécution apparemment moins chère avec une meilleure exécution lorsqu'elle n'a pas trouvé les éléments nécessaires.
Question par question
Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 3 fois par bras. Entrée pondérée par question, moyenne des répétitions.
| Question | Sans capsul | capsul | Entrée en moins | Réponses correctes, sans / avec capsul |
|---|---|---|---|---|
| Q1 | 41 100 | 20 500 | x2.01 | 0 / 0 |
| Q2 | 32 400 | 24 700 | x1.31 | 2 / 3 |
| Q3 | 23 000 | 9 500 | x2.42 | 3 / 3 |
| Q4 | 35 600 | 16 300 | x2.18 | 3 / 2 |
| Q5 | 24 900 | 12 200 | x2.05 | 3 / 3 |
Tarifs publics
| Modèle | Entrée | Sortie | Lecture du cache | Écriture cache 5 min | Écriture cache 1 h | Contexte |
|---|---|---|---|---|---|---|
| Claude Haiku 4.5 | 1,00 | 5,00 | 0,10 | 1,25 | 2,00 | 200 000 |
| Claude Sonnet 5 | 2,00 | 10,00 | 0,20 | 2,50 | 4,00 | 1 000 000 |
| Claude Sonnet 4.6 | 3,00 | 15,00 | 0,30 | 3,75 | 6,00 | 1 000 000 |
| Claude Opus 4.6 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1 000 000 |
| Claude Opus 4.7 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1 000 000 |
| Claude Opus 4.8 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1 000 000 |
| Claude Opus 5 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1 000 000 |
| Claude Opus 5.5 | 4,00 | 20,00 | 0,20 | 5,00 | 8,00 | 1 000 000 |
| Claude Fable 5 | 10,00 | 50,00 | 1,00 | 12,50 | 20,00 | 1 000 000 |
| Claude Fable 5.1 | 10,00 | 50,00 | 0,25 | 12,50 | 20,00 | 1 000 000 |
Tarifs publics d'Anthropic, vérifiés le 23 septembre 2026.
Comment ces mesures ont été faites
Deux bras sur le même modèle : Claude Code tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 22 septembre 2026, 3 répétitions par question et par bras.
30 / 30 cells · /benchmarks/2026-09-22-claude.json
Questions
Combien de tokens Claude Sonnet 4.6 utilise-t-il par question dans Claude Code ?
Dans le banc du 22 septembre 2026, une session Claude Code sans capsul sur Claude Sonnet 4.6 a envoyé en moyenne 31 400 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 16 600.
Combien coûte une question de code avec Claude Sonnet 4.6 ?
Aux tarifs publics d'Anthropic, le trafic de l'agent seul équivaut à 0,139 $US par question, contre 0,0613 $US avec capsul. Un abonnement Claude ne facture pas au token : ces montants servent à comparer la consommation entre modèles.
L'économie mesurée sur Claude Sonnet 4.6 est-elle établie ?
Oui. L'intervalle à 90 % va de x1.30 à x2.79, entièrement au-dessus de un, sur 30 cellules mesurées.
capsul change-t-il les réponses de Claude Sonnet 4.6 ?
Pas dans ce protocole : Claude Sonnet 4.6 a passé 4 vérifications sur cinq sans capsul et 4 sur cinq avec capsul.