Claude Opus 4.8 dans Claude Code : tokens par question

Cette version ultérieure d'Opus est une option plus chère pour les tâches de code qui exigent une exploration étendue.

Les chiffres

Claude Code seul
65 800

tokens d'entrée pondérés par le cache par question

Avec capsul
13 800

tokens d'entrée pondérés par le cache par question

d'entrée envoyée en moins
x4.75

Intervalle à 90 % : x3.00 à x8.75

réponses vérifiées sur cinq, sans puis avec capsul
5 / 4
étapes d'outil par question, sans puis avec capsul
3,4 / 2,2
tokens de sortie par question, sans puis avec capsul
3 040 / 322
coût équivalent API par question, sans puis avec capsul
0,498 $US / 0,0825 $US

Son tarif public API est le même que celui des autres anciennes versions d'Opus présentées ici. Pour les comparer, le nombre de tokens et les vérifications de réponse en disent plus que le seul nom de la gamme. Un agent qui ouvre des fichiers supplémentaires et relit les sorties d'outils précédentes peut renchérir même une tâche en apparence modeste.

Ces mesures viennent de questions brèves posées sur un vrai dépôt. Elles montrent ce qui s'est passé dans ce protocole, y compris les différences entre questions. Pour une migration ou une longue revue, mesurez votre propre travail avant de projeter l'économie affichée sur toute une session.

Question par question

Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 3 fois par bras. Entrée pondérée par question, moyenne des répétitions.

QuestionSans capsulcapsulEntrée en moinsRéponses correctes, sans / avec capsul
Q181 70012 100x6.772 / 0
Q264 80020 900x3.112 / 3
Q343 80010 400x4.203 / 3
Q495 20013 400x7.113 / 3
Q543 40012 500x3.483 / 3

Tarifs publics

ModèleEntréeSortieLecture du cacheÉcriture cache 5 minÉcriture cache 1 hContexte
Claude Haiku 4.51,005,000,101,252,00200 000
Claude Sonnet 52,0010,000,202,504,001 000 000
Claude Sonnet 4.63,0015,000,303,756,001 000 000
Claude Opus 4.65,0025,000,506,2510,001 000 000
Claude Opus 4.75,0025,000,506,2510,001 000 000
Claude Opus 4.85,0025,000,506,2510,001 000 000
Claude Opus 55,0025,000,506,2510,001 000 000
Claude Opus 5.54,0020,000,205,008,001 000 000
Claude Fable 510,0050,001,0012,5020,001 000 000
Claude Fable 5.110,0050,000,2512,5020,001 000 000
Tarifs publics de l'API Claude Anthropic, en dollars US par million de tokens, vérifiés le 23 septembre 2026.

Tarifs publics d'Anthropic, vérifiés le 23 septembre 2026.

Comment ces mesures ont été faites

Deux bras sur le même modèle : Claude Code tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 22 septembre 2026, 3 répétitions par question et par bras.

30 / 30 cells · /benchmarks/2026-09-22-claude.json

Questions

Combien de tokens Claude Opus 4.8 utilise-t-il par question dans Claude Code ?

Dans le banc du 22 septembre 2026, une session Claude Code sans capsul sur Claude Opus 4.8 a envoyé en moyenne 65 800 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 13 800.

Combien coûte une question de code avec Claude Opus 4.8 ?

Aux tarifs publics d'Anthropic, le trafic de l'agent seul équivaut à 0,498 $US par question, contre 0,0825 $US avec capsul. Un abonnement Claude ne facture pas au token : ces montants servent à comparer la consommation entre modèles.

L'économie mesurée sur Claude Opus 4.8 est-elle établie ?

Oui. L'intervalle à 90 % va de x3.00 à x8.75, entièrement au-dessus de un, sur 30 cellules mesurées.

capsul change-t-il les réponses de Claude Opus 4.8 ?

Il en a passé moins : 5 sur cinq sans capsul, 4 sur cinq avec capsul. Le banc publie ce résultat au lieu de l'omettre.