Claude Haiku 4.5 dans Claude Code : tokens par question

Haiku est le modèle Claude le plus léger de cette comparaison. Il convient aux questions de code ciblées qui demandent une réponse courte.

Les chiffres

Claude Code seul
55 500

tokens d'entrée pondérés par le cache par question

Avec capsul
19 300

tokens d'entrée pondérés par le cache par question

d'entrée envoyée en moins
x2.88

Intervalle à 90 % : x1.62 à x4.49

réponses vérifiées sur cinq, sans puis avec capsul
2 / 4
étapes d'outil par question, sans puis avec capsul
2,4 / 4,4
tokens de sortie par question, sans puis avec capsul
2 710 / 444
coût équivalent API par question, sans puis avec capsul
0,0812 $US / 0,0265 $US

Son tarif public API est le plus bas du groupe Claude. Il peut servir à retrouver une fonction, expliquer l'échec d'un test ou faire une petite modification bien délimitée. Même un modèle peu coûteux peut consommer beaucoup si l'agent lit de nombreux fichiers avant de répondre : comparez la colonne d'entrée, pas seulement le prompt.

L'intervalle mesuré compte particulièrement ici. Cette ligne ne prouve pas que capsul réduit l'entrée sur chaque question posée à Haiku. Examinez les résultats par question et les vérifications de réponse avant de le choisir pour un travail répété souvent.

Question par question

Cinq questions d'une ligne sur un vrai dépôt TypeScript, chacune posée 3 fois par bras. Entrée pondérée par question, moyenne des répétitions.

QuestionSans capsulcapsulEntrée en moinsRéponses correctes, sans / avec capsul
Q157 70018 000x3.201 / 1
Q253 60024 800x2.161 / 3
Q318 20010 700x1.700 / 3
Q4118 00030 600x3.873 / 3
Q529 70012 200x2.433 / 3

Tarifs publics

ModèleEntréeSortieLecture du cacheÉcriture cache 5 minÉcriture cache 1 hContexte
Claude Haiku 4.51,005,000,101,252,00200 000
Claude Sonnet 52,0010,000,202,504,001 000 000
Claude Sonnet 4.63,0015,000,303,756,001 000 000
Claude Opus 4.65,0025,000,506,2510,001 000 000
Claude Opus 4.75,0025,000,506,2510,001 000 000
Claude Opus 4.85,0025,000,506,2510,001 000 000
Claude Opus 55,0025,000,506,2510,001 000 000
Claude Opus 5.54,0020,000,205,008,001 000 000
Claude Fable 510,0050,001,0012,5020,001 000 000
Claude Fable 5.110,0050,000,2512,5020,001 000 000
Tarifs publics de l'API Claude Anthropic, en dollars US par million de tokens, vérifiés le 23 septembre 2026.

Tarifs publics d'Anthropic, vérifiés le 23 septembre 2026.

Comment ces mesures ont été faites

Deux bras sur le même modèle : Claude Code tel qu'on l'utilise habituellement, puis la même question avec capsul. L'unité est l'entrée pondérée par le cache : tokens frais à plein poids, lectures du cache au dixième. Campagne du 22 septembre 2026, 3 répétitions par question et par bras.

30 / 30 cells · /benchmarks/2026-09-22-claude.json

Questions

Combien de tokens Claude Haiku 4.5 utilise-t-il par question dans Claude Code ?

Dans le banc du 22 septembre 2026, une session Claude Code sans capsul sur Claude Haiku 4.5 a envoyé en moyenne 55 500 tokens d'entrée pondérés par le cache par question de code en une ligne. Avec capsul sur le même modèle : 19 300.

Combien coûte une question de code avec Claude Haiku 4.5 ?

Aux tarifs publics d'Anthropic, le trafic de l'agent seul équivaut à 0,0812 $US par question, contre 0,0265 $US avec capsul. Un abonnement Claude ne facture pas au token : ces montants servent à comparer la consommation entre modèles.

L'économie mesurée sur Claude Haiku 4.5 est-elle établie ?

Oui. L'intervalle à 90 % va de x1.62 à x4.49, entièrement au-dessus de un, sur 30 cellules mesurées.

capsul change-t-il les réponses de Claude Haiku 4.5 ?

Il en a passé davantage : 2 sur cinq sans capsul, 4 sur cinq avec capsul. Cinq vérifications restent un petit échantillon : il faut y voir une absence de perte, pas un gain établi.