Claude Haiku 4.5 in Claude Code: Tokens pro Frage
Haiku ist das leichteste Claude-Modell in diesem Vergleich und eignet sich für gezielte Coding-Fragen, bei denen eine kurze Antwort genügt.
Die Messwerte
- Claude Code allein
- 55.500
- Mit capsul
- 19.300
- weniger gesendete Eingabe
- x2.88
- bestandene Antwortprüfungen von fünf, ohne und mit capsul
- 2 / 4
- Werkzeugschritte pro Frage, ohne und mit capsul
- 2,4 / 4,4
- Ausgabetokens pro Frage, ohne und mit capsul
- 2.710 / 444
- API-Äquivalentkosten pro Frage, ohne und mit capsul
- 0,0812 $ / 0,0265 $
cachegewichtete Eingabetokens pro Frage
cachegewichtete Eingabetokens pro Frage
90-%-Intervall: x1.62 bis x4.49
Sein API-Listenpreis ist der niedrigste in der Claude-Gruppe. Es bietet sich an, eine Funktion zu finden, einen fehlgeschlagenen Test zu erklären oder eine kleine, klar begrenzte Änderung vorzunehmen. Auch ein günstiges Modell kann viel verbrauchen, wenn der Agent vor der Antwort viele Dateien liest. Vergleichen Sie deshalb die Eingabespalte und nicht nur den Prompt.
Das gemessene Intervall ist hier besonders wichtig. Diese Zeile belegt keine Eingabeersparnis durch capsul bei jeder Haiku-Frage. Sehen Sie sich die Ergebnisse je Frage und die Antwortprüfungen an, bevor Sie es für einen häufig wiederholten Ablauf wählen.
Frage für Frage
Fünf einzeilige Fragen zu einem echten TypeScript-Projekt, je 3 Mal pro Arm gestellt. Gewichtete Eingabe pro Frage als Mittelwert der Wiederholungen.
| Frage | Ohne capsul | capsul | Weniger Eingabe | Korrekte Läufe, ohne / mit capsul |
|---|---|---|---|---|
| F1 | 57.700 | 18.000 | x3.20 | 1 / 1 |
| F2 | 53.600 | 24.800 | x2.16 | 1 / 3 |
| F3 | 18.200 | 10.700 | x1.70 | 0 / 3 |
| F4 | 118.000 | 30.600 | x3.87 | 3 / 3 |
| F5 | 29.700 | 12.200 | x2.43 | 3 / 3 |
Listenpreise
| Modell | Eingabe | Ausgabe | Cache-Lesezugriff | Cache-Schreibzugriff 5 Min. | Cache-Schreibzugriff 1 Std. | Kontext |
|---|---|---|---|---|---|---|
| Claude Haiku 4.5 | 1,00 | 5,00 | 0,10 | 1,25 | 2,00 | 200.000 |
| Claude Sonnet 5 | 2,00 | 10,00 | 0,20 | 2,50 | 4,00 | 1.000.000 |
| Claude Sonnet 4.6 | 3,00 | 15,00 | 0,30 | 3,75 | 6,00 | 1.000.000 |
| Claude Opus 4.6 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1.000.000 |
| Claude Opus 4.7 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1.000.000 |
| Claude Opus 4.8 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1.000.000 |
| Claude Opus 5 | 5,00 | 25,00 | 0,50 | 6,25 | 10,00 | 1.000.000 |
| Claude Opus 5.5 | 4,00 | 20,00 | 0,20 | 5,00 | 8,00 | 1.000.000 |
| Claude Fable 5 | 10,00 | 50,00 | 1,00 | 12,50 | 20,00 | 1.000.000 |
| Claude Fable 5.1 | 10,00 | 50,00 | 0,25 | 12,50 | 20,00 | 1.000.000 |
Anthropic-Listenpreise, geprüft am 23. September 2026.
So wurde gemessen
Zwei Arme mit demselben Modell: Claude Code im normalen Einsatz und dieselbe Frage über capsul. Die Einheit ist cachegewichtete Eingabe: frische Tokens mit vollem Gewicht, Cache-Lesezugriffe mit einem Zehntel. Kampagne vom 22. September 2026, 3 Wiederholungen je Frage und Arm.
30 / 30 cells · /benchmarks/2026-09-22-claude.json
Fragen
Wie viele Tokens nutzt Claude Haiku 4.5 pro Frage in Claude Code?
Im Benchmark vom 22. September 2026 sendete eine Claude Code-Sitzung ohne capsul mit Claude Haiku 4.5 im Mittel 55.500 cachegewichtete Eingabetokens pro einzeiliger Coding-Frage. Mit capsul auf demselben Modell waren es 19.300.
Was kostet eine Coding-Frage mit Claude Haiku 4.5?
Zu Anthropic-Listenpreisen entsprach der Datenverkehr des Agenten allein 0,0812 $ pro Frage, mit capsul 0,0265 $. Ein Claude-Abo rechnet nicht pro Token ab: Diese Beträge helfen, den Verbrauch verschiedener Modelle zu vergleichen.
Ist die Einsparung bei Claude Haiku 4.5 belegt?
Ja. Das 90-%-Intervall reicht von x1.62 bis x4.49 und liegt vollständig über eins, bei 30 gemessenen Zellen.
Verändert capsul die Antworten von Claude Haiku 4.5?
Es bestand mehr Prüfungen: 2 von fünf ohne capsul, 4 von fünf mit capsul. Fünf Prüfungen sind eine kleine Stichprobe: Das zeigt keinen Verlust, aber keinen belegten Gewinn.