Claude Opus, Sonnet und Haiku: Kosten pro Coding-Aufgabe

Der Preis pro Million Tokens erklärt nur einen Teil der Kosten einer Coding-Aufgabe. Entscheidend ist auch, wie viele Tokens ein Modell bis zum Abschluss verbraucht. Das steht in keiner Preisliste.

Die Rechnung eines Programmieragenten für eine Aufgabe besteht aus zwei miteinander multiplizierten Zahlen: dem Preis eines Tokens für das von Ihnen ausgewählte Modell und der Anzahl der Token, die das Modell ausgibt, bevor es erledigt ist. Die Preisliste gibt Ihnen das Erste. Der zweite hängt davon ab, wie das Modell funktioniert.

Ein Modell, das doppelt so viel pro Token kostet und die Hälfte der Token einbringt, kostet genauso viel. Ein Modell, das pro Token günstiger ist, aber drei zusätzliche Dateien liest oder falsch antwortet und erneut gefragt werden muss, kann mehr kosten.

Die Listenpreise, Stand September 2026

Anthropic berechnet für jedes Modell eine Million Token mit separaten Tarifen für neue Eingaben, Cache-Schreibvorgänge, Cache-Lesevorgänge und -Ausgaben. Dies sind die API-Listenpreise mit Stand September 2026.

ModellEingabeAusgabeCache-LesezugriffCache-Schreibzugriff 5 Min.Cache-Schreibzugriff 1 Std.Kontext
Claude Haiku 4.51,005,000,101,252,00200.000
Claude Sonnet 52,0010,000,202,504,001.000.000
Claude Sonnet 4.63,0015,000,303,756,001.000.000
Claude Opus 4.65,0025,000,506,2510,001.000.000
Claude Opus 4.75,0025,000,506,2510,001.000.000
Claude Opus 4.85,0025,000,506,2510,001.000.000
Claude Opus 55,0025,000,506,2510,001.000.000
Claude Opus 5.54,0020,000,205,008,001.000.000
Claude Fable 510,0050,001,0012,5020,001.000.000
Claude Fable 5.110,0050,000,2512,5020,001.000.000
Anthropics Claude-API-Listenpreise in US-Dollar pro Million Tokens, geprüft am 23. September 2026.

Drei Dinge in dieser Tabelle sind für einen Coding-Agenten wichtiger als der Haupteingabepreis:

  • Cache liest. Ein Agent sendet die gesamte Konversation bei jeder Runde erneut und der größte Teil kommt aus dem Prompt-Cache zurück. Dies ist also der Preis, den die meisten Ihrer Eingabe-Tokens zahlen. Die meisten Modelle lesen den Cache zu einem Zehntel ihres Eingabepreises und Fable 5.1 zu einem Vierzigstel; Opus 5.5 liest es mit einem Zwanzigstel, 0,20 $ pro Million Token, genau der Rate von Sonnet 5.
  • Output, Denken inklusive. Der Output kostet bei jedem Modell das Fünffache des Inputs, und Denktoken werden als Output abgerechnet.
  • Der Preis von Sonnet 5. Als Einführungspreise wurden die 2- und 10-Dollar-Preise angekündigt; Anthropic hat sie zum Standard gemacht, und die für den 1. September 2026 geplante Erhöhung auf 3 und 15 US-Dollar ist nicht erfolgt.

Die andere Hälfte: Tokens pro erledigter Aufgabe

Die Token pro Aufgabe variieren je nach Modell aus Gründen, die nichts mit dem Preis zu tun haben. Ein Modell, das mehr erforscht, liest mehr Dateien, bevor es antwortet, und jede gelesene Datei bleibt im Kontext und wird bei jeder späteren Runde erneut bezahlt. Bei einer falschen Antwort werden die Token ausgegeben und beim erneuten Versuch erneut ausgegeben. Ein Modell, das länger denkt, gibt bei der Ausgaberate mehr aus.

Der Kostenleitfaden von Anthropic verdeutlicht das Gleiche von der anderen Seite: Ein leistungsfähigeres Modell ist oft mit weniger Arbeit fertig, was weniger Wendungen, weniger Suchen und weniger Zurückverfolgen bedeutet, und das kann einen höheren Preis pro Token aufwiegen. Auf einer Teilmenge von SWE-bench Pro meldet Fable 5.1 mit geringem Aufwand das Lösen von 88,6 % der Aufgaben zu 0,54 $ pro gelöster Aufgabe, gegenüber 77,4 % bei 0,84 $ für Sonnet 5 in der Standardeinstellung und zum Fünffachen des Preises pro Token. Es zeigt auch Arbeitslasten an, bei denen sich die Rangfolge ändert, und kommt zu dem Schluss, dass keine Preisliste Ihnen sagt, in welche Richtung es gehen wird.

Gemessene Kosten pro Frage, Modell für Modell

Die folgende Tabelle misst beide Hälften in einem realen Repository: die gleichen einzeiligen Fragen, die über Claude Code für jedes Modell gestellt und dreimal wiederholt werden, wobei die Kosten, die Claude Code selbst zu API-Listenpreisen angibt, angegeben werden. Token-Zahlen zählen einen Cache-Lesevorgang als Zehntel eines neuen Tokens, dem Satz, zu dem die meisten Modelle ihn abrechnen. Die Tabelle zeigt auch dieselben Fragen, die über capsul auf demselben Modell gesendet wurden; Auf der Benchmark-Seite wird die Methode erläutert.

ModellEingabe, purEingabe, capsulKosten, purKosten, capsulWeniger Eingabe
Claude Haiku 4.555.50019.3000,0812 $0,0265 $x2.88
Claude Sonnet 554.20018.9000,153 $0,0487 $x2.86
Claude Sonnet 4.631.40016.6000,139 $0,0613 $x1.89
Claude Opus 4.645.70016.4000,332 $0,101 $x2.78
Claude Opus 4.738.70020.1000,28 $0,126 $x1.92
Claude Opus 4.865.80013.8000,498 $0,0825 $x4.75
Claude Opus 545.30016.2000,343 $0,101 $x2.80
Claude Opus 5.542.30015.9000,222 $0,0696 $x2.66
Claude Fable 541.40017.6000,633 $0,219 $x2.35
Claude Fable 5.149.70023.4000,636 $0,279 $x2.12
Claude-Modelle in Claude Code: cachegewichtete Eingabe und API-Äquivalentkosten pro einzeiliger Programmierfrage, purer Agent oder mit capsul. Aus den veröffentlichten Datensätzen berechnet: Claude-Kampagne vom 22. September 2026, Codex-Kampagne vom 4. September 2026.

So lesen Sie es:

  • Beginnen Sie mit Claude Code allein: Was jedes Modell für die Beantwortung ausgegeben hat, zu seinen eigenen Listenpreisen.
  • Vergleichen Sie Zeilen, die eine gemeinsame Preisliste haben. Die Preise für Opus 4.6, 4.7, 4.8 und Opus 5 liegen alle bei 5 bzw. 25 US-Dollar. Daher handelt es sich bei jeder Lücke zwischen ihnen um Token und nicht um den Preis, und zum Zeitpunkt des Verfassens dieses Artikels ist die Lücke groß. Anthropic meldet das gleiche Muster bei seinem eigenen Codierungs-Benchmark.
  • Vergleichen Sie Dollar über Generationen hinweg, nicht Token. Modelle ab 4.7 zählen den gleichen Text als mehr Token (siehe nächster Abschnitt), sodass Token-Zahlen Haiku 4.5, Sonnet 4.6 und Opus 4.6 schmeicheln.
  • Lesen Sie die Kosten neben den Antwortschecks. Eine Zeile, die pro Frage günstig ist, aber weniger der erwarteten Antworten findet, ist pro richtige Antwort nicht günstig.
  • Gehen Sie nicht davon aus, dass der niedrigere Preis gewinnt. Sonnet 5 liegt unterhalb von Sonnet 4.6, doch zum Zeitpunkt des Verfassens dieses Artikels ist es nicht das billigere der beiden allein aufgrund von Claude Code, da für diese Fragen mehr Token ausgegeben wurden. Beim Coding-Benchmark von Anthropic gewinnt stattdessen die Preissenkung, obwohl Sonnet 5 dort auch mehr Token pro Aufgabe verbraucht. Gleiche zwei Modelle, unterschiedliche Arbeit, anderer Gewinner.

Der Tokenizer hat sich mit Claude 4.7 geändert

Auf der Preisseite von Anthropic heißt es, dass Claude 4.7 und spätere Modelle einen neueren Tokenizer verwenden, der etwa 30 % mehr Token für denselben Text erzeugt, wobei die genaue Steigerung vom Inhalt abhängt. Von den oben gemessenen Modellen sind das Opus 4.7, 4.8, 5 und 5.5, Sonnet 5 und beide Fabeln; Opus 4.6, Sonnet 4.6 und Haiku 4.5 verwenden das vorherige.

Ein Vergleich pro Token über diese Linie hinweg ist also kein Gleiches für Gleiches. Die gleiche Eingabeaufforderung besteht bereits bei den neueren Modellen für mehr Token, bevor eines von ihnen irgendeine Arbeit verrichtet, weshalb Anthropic stattdessen empfiehlt, die Kosten pro gelöster Aufgabe zu vergleichen.

Der Denkaufwand ist der zweite Regler

Innerhalb eines Modells entscheidet das Aufwandsniveau darüber, wie viele Token es ausgibt: wie viel es denkt, wie viele Tool-Aufrufe es durchführt und wie viel es schreibt. Die Ebenen reichen von low über medium, high und xhigh bis hin zu max, und geringerer Aufwand bedeutet weniger, knappere Werkzeugaufrufe und weniger Nachdenken, was mit der Ausgaberate abgerechnet wird.

Ab September 2026 führt Claude Code standardmäßig jedes Modell aus, das Aufwand bei high unterstützt, mit Ausnahme von Opus 5.5 bei medium und Opus 4.7 bei xhigh. Daher ist ein Standard-zu-Standard-Vergleich von Sonnet 5 und Opus 5.5 kein Gleiches für Gleiches. Haiku 4.5 hat keine Aufwandseinstellung. Opus 5.5 und die Fable-Modelle denken immer und können das Denken nicht ausschalten, daher ist die Anstrengung die Hauptkontrolle darüber, wie viel sie denken.

Anthropic beschreibt Sonnet 5 bei medium als vergleichbar mit Sonnet 4.6 bei high. Es wird auch berichtet, dass bei langer Codierungsarbeit Genauigkeit wirklich durch Aufwand erkauft wird, während bei Aufgaben, die weit innerhalb der Skills eines Modells liegen, die höchsten Ebenen für die Tiefe zahlen, die die Aufgabe nie nutzt.

/effort medium

Legt den Aufwandsgrad in Claude Code fest; /effort allein öffnet einen Schieberegler.

Welches Modell zu welcher Aufgabe passt

  • Haiku 4.5 für mechanische Bearbeitungen: ein Umbenennen, ein Formatierungsdurchlauf, eine einzelne Dateiänderung, die Sie überprüfen werden, eine schnelle Suche. Es ist das günstigste pro Token, halb so teuer wie Sonnet 5, und Anthropic beschreibt es als geeignet für großvolumige Arbeiten mit überprüfbaren Ausgaben und nicht mit langen Agentenschleifen. Das Zeitfenster beträgt 200.000 statt einer Million Token, und Anthropic verpflichtet sich, es mindestens bis zum 15. Oktober 2026 verfügbar zu halten. Überprüfen Sie daher die Seite mit den veralteten Versionen, bevor Sie darauf aufbauen.
  • Sonett 5 für den Arbeitsalltag. In der Claude-Code-Dokumentation von Anthropic heißt es, dass Sonnet die meisten Coding-Aufgaben gut bewältigt und weniger kostet als Opus; Pro Token ist Sonnet 5 für alles halb so teuer wie Opus 5.5, mit Ausnahme von Cache-Lesevorgängen, bei denen sie gleich sind.
  • Ein Opus für schwierige Probleme: große übergreifende Refaktoren, schwieriges Debugging, Architekturentscheidungen. Opus 5.5 ist seit September 2026 auch die Standardversion von Claude Code für Pro, Max, Team, Enterprise und die API. Wenn Sie sich also noch nie für ein Modell entschieden haben, ist es das Modell, für das Sie bezahlen.
  • Fable für die schwierigsten und am längsten laufenden Aufgaben. Es ist das teuerste pro Token, obwohl der Kostenleitfaden von Anthropic empfiehlt, mit der Agentenarbeit an Fable 5.1 mit low Aufwand zu beginnen und sie dort zu erhöhen, wo sie fehlt. Abhängig von Ihrem Plan und der Sitzplatzstufe stellt Claude Code Fable möglicherweise Nutzungsguthaben anstelle der in Ihrem Plan enthaltenen Limits in Rechnung. Der /model-Picker sagt dies in der Fable-Zeile.

Modellwechsel in Claude Code

In einer Sitzung wechselt /model, gefolgt von einem Alias, sofort, und /model allein öffnet einen Picker, in dem die linke und rechte Pfeiltaste auch den Aufwand festlegen. claude --model legt das Modell beim Start fest, und das Feld model in Ihrer Einstellungsdatei oder die Umgebungsvariable ANTHROPIC_MODEL sorgt dafür, dass eine Auswahl getroffen wird. Die Hauptaliasnamen sind haiku, sonnet, opus und fable sowie opusplan: Opus im Planmodus, Sonnet für die Ausführung.

/model sonnet

Schaltet die aktuelle Sitzung auf das neueste Sonnet um.

claude --model haiku

Startet eine neue Sitzung zum Thema Haiku.

Wechseln Sie zu Beginn einer Aufgabe, nicht in der Mitte. Jedes Modell verfügt über einen eigenen Prompt-Cache, sodass nach einem Wechsel bei der nächsten Anfrage die gesamte Konversation ohne Cache-Treffer erneut gelesen wird, was bei einer langen Sitzung kostspielig ist. Claude Code fordert Sie auf, einen Wechsel zu bestätigen, während der Cache noch warm ist. Jeder Wechsel des Planmodus unter opusplan ist ein solcher Schalter, und bei den meisten Modellen kostet eine Änderung des Aufwands während der Sitzung das gleiche erneute Lesen. Für Subagenten, die einfache Arbeiten ausführen, schlägt Anthropic model: haiku in ihrer Konfiguration vor.

Wenn Sie verkleinern möchten, was jede Frage beinhaltet und nicht den Preis eines Tokens, nimmt capsul die gleichen Modellnamen und sendet dem Modell kurze Auszüge, was die Frage benötigt, und nicht das Repository. Die Spalte in der Tabelle oben ist die gemessene.

capsul ask 'rename userId to accountId in the auth module' --model haiku

Steuert die Claude-CLI, bei der Sie bereits angemeldet sind, auf dem von Ihnen benannten Modell.

Fragen

Lohnt sich Opus für Claude Code?

Bei schwierigen Problemen oft ja: Ein leistungsfähigeres Modell kann in weniger Runden mit weniger Suchen und Zurückverfolgen fertig werden, was einen höheren Preis pro Token ausgleichen kann. Bei routinemäßigen Bearbeitungen zahlt es sich meist für die Tiefe aus, die die Aufgabe nicht nutzt, und Anthropics eigene Dokumentation besagt, dass unerwartet hohe Ausgaben für die API normalerweise auf Sitzungen zurückzuführen sind, die nie gelöscht wurden, oder darauf, dass Opus als Standardmodell beibehalten wurde. Ab September 2026 ist Opus 5.5 die Standardversion von Claude Code für Pro, Max, Team, Enterprise und die API. Überprüfen Sie also /model, bevor Sie davon ausgehen, dass Sie etwas günstigeres haben.

Was ist das günstigste Claude-Modell zum Codieren?

Pro Token Claude Haiku 4,5: Stand September 2026 ist es das günstigste Modell auf der API von Anthropic, mit 1 $ pro Million Input-Tokens und 5 $ pro Million Output-Tokens. Pro Aufgabe kommt es darauf an, wie viele Token ein Modell ausgibt und ob es die richtige Antwort bekommt, denn eine falsche Antwort wird doppelt bezahlt. Anthropic beschreibt Haiku als geeignet für hochvolumige Arbeiten mit überprüfbaren Ausgaben und nicht für lange Agentenschleifen, daher ist es die günstigste Wahl für mechanische Bearbeitungen und nicht für alles.

Ist Claude Sonnet 5 günstiger als Opus 5.5?

Pro Token kostet Sonnet 5 ab September 2026 halb so viel wie Opus 5.5 für neue Eingaben, Cache-Schreibvorgänge und -Ausgaben und genau das Gleiche für Cache-Lesevorgänge, nämlich 0,20 US-Dollar pro Million Token. Anthropic weist darauf hin, dass zwischengespeicherte Eingaben den größten Teil der Rechnung eines Agenten ausmachen, sodass die tatsächliche Lücke pro Token geringer ist, als die Gesamtpreise vermuten lassen. Welches weniger pro Aufgabe kostet, hängt dann davon ab, wie viele Token jeder ausgibt: Sonnet 5 gewinnt normalerweise beim alltäglichen Programmieren, während bei schwierigen Problemen das Modell, das in weniger Runden fertig ist, die Lücke schließen kann.

Warum verwendet dieselbe Eingabeaufforderung bei neueren Claude-Modellen mehr Token?

Claude 4.7 und spätere Modelle verwenden einen neueren Tokenizer, der laut Anthropic etwa 30 % mehr Token für denselben Text erzeugt, wobei die genaue Steigerung vom Inhalt abhängt. Opus 4.6, Sonnet 4.6 und Haiku 4.5 verwenden den vorherigen Tokenizer. Vergleichen Sie Modelle anhand der Kosten pro Aufgabe und nicht anhand der Token-Anzahl, da die Token-Anzahl die neueren Modelle teurer erscheinen lässt, bevor eines der beiden Modelle irgendeine Arbeit geleistet hat.

Ändert der Aufwand die Kosten einer Aufgabe?

Ja. Der Aufwand legt fest, wie viel ein Modell denkt, wie viele Toolaufrufe es durchführt und wie viel es schreibt. Das Denken wird mit der Ausgaberate abgerechnet, sodass bei geringerem Aufwand weniger Token für dieselbe Aufgabe aufgewendet werden. In Claude Code stellen Sie es mit /effort oder mit den Pfeiltasten in /model ein; Ab September 2026 verwenden die meisten Modelle standardmäßig high, Opus 5.5 medium und Haiku 4.5 verfügt über keine Aufwandseinstellung. Im Hilfecenter von Anthropic wird neben dem von Ihnen verwendeten Modell auch der Aufwand als einer der Faktoren aufgeführt, die sich auf die Nutzung eines Abonnements auswirken.

$ npm i -g @penra/capsul

← Alle Ratgeber