Kosten pro Aufgabe
Die Kosten pro Aufgabe umfassen alle Anfragen, Fehlversuche und delegierten Aufrufe bis zum Abschluss einer Arbeit und zeigen damit mehr als der Preis pro Token oder Anfrage.
Preislisten zitieren Token; Was Sie bezahlen, ist fertige Arbeit. Ein Agent erledigt eine Aufgabe durch viele Anfragen (Erkunden, Bearbeiten, Ausführen von Tests, Selbstkorrektur), und wie viele er benötigt, variiert je nach Modell und Aufwand. Das Modell, das pro Token am günstigsten ist, ist also nicht unbedingt das günstigste pro Aufgabe. Anthropics eigener Kostenleitfaden vom September 2026 empfiehlt den Vergleich von Modellen hinsichtlich der Kosten pro abgeschlossener Aufgabe und weist darauf hin, dass ein leistungsfähigeres Modell häufig mit weniger Umdrehungen, weniger Suchen und weniger Zurückverfolgen fertig wird.
Ausfälle gehören in die Zahl. Bei einem fehlgeschlagenen Versuch werden die Token weiterhin in Rechnung gestellt, ebenso wie bei einem erneuten Versuch. Daher kann ein Modell, das pro Anfrage günstig ist, aber häufiger fehlschlägt, mehr pro Aufgabe kosten. Auch Nacharbeit zählt: Eine Antwort, die in einer zweiten Sitzung korrigiert werden muss, war nicht billig.
Außerdem sind die Token-Zählungen nicht mehr zwischen den Tokenisierern vergleichbar. Laut Anthropic umfasst derselbe Text bei seinen Modellen ab Version 4.7 etwa 30 % mehr Token als bei früheren Modellen. Daher benachteiligt ein Vergleich der pro Aufgabe verwendeten Token die neueren Modelle aufgrund ihrer Konstruktion, während ein Vergleich der Preise pro Token außer Acht lässt, dass jeder ihrer Token weniger Text abdeckt. Kosten pro erledigter Aufgabe bleiben trotz dieses Unterschieds vergleichbar.
Für die Messung ist eine definierte Aufgabe erforderlich, eine Prüfung, die besagt, ob sie erfolgreich war, und alle gezählten Kosten: die Hauptsitzung, Subagenten, Thinking-Tokenss und Wiederholungsversuche. Bei einem Abonnement, bei dem keine Rechnung pro Token vorliegt, wird der Gesamtbetrag normalerweise als API-äquivalente Kosten ausgedrückt.