gpt-5.6-terra in Codex CLI: Tokens pro Frage
Terra ist das ausgewogene Modell dieser GPT-Familie, zwischen Spitzenleistung und günstigerem Durchsatz angesiedelt.
Die Messwerte
- Codex CLI allein
- 24.000
- Mit capsul
- 11.100
- weniger gesendete Eingabe
- x2.16
- bestandene Antwortprüfungen von fünf, ohne und mit capsul
- 3 / 4
- Ausgabetokens pro Frage, ohne und mit capsul
- 582 / 142
cachegewichtete Eingabetokens pro Frage
cachegewichtete Eingabetokens pro Frage
90-%-Intervall: x1.57 bis x3.20
Codex CLI meldet bei einem ChatGPT-Abo Tokens, keine Dollarbeträge: Für GPT-Modelle werden keine Kosten gezeigt.
Für alltägliche Implementierungen, Testreparaturen und Code-Reviews kann es ein brauchbarer Standard sein, wenn mehr Urteilsvermögen als bei einer mechanischen Änderung gefragt ist. In einer Agentensitzung kann der zum Verständnis eines Repositorys gesammelte Kontext den Nutzerprompt überwiegen. Die Zeilen je Frage zeigen, wie sich dieser Verkehr unter dem gemessenen Protokoll verändert hat.
Codex CLI lief hier mit einem ChatGPT-Abo; diesem Modell ist deshalb kein Dollarbetrag zugeordnet. Aussagekräftig sind die Tokendifferenz und die Antwortprüfungen zusammen. Messen Sie längere oder explorativere Arbeit selbst, bevor Sie das Ergebnis dieser kurzen Fragen darauf übertragen.
Frage für Frage
Fünf einzeilige Fragen zu einem echten TypeScript-Projekt, je 2 Mal pro Arm gestellt. Gewichtete Eingabe pro Frage als Mittelwert der Wiederholungen.
| Frage | Ohne capsul | capsul | Weniger Eingabe | Korrekte Läufe, ohne / mit capsul |
|---|---|---|---|---|
| F1 | 26.600 | 6.100 | x4.37 | 0 / 0 |
| F2 | 21.800 | 9.960 | x2.19 | 2 / 2 |
| F3 | 15.700 | 9.620 | x1.63 | 2 / 2 |
| F4 | 33.300 | 24.400 | x1.37 | 0 / 2 |
| F5 | 22.400 | 5.480 | x4.08 | 2 / 2 |
So wurde gemessen
Zwei Arme mit demselben Modell: Codex CLI im normalen Einsatz und dieselbe Frage über capsul. Die Einheit ist cachegewichtete Eingabe: frische Tokens mit vollem Gewicht, Cache-Lesezugriffe mit einem Zehntel. Kampagne vom 4. September 2026, 2 Wiederholungen je Frage und Arm.
20 / 20 cells · /benchmarks/2026-09-04-codex.json
Fragen
Wie viele Tokens nutzt gpt-5.6-terra pro Frage in Codex CLI?
Im Benchmark vom 4. September 2026 sendete eine Codex CLI-Sitzung ohne capsul mit gpt-5.6-terra im Mittel 24.000 cachegewichtete Eingabetokens pro einzeiliger Coding-Frage. Mit capsul auf demselben Modell waren es 11.100.
Ist die Einsparung bei gpt-5.6-terra belegt?
Ja. Das 90-%-Intervall reicht von x1.57 bis x3.20 und liegt vollständig über eins, bei 20 gemessenen Zellen.
Verändert capsul die Antworten von gpt-5.6-terra?
Es bestand mehr Prüfungen: 3 von fünf ohne capsul, 4 von fünf mit capsul. Fünf Prüfungen sind eine kleine Stichprobe: Das zeigt keinen Verlust, aber keinen belegten Gewinn.