gpt-5.6-sol in Codex CLI: Tokens pro Frage
Sol ist das Spitzenmodell dieser GPT-Familie in Codex CLI und für anspruchsvolle Coding-Arbeit gedacht.
Die Messwerte
- Codex CLI allein
- 33.100
- Mit capsul
- 14.700
- weniger gesendete Eingabe
- x2.26
- bestandene Antwortprüfungen von fünf, ohne und mit capsul
- 3 / 3
- Ausgabetokens pro Frage, ohne und mit capsul
- 1.020 / 225
cachegewichtete Eingabetokens pro Frage
cachegewichtete Eingabetokens pro Frage
90-%-Intervall: x1.81 bis x3.01
Codex CLI meldet bei einem ChatGPT-Abo Tokens, keine Dollarbeträge: Für GPT-Modelle werden keine Kosten gezeigt.
Es kommt bei unklaren Fehlern, komplexen Implementierungen oder Reviews infrage, die anhaltendes Urteilsvermögen verlangen. Solche Aufgaben laden auch zu breiter Dateisuche ein. Deshalb zählt die vom Agenten gesendete Eingabe neben der Modellwahl. Die Zahlen unten vergleichen dieselben kurzen Fragen in Codex CLI allein und mit capsul.
Dieser Lauf nutzte ein ChatGPT-Abo. Die Seite zeigt deshalb Tokens und keinen Dollarbetrag je Frage. Prüfen Sie Intervall und Antwortprüfungen, bevor Sie aus der gemessenen Differenz eine Änderung Ihres Arbeitsablaufs ableiten. Ein langes Projekt kann Kontext anders ansammeln als diese kurzen Aufgaben.
Frage für Frage
Fünf einzeilige Fragen zu einem echten TypeScript-Projekt, je 2 Mal pro Arm gestellt. Gewichtete Eingabe pro Frage als Mittelwert der Wiederholungen.
| Frage | Ohne capsul | capsul | Weniger Eingabe | Korrekte Läufe, ohne / mit capsul |
|---|---|---|---|---|
| F1 | 36.000 | 19.200 | x1.88 | 0 / 0 |
| F2 | 23.900 | 9.850 | x2.43 | 1 / 2 |
| F3 | 24.600 | 7.830 | x3.14 | 2 / 2 |
| F4 | 61.400 | 21.900 | x2.80 | 0 / 0 |
| F5 | 19.400 | 14.500 | x1.34 | 2 / 2 |
So wurde gemessen
Zwei Arme mit demselben Modell: Codex CLI im normalen Einsatz und dieselbe Frage über capsul. Die Einheit ist cachegewichtete Eingabe: frische Tokens mit vollem Gewicht, Cache-Lesezugriffe mit einem Zehntel. Kampagne vom 4. September 2026, 2 Wiederholungen je Frage und Arm.
20 / 20 cells · /benchmarks/2026-09-04-codex.json
Fragen
Wie viele Tokens nutzt gpt-5.6-sol pro Frage in Codex CLI?
Im Benchmark vom 4. September 2026 sendete eine Codex CLI-Sitzung ohne capsul mit gpt-5.6-sol im Mittel 33.100 cachegewichtete Eingabetokens pro einzeiliger Coding-Frage. Mit capsul auf demselben Modell waren es 14.700.
Ist die Einsparung bei gpt-5.6-sol belegt?
Ja. Das 90-%-Intervall reicht von x1.81 bis x3.01 und liegt vollständig über eins, bei 20 gemessenen Zellen.
Verändert capsul die Antworten von gpt-5.6-sol?
In diesem Protokoll nicht: gpt-5.6-sol bestand 3 von fünf Antwortprüfungen ohne capsul und 3 von fünf mit capsul.