Codex CLI の gpt-5.4:質問あたりのトークン
この以前の GPT モデルも、Codex CLI のコーディングセッションを比べるための基準です。
測定結果
- 通常の Codex CLI
- 31,800
- capsul 使用時
- 8,220
- 送信した入力の削減量
- x3.86
- 5 項目の回答チェック通過数。通常、capsul の順
- 4 / 4
- 質問あたりの出力トークン。通常、capsul の順
- 1,660 / 467
質問あたりのキャッシュ加重入力トークン
質問あたりのキャッシュ加重入力トークン
90% 区間:×2.88 〜 ×5.47
ChatGPT プラン上の Codex CLI が報告するのはトークン数で、ドル額ではありません。GPT モデルのコストは表示しません。
使い慣れたモデルでも、回答前にエージェントがどれだけ読むかによって、入力量は大きく変わります。下の測定はコーディング質問を同じに保ち、コンテキストの渡し方を変えています。モデル名から推測せずに、トークンの通信量を判断できます。
このサブスクリプション利用の実行では、質問ごとのドル額を報告していません。区間、回答チェック、個々のタスクを併せて見てください。より大きな修正や長い会話に使うなら、そのセッションで積み重なる入力を別途測る価値があります。
質問ごとの結果
実際の TypeScript コードベースに関する 1 行の質問を 5 つ用意し、質問ごとに各比較条件で 2 回反復。表は質問あたりの加重入力の平均値です。
| 質問 | 通常 | capsul | 入力削減量 | 正解回数:通常 / capsul |
|---|---|---|---|---|
| 質問 1 | 36,800 | 10,400 | x3.53 | 0 / 0 |
| 質問 2 | 30,600 | 5,970 | x5.12 | 2 / 2 |
| 質問 3 | 17,000 | 3,310 | x5.12 | 1 / 2 |
| 質問 4 | 56,000 | 15,900 | x3.53 | 2 / 2 |
| 質問 5 | 18,500 | 5,520 | x3.35 | 2 / 2 |
測定方法
同じモデルで 2 条件を比較します。通常どおり Codex CLI を実行した場合と、同じ質問を capsul 経由で送った場合です。単位はキャッシュ加重入力で、新規トークンは全量、キャッシュ読み取りは 10 分の 1 として計算。測定日は 2026年9月4日、質問と条件ごとに 2 回反復しました。
20 / 20 cells · /benchmarks/2026-09-04-codex.json
よくある質問
Codex CLI の gpt-5.4 は質問ごとに何トークン使いますか?
2026年9月4日 のベンチマークでは、Codex CLI で gpt-5.4 を通常どおり使うと、1 行のコーディング質問あたり平均 31,800 キャッシュ加重入力トークンを送信しました。capsul 使用時は 8,220 です。
gpt-5.4 の削減効果は確かですか?
はい。90% 区間は ×2.88 から ×5.47 で、全体が 1 を上回っています。測定したセル数は 20 です。
capsul は gpt-5.4 の回答を変えますか?
この測定条件では変化はありません。gpt-5.4 は通常時に 5 項目中 4 項目、capsul 使用時に 4 項目の回答チェックに通過しました。