Codex CLI のトークン消費:読み取り、そして下げる

Codex は使った量を事後に教えてくれます。ここでは事前に見る方法と、数字を動かすものを扱います。

Codex CLI のセッションは、どのエージェントのセッションとも同じ形をしています。小さな質問が大量のコンテキストに包まれている、という形です。違うのは、そのコンテキストのかなりの部分が環境由来だという点です。あなたが何かを打ち込む前から、そこにあります。

環境入力:頼んでいない部分

セッションはどれも、指示、ツールのスキーマ、そして環境に登録されているものすべてから始まります。どれも間違ってはいませんし、現在の作業がそれに触れるかどうかにかかわらず、毎ターン課金されます。

これは枠を消費せずに測れます。珍しいことで、知っておく価値があります。

codex debug prompt-input

送られる内容を出力します。決定的で、再現でき、費用はかかりません。

自分のマシンで走らせて合計を読んでください。私たちの基準機では、capsul が取り除く環境部分は 1 ターンあたり 4500 トークンを少し超えていました。プラグインのカタログ、コネクタの説明と同梱の skills、そして Codex が自分で起動していた MCP サーバーのツールスキーマです。

セッション入力:あなたが左右できる部分

環境入力の上に、どのエージェントでも積み上がるものが乗ります。読んだファイル、走らせたコマンド、そしてここまでの記録です。効く手はどこでも同じです。

  • エージェントに探させず、ファイルを名指しする。
  • 作業ごとに 1 セッション、終わったら閉じる。
  • うるさいコマンド出力は記録に届く前に絞り込む。
  • コンテキストに上限を置き、それを守る。

予算のもとで Codex を動かす

capsul はすでにサインイン済みの Codex CLI を動かすので、答えるのは既存の ChatGPT プランです。継続、使用量、推論の強さは、見える場所に返されます。

npm i -g @penra/capsul
capsul ask '検索エンドポイントにページングを追加して' --budget 3000

数字を正直に読む

どのトークンベンチマークにも当てはまる注意が 2 つあります。私たちのものも例外ではありません。第一に、加重入力と生の入力は別の測定です。キャッシュされた入力は新規入力の何分の一かで課金されるため、キャッシュを無視した比較は、たまたまキャッシュがよく効いたほうの腕を有利に見せます。第二に、ある作業での削減は次の作業での削減ではありません。私たち自身の表にも、capsul のほうが加重入力を多く使う行があり、外さずに公開しています。

よくある質問

枠を消費せずに Codex のトークン使用量を見るには。

codex debug prompt-input は、与えた入力に対して送られる内容をモデルを呼ばずに出力します。決定的なので、2 回走らせれば変更の効果を測れます。

capsul に OpenAI の API キーは必要ですか。

いいえ。すでにサインイン済みの Codex CLI を動かすので、答えるのはあなたの ChatGPT プランです。API キーはどのプランでもセッションごとの任意の選択です。

入力を減らすと推論の強さは変わりますか。

両者は独立です。強さは別の設定で、使用量と並べて capsul に返され、リクエストごとに指定できます。

MCP サーバーは使わなくてもトークンを消費しますか。

そのツールスキーマは送られる内容の一部なので、はい。現在の作業が一度も触れない登録済みサーバーでも、毎ターン入力を占めます。

$ npm i -g @penra/capsul

ガイド一覧