Claude Opus・Sonnet・Haiku のタスク別コスト
1百万トークンあたりの価格は、コーディングタスクのコストの半分に過ぎません。残りの半分は、タスク完了までにモデルが消費するトークン数で、価格表には掲載されていません。
コーディングエージェントのタスク単位の請求は、2つの数値の掛け算です。選択したモデルのトークン単価と、タスク完了までにそのモデルが消費したトークン数です。価格表は前者を示します。後者はモデルの動作に依存します。
トークン単価が2倍でもトークン消費が半分であればコストは同じです。トークン単価は安くても余計に3つのファイルを読む、あるいは誤答して再度質問し直す場合は、コストが増えることがあります。
2026年9月時点の価格表
Anthropicは各モデルを1百万トークン単位で価格設定し、入力(新規)、キャッシュ書き込み、キャッシュ読み取り、出力で別々のレートを設けています。これらは2026年9月時点のAPI価格表です。
| モデル | 入力 | 出力 | キャッシュ読み取り | キャッシュ書き込み 5 分 | キャッシュ書き込み 1 時間 | コンテキスト |
|---|---|---|---|---|---|---|
| Claude Haiku 4.5 | 1.00 | 5.00 | 0.10 | 1.25 | 2.00 | 200,000 |
| Claude Sonnet 5 | 2.00 | 10.00 | 0.20 | 2.50 | 4.00 | 1,000,000 |
| Claude Sonnet 4.6 | 3.00 | 15.00 | 0.30 | 3.75 | 6.00 | 1,000,000 |
| Claude Opus 4.6 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 4.7 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 4.8 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 5 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 5.5 | 4.00 | 20.00 | 0.20 | 5.00 | 8.00 | 1,000,000 |
| Claude Fable 5 | 10.00 | 50.00 | 1.00 | 12.50 | 20.00 | 1,000,000 |
| Claude Fable 5.1 | 10.00 | 50.00 | 0.25 | 12.50 | 20.00 | 1,000,000 |
その表で、コーディングエージェントにとって入力価格の見出しより重要な点が3つあります。
- キャッシュ読み取り。エージェントは各ターンで会話全体を再送し、その大部分はプロンプトキャッシュから返ってくるため、入力トークンの多くはこのレートで課金されます。多くのモデルは入力価格の10分の1でキャッシュを読み、Fable 5.1は40分の1です。Opus 5.5は20分の1、すなわち1百万トークンあたり$0.20で、Sonnet 5と同じレートです。
- 出力(思考を含む)。出力はすべてのモデルで入力の5倍のコストがかかり、思考トークンは出力として課金されます。
- Sonnet 5の価格。$2 と $10 のレートは当初の導入価格として発表されましたが、Anthropicはそれを標準化し、2026年9月1日に予定されていた $3 と $15 への引き上げは実施されませんでした。
残りの半分:タスク完了までのトークン数
タスクあたりのトークン数は、価格とは無関係なモデル固有の要因で変わります。探索が多いモデルは回答前に多くのファイルを読み込み、読み込んだファイルはコンテキストに残り、後続のターンでも再度課金されます。誤答はトークンを消費し、再試行でも再度消費します。思考時間が長いモデルは出力レートでより多く課金されます。
Anthropicのコストガイドでも同様の指摘があります。より高性能なモデルは、ターン数や検索・バックトラッキングが減少し、トークン単価が高くても総コストが抑えられることがあります。SWE-bench Pro のサブセットでは、Fable 5.1 が低エフォートでタスクの88.6% を解決し、1タスクあたり$0.54 と報告されています。一方、デフォルト設定の Sonnet 5 は77.4% を解決し、1タスクあたり$0.84 で、トークン単価は5倍です。ワークロードによっては順位が逆転する例も示され、価格表だけでは結果を予測できないと結論付けています。
質問ごとの測定コスト(モデル別)
以下の表は実際のリポジトリで両方の要素を測定したものです。各モデルで Claude Code を通じて同じ1行質問を3回ずつ実行し、Claude Code が API 価格表で報告するコストを使用しています。トークン数はキャッシュ読み取りを新規トークンの10分の1としてカウントし、これは多くのモデルの課金レートです。また、同じモデルで capsul を使用した同一質問の結果も示しています。ベンチマークページで手法を説明しています。
| モデル | 通常の入力 | capsul 使用時の入力 | 通常のコスト | capsul 使用時のコスト | 入力削減量 |
|---|---|---|---|---|---|
| Claude Haiku 4.5 | 55,500 | 19,300 | $0.0812 | $0.0265 | x2.88 |
| Claude Sonnet 5 | 54,200 | 18,900 | $0.153 | $0.0487 | x2.86 |
| Claude Sonnet 4.6 | 31,400 | 16,600 | $0.139 | $0.0613 | x1.89 |
| Claude Opus 4.6 | 45,700 | 16,400 | $0.332 | $0.101 | x2.78 |
| Claude Opus 4.7 | 38,700 | 20,100 | $0.28 | $0.126 | x1.92 |
| Claude Opus 4.8 | 65,800 | 13,800 | $0.498 | $0.0825 | x4.75 |
| Claude Opus 5 | 45,300 | 16,200 | $0.343 | $0.101 | x2.80 |
| Claude Opus 5.5 | 42,300 | 15,900 | $0.222 | $0.0696 | x2.66 |
| Claude Fable 5 | 41,400 | 17,600 | $0.633 | $0.219 | x2.35 |
| Claude Fable 5.1 | 49,700 | 23,400 | $0.636 | $0.279 | x2.12 |
読み方:
- まず Claude Code 単体で見る:各モデルが回答に費やしたコスト(各モデルの価格表に基づく)。
- 同一価格表の行を比較する。Opus 4.6、4.7、4.8、Opus 5 はすべて $5 と $25 の価格で、差はトークン数によるもので、執筆時点では差が大きいです。Anthropic の独自コーディングベンチマークでも同様のパターンが報告されています。
- 世代間ではトークン数ではなくドル額を比較します。4.7 以降のモデルは同じテキストをより多くのトークンとして数えるため(次節参照)、トークン数だけの比較は Haiku 4.5、Sonnet 4.6、Opus 4.6 に有利です。
- コストと回答チェックを併せて読む。質問あたりは安くても期待した回答が少ない行は、正解あたりのコストが安いとは言えません。
- 価格が低いからといって必ず安いとは限りません。Sonnet 5 は Sonnet 4.6 より価格が下がっていますが、執筆時点では Claude Code 単体ではトークン消費が多いため、2つのうち安くはありません。Anthropic のコーディングベンチマークでは価格差が勝りますが、そこでも Sonnet 5 はタスクあたりのトークンが多くなります。同じ2モデルでも作業内容により勝者が変わります。
Claude 4.7 でトークナイザーが変更された
Anthropic の価格ページによると、Claude 4.7 以降のモデルは新しいトークナイザーを使用し、同一テキストで約30% 多くのトークンが生成されます(増加率はコンテンツに依存)。上記で測定したモデルでは、Opus 4.7、4.8、5、5.5、Sonnet 5、Fable 系列が該当し、Opus 4.6、Sonnet 4.6、Haiku 4.5 は従来のトークナイザーを使用しています。
したがって、その境界をまたいだトークン単価比較は同条件ではありません。同じプロンプトでも新しいモデルでは作業前にすでにトークン数が増えているため、Anthropic はタスク解決あたりのコスト比較を推奨しています。
エフォートは第2の調整項目
同一モデル内では、エフォートレベルがトークン消費量を決定します。思考量、ツール呼び出し回数、出力量が変わります。レベルは low、medium、high、xhigh、max の順で、エフォートが低いほどツール呼び出しが少なく簡潔になり、思考も減り、出力レートで課金されます。
2026年9月時点で、Claude Code はエフォートに対応するすべてのモデルをデフォルトで high に設定していますが、Opus 5.5 は medium、Opus 4.7 は xhigh です。そのため、Sonnet 5 と Opus 5.5 のデフォルト同士の比較は同条件ではありません。Haiku 4.5 にはエフォート設定がありません。Opus 5.5 と Fable 系列は常に思考し、思考をオフにできないため、エフォートが思考量の主要な制御手段です。
Anthropic は Sonnet 5 の medium を Sonnet 4.6 の high と同等と説明しています。また、長時間のコーディング作業ではエフォートが精度向上に寄与しますが、モデルの能力範囲内のタスクでは最高エフォートはタスクが必要としない深さに対して費用がかかります。
/effort mediumClaude Code でエフォートレベルを設定します。単独の /effort はスライダーを開きます。
どのモデルをどの仕事に使うか
- Haiku 4.5 は機械的な編集向けです:リネーム、フォーマット調整、単一ファイルの変更(確認が必要)、簡易検索など。トークン単価は最安で、Sonnet 5 の半額です。Anthropic は大量のチェック可能な出力に適し、長いエージェントループには向かないと説明しています。ウィンドウは200,000トークンで、ミリオンではありません。また、Anthropic は2026年10月15日までの提供継続を約束しているので、利用前に非推奨ページを確認してください。
- Sonnet 5 は日常的な作業向けです。Anthropic の Claude Code ドキュメントでは、Sonnet はほとんどのコーディングタスクをうまく処理し、Opus よりコストが低いと述べられています。トークン単価では、キャッシュ読み取りを除くすべてで Opus 5.5 の半額です。
- Opus は難しい問題向けです:大規模な横断的リファクタ、難解なデバッグ、アーキテクチャ決定など。Opus 5.5 は2026年9月時点で Pro、Max、Team、Enterprise、API のデフォルトです。モデルを選択しなければ、このモデルが課金対象になります。
- Fable は最も難しく長時間かかるタスク向けです。トークン単価は最も高いですが、Anthropic のコストガイドでは Fable 5.1 を
lowエフォートで開始し、必要に応じて上げることを推奨しています。プランやシートの階層によっては、Claude Code が Fable の使用量をプランの上限ではなくクレジットで課金する場合があります。/modelピッカーの Fable 行にその旨が記載されています。
Claude Code でモデルを切り替える
セッション内では、エイリアスを付けた /model で即座に切り替わり、単独の /model はピッカーを開き、左右矢印キーでエフォートも設定できます。claude --model は起動時にモデルを指定し、設定ファイルの model フィールドや環境変数 ANTHROPIC_MODEL で選択を固定できます。主なエイリアスは haiku、sonnet、opus、fable、さらに opusplan(プランモードの Opus、実行は Sonnet)です。
/model sonnet現在のセッションを最新の Sonnet に切り替えます。
claude --model haikuHaiku で新しいセッションを開始します。
タスク開始時に切り替え、途中で切り替えないでください。モデルごとにプロンプトキャッシュが別々に保持されるため、切り替え後の次リクエストはキャッシュヒットなしで会話全体を再読し、長いセッションではコストが高くなります。Claude Code はキャッシュが温かい間に切り替えを確認します。opusplan のプランモード切替はすべてこのような切り替えで、ほとんどのモデルではセッション途中のエフォート変更も同様に再読コストがかかります。シンプルな作業を行うサブエージェントには、Anthropic は設定で model: haiku を推奨しています。
トークン単価を下げるのではなく、各質問が持つ情報量を減らしたい場合、capsul は同じモデル名を使い、リポジトリ全体ではなく質問に必要な短い抜粋だけをモデルに送ります。上表の列はその測定結果です。
capsul ask 'rename userId to accountId in the auth module' --model haiku既にサインインしている Claude CLI を指定したモデルで実行します。
よくある質問
Claude Code で Opus を使う価値はありますか?
難しい問題では、しばしば価値があります。より高性能なモデルはターン数や検索・バックトラッキングを減らして完了でき、トークン単価が高くても総コストを抑えられます。日常的な編集では、タスクが必要としない深さに対して費用がかかります。Anthropic のドキュメントでも、API の予想外の高支出はクリアされていないセッションやデフォルトの Opus が原因とされています。2026年9月時点で Opus 5.5 は Pro、Max、Team、Enterprise、API のデフォルトです。安価なモデルを使用していると仮定する前に /model を確認してください。
コーディングに最も安い Claude モデルはどれですか?
トークン単価では Claude Haiku 4.5 が最安です。2026年9月時点で Anthropic の API で入力トークンは1百万あたり$1、出力トークンは1百万あたり$5 です。タスク単位では、モデルが消費するトークン数と正答率に依存します。誤答は二重に課金されるためです。Anthropic は Haiku を大量のチェック可能な出力向けで、長いエージェントループには向かないと説明しており、機械的な編集には最も安価な選択肢です。
Claude Sonnet 5 は Opus 5.5 より安いですか?
トークン単価では、2026年9月時点で Sonnet 5 は新規入力、キャッシュ書き込み、出力で Opus 5.5 の半額で、キャッシュ読み取りは同額($0.20/百万トークン)です。Anthropic はキャッシュ入力がエージェントの請求額の大部分を占めると指摘しており、実際の単価差は見出し価格より小さいです。タスク単位のコストは各モデルのトークン消費量に依存します。日常的なコーディングでは Sonnet 5 が有利ですが、難しい問題では少ないターンで完了するモデルが差を埋めます。
同じプロンプトが新しい Claude モデルでより多くのトークンになるのはなぜですか?
Claude 4.7 以降のモデルは新しいトークナイザーを使用し、同一テキストで約30% 多くのトークンが生成されます(増加率はコンテンツに依存)。Opus 4.6、Sonnet 4.6、Haiku 4.5 は従来のトークナイザーです。トークン数で比較すると、作業前から新しいモデルが高価に見えるため、タスクあたりのコストで比較してください。
エフォートレベルはタスクのコストに影響しますか?
はい。エフォートはモデルの思考量、ツール呼び出し回数、出力量を決定し、思考は出力レートで課金されるため、エフォートが低いほど同一タスクで消費トークンが減ります。Claude Code では /effort または /model の矢印キーで設定します。2026年9月時点で多くのモデルはデフォルトで high、Opus 5.5 は medium、Haiku 4.5 はエフォート設定がありません。Anthropic のヘルプセンターでも、使用モデルと共にエフォートがサブスクリプション使用量に影響する要因として掲載されています。
$ npm i -g @penra/capsul