Claude Code 中的 Claude Opus 4.8:每问 token 数
这一较晚的 Opus 版本是标价较高的选择,适合需要更广泛调查的编程任务。
实测数字
- 原始 Claude Code
- 65,800
- 使用 capsul
- 13,800
- 发送的输入减少
- x4.75
- 五项答案校验的通过数,依次为原始代理与 capsul
- 5 / 4
- 每问的工具步骤数,依次为原始代理与 capsul
- 3.4 / 2.2
- 每问的输出 token,依次为原始代理与 capsul
- 3,040 / 322
- 每问的 API 等价成本,依次为原始代理与 capsul
- US$0.498 / US$0.0825
每问的缓存加权输入 token
每问的缓存加权输入 token
90% 区间:×3.00 至 ×8.75
它的 API 公开标价与这里较早的其他 Opus 版本相同。比较这些模型时,token 数和答案校验比系列名称更有参考价值。代理若额外打开文件、反复读取先前的工具输出,即使任务看似很小,成本也可能上升。
这些数字来自真实代码库上的简短问题,也保留了不同问题之间的变化。若要估算迁移或长时间审查的成本,应先测量自己的工作流,再把页面所示的节省推算到整段会话。
逐项问题
针对真实 TypeScript 代码库提出五个单行问题,每条对照臂的每个问题重复 3 次。表中为每问加权输入的平均值。
| 问题 | 原始代理 | capsul | 减少的输入 | 正确运行次数:原始 / capsul |
|---|---|---|---|---|
| 问题 1 | 81,700 | 12,100 | x6.77 | 2 / 0 |
| 问题 2 | 64,800 | 20,900 | x3.11 | 2 / 3 |
| 问题 3 | 43,800 | 10,400 | x4.20 | 3 / 3 |
| 问题 4 | 95,200 | 13,400 | x7.11 | 3 / 3 |
| 问题 5 | 43,400 | 12,500 | x3.48 | 3 / 3 |
公开标价
| 模型 | 输入 | 输出 | 缓存读取 | 缓存写入 5 分钟 | 缓存写入 1 小时 | 上下文 |
|---|---|---|---|---|---|---|
| Claude Haiku 4.5 | 1.00 | 5.00 | 0.10 | 1.25 | 2.00 | 200,000 |
| Claude Sonnet 5 | 2.00 | 10.00 | 0.20 | 2.50 | 4.00 | 1,000,000 |
| Claude Sonnet 4.6 | 3.00 | 15.00 | 0.30 | 3.75 | 6.00 | 1,000,000 |
| Claude Opus 4.6 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 4.7 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 4.8 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 5 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 5.5 | 4.00 | 20.00 | 0.20 | 5.00 | 8.00 | 1,000,000 |
| Claude Fable 5 | 10.00 | 50.00 | 1.00 | 12.50 | 20.00 | 1,000,000 |
| Claude Fable 5.1 | 10.00 | 50.00 | 0.25 | 12.50 | 20.00 | 1,000,000 |
Anthropic 公开标价,核对日期:2026年9月23日。
测量方法
同一个模型的两条对照臂:直接运行 Claude Code,以及通过 capsul 提交同一个问题。计量单位为缓存加权输入:新 token 全额计算,缓存读取按十分之一计算。测量日期为 2026年9月22日,每个问题在每条臂上重复 3 次。
30 / 30 cells · /benchmarks/2026-09-22-claude.json
常见问题
Claude Code 中的 Claude Opus 4.8 每问使用多少 token?
在 2026年9月22日 的基准测试中,Claude Code 直接运行 Claude Opus 4.8 时,每个单行编程问题平均发送 65,800 个缓存加权输入 token;使用 capsul 后为 13,800 个。
用 Claude Opus 4.8 回答一个编程问题要花多少钱?
按 Anthropic 公开标价计算,原始代理每问的流量成本为 US$0.498,使用 capsul 后为 US$0.0825。Claude 订阅并不按 token 收费;这里的金额用于比较不同模型每问消耗的额度。
Claude Opus 4.8 的节省有统计依据吗?
有。90% 区间为 ×3.00 至 ×8.75,整体高于一,共测得 30 个单元格。
capsul 会改变 Claude Opus 4.8 的答案吗?
通过的校验更少:直接运行时为五项中的 5 项,使用 capsul 时为 4 项。基准测试如实公布了这一结果。