Claude Code 中的 Claude Sonnet 4.6:每问 token 数
这一较早的 Sonnet 版本,为比较 Claude 中档编程模型提供了有用的基准。
实测数字
- 原始 Claude Code
- 31,400
- 使用 capsul
- 16,600
- 发送的输入减少
- x1.89
- 五项答案校验的通过数,依次为原始代理与 capsul
- 4 / 4
- 每问的工具步骤数,依次为原始代理与 capsul
- 3.8 / 3
- 每问的输出 token,依次为原始代理与 capsul
- 748 / 344
- 每问的 API 等价成本,依次为原始代理与 capsul
- US$0.139 / US$0.0613
每问的缓存加权输入 token
每问的缓存加权输入 token
90% 区间:×1.30 至 ×2.79
它的 API 公开标价高于更新的 Sonnet。如果你因兼容性或账户可用性继续使用它,实际成本取决于标价和代理真正发送的输入量。另一个模型的 token 数更少,并不能单独说明它是否能更好地完成任务。
下方的问题展示了原始代理和 capsul 在相同仓库任务上发送的上下文量。请把答案结果与 token 区间一起看,避免把未能找到任务所需信息的低消耗运行误当成更好的结果。
逐项问题
针对真实 TypeScript 代码库提出五个单行问题,每条对照臂的每个问题重复 3 次。表中为每问加权输入的平均值。
| 问题 | 原始代理 | capsul | 减少的输入 | 正确运行次数:原始 / capsul |
|---|---|---|---|---|
| 问题 1 | 41,100 | 20,500 | x2.01 | 0 / 0 |
| 问题 2 | 32,400 | 24,700 | x1.31 | 2 / 3 |
| 问题 3 | 23,000 | 9,500 | x2.42 | 3 / 3 |
| 问题 4 | 35,600 | 16,300 | x2.18 | 3 / 2 |
| 问题 5 | 24,900 | 12,200 | x2.05 | 3 / 3 |
公开标价
| 模型 | 输入 | 输出 | 缓存读取 | 缓存写入 5 分钟 | 缓存写入 1 小时 | 上下文 |
|---|---|---|---|---|---|---|
| Claude Haiku 4.5 | 1.00 | 5.00 | 0.10 | 1.25 | 2.00 | 200,000 |
| Claude Sonnet 5 | 2.00 | 10.00 | 0.20 | 2.50 | 4.00 | 1,000,000 |
| Claude Sonnet 4.6 | 3.00 | 15.00 | 0.30 | 3.75 | 6.00 | 1,000,000 |
| Claude Opus 4.6 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 4.7 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 4.8 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 5 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 5.5 | 4.00 | 20.00 | 0.20 | 5.00 | 8.00 | 1,000,000 |
| Claude Fable 5 | 10.00 | 50.00 | 1.00 | 12.50 | 20.00 | 1,000,000 |
| Claude Fable 5.1 | 10.00 | 50.00 | 0.25 | 12.50 | 20.00 | 1,000,000 |
Anthropic 公开标价,核对日期:2026年9月23日。
测量方法
同一个模型的两条对照臂:直接运行 Claude Code,以及通过 capsul 提交同一个问题。计量单位为缓存加权输入:新 token 全额计算,缓存读取按十分之一计算。测量日期为 2026年9月22日,每个问题在每条臂上重复 3 次。
30 / 30 cells · /benchmarks/2026-09-22-claude.json
常见问题
Claude Code 中的 Claude Sonnet 4.6 每问使用多少 token?
在 2026年9月22日 的基准测试中,Claude Code 直接运行 Claude Sonnet 4.6 时,每个单行编程问题平均发送 31,400 个缓存加权输入 token;使用 capsul 后为 16,600 个。
用 Claude Sonnet 4.6 回答一个编程问题要花多少钱?
按 Anthropic 公开标价计算,原始代理每问的流量成本为 US$0.139,使用 capsul 后为 US$0.0613。Claude 订阅并不按 token 收费;这里的金额用于比较不同模型每问消耗的额度。
Claude Sonnet 4.6 的节省有统计依据吗?
有。90% 区间为 ×1.30 至 ×2.79,整体高于一,共测得 30 个单元格。
capsul 会改变 Claude Sonnet 4.6 的答案吗?
在本测试中没有:Claude Sonnet 4.6 直接运行时通过五项答案校验中的 4 项,使用 capsul 时通过 4 项。