Claude Code 中的 Claude Haiku 4.5:每问 token 数
Haiku 是本次比较中最轻量的 Claude 档位,适合只需简短回答、范围明确的编程问题。
实测数字
- 原始 Claude Code
- 55,500
- 使用 capsul
- 19,300
- 发送的输入减少
- x2.88
- 五项答案校验的通过数,依次为原始代理与 capsul
- 2 / 4
- 每问的工具步骤数,依次为原始代理与 capsul
- 2.4 / 4.4
- 每问的输出 token,依次为原始代理与 capsul
- 2,710 / 444
- 每问的 API 等价成本,依次为原始代理与 capsul
- US$0.0812 / US$0.0265
每问的缓存加权输入 token
每问的缓存加权输入 token
90% 区间:×1.62 至 ×4.49
它在 Claude 模型中的 API 公开标价最低,适合查找函数、解释测试失败或完成小范围修改。但即使模型便宜,代理在回答前若读取大量文件,消耗仍可能很高。因此要看输入量,而不能只看用户写了多短的问题。
这里尤其要留意测量区间。不能把这一行理解为 capsul 对每个 Haiku 问题都能节省输入。若打算在经常重复的工作流中使用它,请同时查看逐项问题的结果和答案校验。
逐项问题
针对真实 TypeScript 代码库提出五个单行问题,每条对照臂的每个问题重复 3 次。表中为每问加权输入的平均值。
| 问题 | 原始代理 | capsul | 减少的输入 | 正确运行次数:原始 / capsul |
|---|---|---|---|---|
| 问题 1 | 57,700 | 18,000 | x3.20 | 1 / 1 |
| 问题 2 | 53,600 | 24,800 | x2.16 | 1 / 3 |
| 问题 3 | 18,200 | 10,700 | x1.70 | 0 / 3 |
| 问题 4 | 118,000 | 30,600 | x3.87 | 3 / 3 |
| 问题 5 | 29,700 | 12,200 | x2.43 | 3 / 3 |
公开标价
| 模型 | 输入 | 输出 | 缓存读取 | 缓存写入 5 分钟 | 缓存写入 1 小时 | 上下文 |
|---|---|---|---|---|---|---|
| Claude Haiku 4.5 | 1.00 | 5.00 | 0.10 | 1.25 | 2.00 | 200,000 |
| Claude Sonnet 5 | 2.00 | 10.00 | 0.20 | 2.50 | 4.00 | 1,000,000 |
| Claude Sonnet 4.6 | 3.00 | 15.00 | 0.30 | 3.75 | 6.00 | 1,000,000 |
| Claude Opus 4.6 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 4.7 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 4.8 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 5 | 5.00 | 25.00 | 0.50 | 6.25 | 10.00 | 1,000,000 |
| Claude Opus 5.5 | 4.00 | 20.00 | 0.20 | 5.00 | 8.00 | 1,000,000 |
| Claude Fable 5 | 10.00 | 50.00 | 1.00 | 12.50 | 20.00 | 1,000,000 |
| Claude Fable 5.1 | 10.00 | 50.00 | 0.25 | 12.50 | 20.00 | 1,000,000 |
Anthropic 公开标价,核对日期:2026年9月23日。
测量方法
同一个模型的两条对照臂:直接运行 Claude Code,以及通过 capsul 提交同一个问题。计量单位为缓存加权输入:新 token 全额计算,缓存读取按十分之一计算。测量日期为 2026年9月22日,每个问题在每条臂上重复 3 次。
30 / 30 cells · /benchmarks/2026-09-22-claude.json
常见问题
Claude Code 中的 Claude Haiku 4.5 每问使用多少 token?
在 2026年9月22日 的基准测试中,Claude Code 直接运行 Claude Haiku 4.5 时,每个单行编程问题平均发送 55,500 个缓存加权输入 token;使用 capsul 后为 19,300 个。
用 Claude Haiku 4.5 回答一个编程问题要花多少钱?
按 Anthropic 公开标价计算,原始代理每问的流量成本为 US$0.0812,使用 capsul 后为 US$0.0265。Claude 订阅并不按 token 收费;这里的金额用于比较不同模型每问消耗的额度。
Claude Haiku 4.5 的节省有统计依据吗?
有。90% 区间为 ×1.62 至 ×4.49,整体高于一,共测得 30 个单元格。
capsul 会改变 Claude Haiku 4.5 的答案吗?
通过的校验更多:直接运行时为五项中的 2 项,使用 capsul 时为 4 项。五项样本很小,应理解为没有损失,而非确立了提升。