计费实践 · 更新于 2026-10-03
一次调用有缓存时,积分费用怎样算?
用一个完整算式区分总输入、普通输入与缓存,避免把缓存重复算进费用。
为什么不能只看输入总量
带缓存的请求中,同样是输入 10000 Token,费用可能不同,因为普通输入、缓存读取与缓存创建可以使用不同价格。
下面使用演算价格,不代表任何模型的当前售价。实际价格请查看所选分组的模型卡片。
示例数据
- 输入总量:10000,其中普通输入 1000、缓存读取 6000、缓存创建 3000。
- 输出:2000。
- 输入单价:10 积分 / 1M;输出:20 积分 / 1M。
- 读取单价:1 积分 / 1M;创建:12.5 积分 / 1M。
缓存创建价格配置仅用于 Claude 模型;这里只演示有创建缓存的计费场景。
分项计算
普通输入:1000 × 10 / 1000000 = 0.01
缓存读取:6000 × 1 / 1000000 = 0.006
缓存创建:3000 × 12.5 / 1000000 = 0.0375
输出:2000 × 20 / 1000000 = 0.04
合计:0.0935 积分若这 10000 输入全部按 10 积分 / 1M 的普通输入价计算,加上输出则是 0.14 积分。两者区别来自缓存明细,不是把总输入、读取和创建三份量重复相加。
命中率与费用不是一回事
该请求命中率是 6000 / 10000 = 60%。命中率越高是否越省钱,还要看具体缓存价格;创建缓存也可能比普通输入单价更高。
页面价格为了易读会取整显示,实际计费使用完整价格与内部额度单位,最终记录可能有微小取整差异。
如何核对自己的调用
打开用量明细,核对模型、分组、Token 数和缓存字段。上游未报告缓存明细时,不能按相似输入自行推算命中。