计费实践 · 更新于 2026-10-03

一次调用有缓存时,积分费用怎样算?

用一个完整算式区分总输入、普通输入与缓存,避免把缓存重复算进费用。

为什么不能只看输入总量

带缓存的请求中,同样是输入 10000 Token,费用可能不同,因为普通输入、缓存读取与缓存创建可以使用不同价格。

下面使用演算价格,不代表任何模型的当前售价。实际价格请查看所选分组的模型卡片。

示例数据

  • 输入总量:10000,其中普通输入 1000、缓存读取 6000、缓存创建 3000。
  • 输出:2000。
  • 输入单价:10 积分 / 1M;输出:20 积分 / 1M。
  • 读取单价:1 积分 / 1M;创建:12.5 积分 / 1M。

缓存创建价格配置仅用于 Claude 模型;这里只演示有创建缓存的计费场景。

分项计算

普通输入:1000 × 10 / 1000000 = 0.01
缓存读取:6000 × 1 / 1000000 = 0.006
缓存创建:3000 × 12.5 / 1000000 = 0.0375
输出:2000 × 20 / 1000000 = 0.04
合计:0.0935 积分

若这 10000 输入全部按 10 积分 / 1M 的普通输入价计算,加上输出则是 0.14 积分。两者区别来自缓存明细,不是把总输入、读取和创建三份量重复相加。

命中率与费用不是一回事

该请求命中率是 6000 / 10000 = 60%。命中率越高是否越省钱,还要看具体缓存价格;创建缓存也可能比普通输入单价更高。

页面价格为了易读会取整显示,实际计费使用完整价格与内部额度单位,最终记录可能有微小取整差异。

如何核对自己的调用

打开用量明细,核对模型、分组、Token 数和缓存字段。上游未报告缓存明细时,不能按相似输入自行推算命中。

缓存价格和命中率说明

查看当前售价