Skip to content

倍率与计费公式 ​

一句话

倍率就是个"价格乘数"——数字越小越便宜。 你在控制台看到的单价,已经是所有倍率乘完之后的最终价,不用自己再算。

✖️ 倍率是什么 ​

倍率(multiplier)是一个乘数,表示相对计费基准的比例——数字越小越便宜。比如:

  • 倍率 0.5 → 基准的一半
  • 倍率 1.0 → 与基准持平
  • 倍率 2.0 → 基准的两倍

本站计费涉及两个倍率:模型倍率(这个模型多贵)和令牌分组倍率(这批线路多贵)。你在控制台看到的单价,是两者都乘完之后的结果。

🧮 一次调用的完整公式 ​

最终扣费由两个倍率决定:

你的最终扣费 = token 用量 × 模型倍率 × 令牌分组倍率
因素谁决定通俗理解
模型倍率(model_ratio)本站按该模型的官方计费成本设定这个模型本身有多贵。同一个模型只有一个模型倍率,不随你走哪个分组变化
令牌分组倍率(group_ratio)你建 Key 时选的令牌分组这批线路有多贵。计费按这个 Key 的令牌分组倍率算;至于你能选哪些令牌分组,由你的用户分组决定

没有"渠道倍率"这一项

本站不按单条渠道给你计价。你能选的是令牌分组,一个分组背后挂着一批渠道;线路质量与价格的差异,全部体现在分组倍率上。详见 渠道与多档价格。

你看到的价格已经乘完了控制台「模型广场」上每个模型显示的单价,已经是按你当前分组乘完的"到手价"——你照着它估钱就行,不需要自己再乘一遍倍率。

🧾 四种计量的单价关系 ​

token 页 讲过:一次调用的 token 分四类——输入、输出、缓存写入、缓存读取。它们不是同一个价,控制台每个模型都分别给出对应倍率,彼此关系大致是:

计量相对输入的单价由哪个倍率决定
输入 token基准(×1)模型倍率(model_ratio)
输出 token通常贵几倍模型倍率 × 补全倍率(completion_ratio)
缓存写入比输入略贵模型倍率 × 缓存写入倍率
缓存读取(命中)比输入便宜很多模型倍率 × 缓存读取倍率

举个实际的(数字随时会变、以 模型广场 当前为准):假设某模型补全倍率 5、缓存写入倍率 1.25、缓存读取倍率 0.6,那相对它的输入价:

  • 输出 ≈ 5 倍输入价——所以"让模型少啰嗦"是最直接的省钱手段
  • 缓存写入 ≈ 1.25 倍输入价——第一次把内容存进缓存略贵一点
  • 缓存读取 ≈ 0.6 倍输入价——后续命中这段更便宜

⚠️ 缓存读取倍率各模型不同,务必以模型广场当前标注为准。 不同模型差别很大(有的 0.1、有的 0.6),不要拿本页的示例数字去估自己的账单。

这四项各自的单价,再乘上你这把 Key 所属的令牌分组倍率,才是你最终为每一类 token 付的钱。控制台「模型广场」会对每个模型分别标出这几档,照着看即可,不用自己心算。

🔢 举个例子感受一下 ​

数字纯属示意,不是真实价格,只为说明怎么乘:

某模型的模型倍率是 2.5(这个数字对所有人都一样,换分组也不变)。 你 Key 选的令牌分组,分组倍率是 0.8。 那这个模型对你的单价系数 = 2.5 × 0.8 = 2.0。

同一个模型,如果你换一把 Key、选了分组倍率 1.5 的分组,就是 2.5 × 1.5 = 3.75——贵了近一倍。 贵的分组一般对应质量/稳定性更好的线路,怎么权衡见 渠道与多档价格。

记住一句话:模型倍率决定"你用的是哪个模型",分组倍率决定"你走的是哪批线路"。同一个模型在控制台出现好几个价,差的永远是后者。

❓ 控制台那个"倍率"标的是什么 ​

你在控制台某些地方会直接看到模型标着一个倍率数字,那是模型倍率——该模型相对官方计费基准的比例。比如标 2.5,就是这个模型按 2.5 倍基准计价。

模型广场 页面顶部另外会显示你当前的分组和分组倍率,页面上每个模型的单价已经是两者乘完之后的结果。

再强调一次:页面上的单价是给你看的到手价,你不用拿倍率去乘第二遍。

💴 为什么我看到的是"人民币 / 美元"不是倍率 ​

为了让你直观,控制台余额和单价都换算成人民币 / 美元显示,按 token 实际消耗扣。你日常完全可以只用"token 数 + 余额"这套来理解花销,倍率是背后的定价机制,知道有这么回事就够了。

🚀 下一步 ​