主题
倍率与计费公式
一句话
倍率就是个"价格乘数"——数字越小越便宜。 你在控制台看到的单价,已经是所有倍率乘完之后的最终价,不用自己再算。
✖️ 倍率是什么
倍率(multiplier)是一个乘数,表示本站价格相对该模型官方原价的比例。比如:
- 倍率 0.5 → 官方价的一半
- 倍率 1.0 → 与官方原价持平
- 倍率 2.0 → 官方价的两倍
本站定价就是以各模型的官方计费为基准,乘上倍率得到你看到的价格——倍率越低越便宜。
🧮 一次调用的完整公式
最终单价由三个因素相乘得到:
你的最终单价 = 官方原价 × 渠道倍率 × 令牌分组倍率| 因素 | 谁决定 | 通俗理解 |
|---|---|---|
| 官方原价 | OpenAI / Anthropic / Google | 这个模型的官方计费基准 |
| 渠道倍率 | 本站运营 | 走哪条渠道,质量与价格正相关——稳定优质的贵、经济档的便宜 |
| 令牌分组倍率 | 你建 Key 时选的令牌分组 | 计费按这个 Key 的令牌分组的倍率算;至于你能选哪些令牌分组,由你的用户分组决定 |
你看到的价格已经乘完了
控制台 定价页 上每个模型显示的单价,已经是上面三项相乘后的"到手价"——你照着它估钱就行,不需要自己去找原价再乘倍率。
🧾 四种计量的单价关系
token 页 讲过:一次调用的 token 分四类——输入、输出、缓存写入、缓存读取。它们不是同一个价,控制台每个模型都分别给出对应倍率,彼此关系大致是:
| 计量 | 相对输入的单价 | 由哪个倍率决定 |
|---|---|---|
| 输入 token | 基准(×1) | 模型倍率(model_ratio) |
| 输出 token | 通常贵几倍 | 模型倍率 × 补全倍率(completion_ratio) |
| 缓存写入 | 比输入略贵 | 模型倍率 × 缓存写入倍率 |
| 缓存读取(命中) | 比输入便宜很多 | 模型倍率 × 缓存读取倍率 |
举个实际的(数字取自控制台某便宜档模型,随时会变、以 定价页 当前为准):假设某模型补全倍率 5、缓存写入倍率 1.25、缓存读取倍率 0.1,那相对它的输入价:
- 输出 ≈ 5 倍输入价——所以"让模型少啰嗦"是最直接的省钱手段
- 缓存写入 ≈ 1.25 倍输入价——第一次把内容存进缓存略贵一点
- 缓存读取 ≈ 0.1 倍输入价——后续命中这段几乎白送,省约 90%
这四项各自的单价,再乘上前面讲的渠道倍率 × 令牌分组倍率,才是你最终为每一类 token 付的钱。控制台定价页会对每个模型分别标出这几档,照着看即可,不用自己心算。
🔢 举个例子感受一下
数字纯属示意,不是真实价格,只为说明怎么乘:
某模型官方原价是 X。 你走的是稳定渠道(渠道倍率 1.2),你 Key 用的令牌分组有折扣(令牌分组倍率 0.8)。 那这个模型对你的最终单价 = X × 1.2 × 0.8 = 0.96 X。
同样的模型,如果你换走经济渠道(渠道倍率 0.7),最终就是 X × 0.7 × 0.8 = 0.56 X——便宜不少,但经济渠道稳定性会差一些。
❓ 控制台那个"倍率"标的是什么
你在控制台某些地方会直接看到模型标着一个倍率数字,它表示该模型相对官方原价的最终比例。比如标 2.0,就是本站这个模型的价格是官方原价的 2 倍(已包含运营成本)。
再强调一次:这是给你看的参考值,最终单价已经按它算好了,你不用拿它去乘第二遍。
💴 为什么我看到的是"人民币 / 美元"不是倍率
为了让你直观,控制台余额和单价都换算成人民币 / 美元显示,按 token 实际消耗扣。你日常完全可以只用"token 数 + 余额"这套来理解花销,倍率是背后的定价机制,知道有这么回事就够了。