Skip to content

价格说明

实时价格以控制台为准

本页只解释计费机制。每个模型的最终单价随上游政策动态调整,唯一可靠的价格表是控制台 模型 / 定价页——文档里写死任何数字都会很快过期。

💵 计费基本盘

  • 按 token 实际用量计费——没有月费、没有套餐门槛(单次充值最低 ¥50)
  • 预付费——账户余额扣完为止;余额不足时调用直接返 402,不会透支
  • 结算单位 = token;控制台余额按人民币 / 美元显示,每次调用按当次消耗的 token 数 × 单价从余额里扣
  • 四类计量分开计价:输入 token、输出 token、缓存写入、缓存读取(命中)——输出通常比输入贵几倍,缓存读取命中后大幅折扣;概念与倍率关系见 Token 与计费单位四种计量的单价

🧮 一次调用的价格怎么算

实际扣费由 3 个因素相乘决定:

扣费 = 官方原价 × 渠道倍率 × 令牌分组倍率
因素谁决定含义
官方原价OpenAI / Anthropic / Google本站以各模型的官方计费为基准
渠道倍率本站运营走哪条渠道,质量与价格正相关——稳定优质的贵、经济档的便宜
令牌分组倍率你建 Key 时选的令牌分组计费按这个 Key 的令牌分组倍率算;能选哪些令牌分组由你的用户分组决定

控制台 定价页 上看到的"单价"已经是乘完三项后的最终用户价——你不用自己算。带数字的算例、以及"控制台那个倍率标的到底是什么" → 倍率与计费公式

🏷️ 为什么同一个模型有多个价格档

同一个模型(比如 claude-sonnet-4-6)控制台可能显示多档价格,对应由不同渠道提供——渠道质量与倍率(价格)通常成正相关,质量越好越稳越贵

档位特点适合
稳定优质档质量最好、最稳,价格最高生产环境、关键业务
高性价比档质量稳定、价格适中开发测试、个人使用
经济档价格最低,可用性偶有波动价格敏感且能接受偶发不可用

WARNING

便宜不等于划算。如果你跑的是定时任务 / 生产业务,经济档间歇性不可用导致的失败成本可能远超差价。开发测试随便用,生产稳重选。

渠道为什么让同一模型有多档价、怎么挑档,完整机制 → 渠道与多档价格

🎖️ 用户分组决定你能选哪些令牌分组

计费用的是令牌分组倍率(见上),而你能选用哪些令牌分组由你的用户分组决定——更优惠的令牌分组可能只对更高档的用户分组开放。用户分组由管理员分配,本站没有"按充值额自动升档"的等级阶梯,想开放更优惠的分组请 联系客服 评估。

你当前所属的分组可以在控制台「个人设置」页(或「数据看板」顶部)看到的「用户分组」字段查到。

📊 多少钱算"够用"

这张表只是直觉级参考

模型选择是 10×-50× 的变量——同样的对话量,用 Haiku 和用 Opus 4.7 月账单能差两个数量级。下面数字按"模型档位选对"估算,以控制台实际价为准。

场景用什么档位月用量参考
个人偶尔聊天 / 写作便宜档(mini / haiku / flash 类)¥50-150
同上但偏重顶级模型顶级档(opus 顶配 / 最贵 GPT 档)¥300-1000
日常配 Claude Code / Cursor 写代码中档(sonnet 主力 / 主流 GPT 系)¥300-1500
同上但偏重顶级长任务顶级档¥1500-5000
重度 Agent 工作流(每天数小时 + 顶级模型主力)顶级档 + 大量上下文¥3000-10000+
团队 / 小型业务 API 调用按业务量评估——

不再列具体型号

模型名几周一变(更新、改名、下线),文档写死过时太快。有哪些可用模型 + 实时单价永远以 控制台模型 / 定价页 为准。当前主流的便宜 / 中档 / 顶级各家都有,到那里挑就行。

估算的钱不知道够不够时,做这件事

先充 ¥50 跑两三天,看 日志 实际消耗速度——你的 prompt 长度、模型档、调用频率三个变量都拍下来后,再决定要不要加充到月预算。一开始按上面的表估,多半要么严重高估要么严重低估。

单次充值最低 ¥50,第一次从 ¥50 起步即可——正好够确认链路 + 跑通几个真实场景、验证持续用量。本站余额永久有效,不存在"充多了浪费"。

💳 充值方式

  • 支付宝:即时到账(经 Z-Pay 易支付协议接入),当前唯一的在线支付方式

暂不支持微信 / 信用卡 / PayPal / USDT。对公 / 大额需求先 联系客服 评估

🧾 需要开票:累计满 ¥500 可开(可多笔累计),额外收 3% 税点。确定要开票的建议充值前先联系客服,由客服安排最省事(已自助充值的也能开)。见 售前售后 § 发票

充值流程详见 充值

↩️ 退款 / 余额结算

  • 已消耗的 token 不退
  • 订阅套餐 / 折扣 / 满赠 / 活动类充值一经支付不退(入口处有显式二次确认,不点不会扣款)
  • 普通充值未消费部分按阶梯:24h 内扣 10% / 24h-7 天扣 25% / 超过 7 天不退
  • 完整规则(含混合充值的扣减优先级)→ 售前售后 § 退款政策
  • 如怀疑某笔消耗异常,可 联系客服 核查

💡 怎么省钱

节省幅度代价
测试 / 探索阶段用便宜档(mini / haiku / flash 系),生产 / 关键任务才用贵档10-50×模型能力差异,按需选
控制单次会话长度,agent 流定期 /clear2-5×失去长上下文连续性
用桌面客户端的 "max tokens" 限制单次响应长度1.5-3×长回答会被截断
给 Agent 用的 Key 单独建一个并 设额度上限上限内跑飞了只烧这个 Key 的预算

关于"prompt 缓存"

有些上游模型支持 prompt caching,能让重复的 system prompt 部分以折扣价计费。OpenAI 兼容路径下多为上游自动生效,不需要你做任何配置Anthropic 原生路径部分场景需要在请求里显式标记要缓存的部分cache_control),详见 进阶技巧。本站不提供"打开缓存"的开关,缓存命中情况以上游返回的 usage 字段为准。

❓ 常见问题

控制台显示的 "倍率" 是什么意思

倍率 = 该模型相对官方原价的比例。比如倍率 2.0 表示该模型在本站的价格是官方原价的 2 倍(包含运营 / 服务成本)。你看到的最终单价已经包含倍率了,不用自己再乘

价格会涨吗

会随上游成本变动即时调整(不预告固定提前期)——上游说涨就涨,下游硬撑会贴钱补不动。调整后会立即在站内公告告知。已发生的扣费按当时倍率算,不回溯。

不同模型的 input / output token 价格不一样吗

是的。绝大多数 LLM 模型的 output token 单价 ~3-5× 于 input token——因为生成成本远高于读取成本。这意味着"长 prompt + 短回答"比"短 prompt + 长回答"便宜得多。

🚀 下一步