Billing
计费说明
计费以实际调用模型、输入 / 输出 Token、缓存用量、账户分组及调用发生时生效的规则为准。控制台和模型广场是最终计费显示来源。
当前参考价格
单位:美元 / 1M tokens。价格可能调整,请以平台实时显示为准。
| 模型 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
| MiMo-V2.5 | $0.14 | $0.28 | $0.0028 |
| Muse Spark 1.2 Contributor | $0.10 | $0.20 | $0.002 |
| Hy3 | $0.14 | $0.58 | $0.035 |
| DeepSeek V4 Flash · Off-Peak | $0.22 | $0.66 | $0.007 |
| DeepSeek V4 Flash · Peak | $0.44 | $1.32 | $0.014 |
DeepSeek V4 Flash 峰值时段:UTC 01:00–04:00、06:00–10:00;其他时间为 Off-Peak。北京时间对应 09:00–12:00、14:00–18:00。
账户额度
当前 995api 不提供在线充值。账户额度通过管理员提供的 CDKey / 兑换码获取。兑换成功后可在控制台查看余额与消费记录。
缓存计费
如果模型支持缓存计费,缓存读取 Token 可能采用独立价格。是否产生缓存命中、命中多少、是否存在缓存写入费用,由具体模型与请求行为决定。
为什么实际消费和“单次消息”不完全成比例
长上下文、Agent 工具循环、模型输出长度、缓存命中率和重试都会影响实际 Token 消耗。对于持续运行的编程 Agent,应结合控制台用量记录评估成本,而不是只按消息条数估算。