近期,我们对部分模型价格进行了下调。为了方便大家对比,下面直接列出 最开始 和 本次调整后 的价格,并估算整体优惠区间。
1. 计费方式说明
| 阶段 | 计费方式 |
|---|---|
| 最开始 | 固定 $0.01 / 次,所有模型统一按请求次数计费 |
| 本次调整后 | 按输入/输出 token 计费,单价如下 |
注:最开始为固定按次计费,本次调整后为按 token 计费,两者无法直接精确换算,实际差异取决于单次请求的输入/输出 token 量。
2. 价格对比:最开始 → 本次调整后
本次调整后单位:每 1M tokens
| 模型 | 最开始 | 本次调整后 |
|---|---|---|
| space-bunny | $0.01 / 次 | 输入 $0.008 / 输出 $0.0048 |
| fledge-alpha | $0.01 / 次 | 输入 $0.008 / 输出 $0.0048 |
| big-pickle | $0.01 / 次 | 输入 $0.0224 / 输出 $0.00896 |
| ling-3.1-flash | $0.01 / 次 | 输入 $0.0224 / 输出 $0.00896 |
| mimo-v2.5 | $0.01 / 次 | 输入 $0.0224 / 输出 $0.00896 |
| longcat-2.5-preview | $0.01 / 次 | 输入 $0.12 / 输出 $0.0944 |
| nemotron-3.5-lightning | $0.01 / 次 | 输入 $0.00952 / 输出 $0.00544 |
| nemotron-3-ultra | $0.01 / 次 | 输入 $0.01428 / 输出 $0.00816 |
| grok-4.7 | $0.01 / 次 | 输入 $0.36 / 输出 $0.072 |
| grok-4.6 | $0.01 / 次 | 输入 $0.36 / 输出 $0.072 |
| grok-4.5 | $0.01 / 次 | 输入 $0.36 / 输出 $0.072 |
3. 优惠幅度估算
由于最开始是固定 $0.01 / 次,现在按输入/输出 token 计费,无法直接统一换算。以下按常见请求规模做估算:
-
轻量短请求(约 1k 输入 + 500 输出):
本次单次成本约 $0.0000104 ~ $0.000396,对比最开始 $0.01 / 次,优惠约 96% ~ 99.9%。 -
中等请求(约 10k 输入 + 5k 输出):
本次单次成本约 $0.000104 ~ $0.00396,对比最开始 $0.01 / 次,优惠约 60% ~ 99%。 -
综合日常测试、开发、批量调用场景:
整体优惠大致在 60% ~ 99.9% 区间。
如果请求特别长、输入/输出 token 很多,成本会继续上升,优惠会收窄,最终请以实际 token 用量和调用记录为准。
表格中的本次调整后价格为 test 分组示例价格,实际费用还会受到输入输出 token 数量、缓存命中情况以及具体分组倍率影响,最终以模型广场和调用记录中的实际价格为准。
4. 后续说明与感谢
市场变化很快,我们会继续关注新的模型、新的服务以及大家的使用反馈。如果后续还有进一步优化价格的空间,我们也会继续进行相应调整。
感谢大家一直以来的支持。希望这次降价之后,大家可以更放心地调用模型,多测试、多尝试,把更多额度用在真正有价值的地方。
