Appearance
计费说明
易算云平台大模型服务按量计费,以统一计费单位额度进行结算。每次请求的额度消耗由 输入倍率 与 输出倍率 共同决定,不同模型定价不同,消耗的额度也不同。
额度计算公式
消耗额度 = 输入token × 输入倍率 + 输出token × 输出倍率其中:
输出倍率 = 输入倍率 × 补全倍率| 倍率 | 含义 | 通俗解释 |
|---|---|---|
| 输入倍率 | 输入 token 的单价倍数 | 决定这个模型输入部分贵不贵 |
| 输出倍率 | 输出 token 的单价倍数 | 输出通常比输入贵(例如 GPT-4o 输出是输入的 4 倍),因此输出倍率 = 输入倍率 × 补全倍率 |
| 补全倍率 | 输出相对输入的倍数 | 描述输出比输入贵多少倍 |
计费示例
假设某次请求输入 1000 token、输出 300 token,该模型输入倍率为 0.5、补全倍率为 1(即输出倍率 = 0.5 × 1 = 0.5):
消耗额度 = 1000 × 0.5 + 300 × 0.5 = 650若某模型补全倍率更高(输出倍率更高),同等输入输出下消耗的额度会更多;反之选择输入倍率更低的轻量模型则可显著节省额度。
模型计费
不同模型的输入倍率与输出倍率如下,实行动态更新,以平台实时展示为准:
| 模型 | 输入倍率 | 输出倍率 |
|---|---|---|
DeepSeek-V4-Flash | - | - |
GLM-5.2 | - | - |
Kimi-K3 | - | - |
具体倍率数值后续由平台配置,请以 易算控制台 → Token Plan → 模型广场 中的实时信息为准。
如何查看与控制消耗
- 实时查看:在易算控制台查看每次请求消耗的额度与 Token 用量
- 模型选择:选择输入倍率更低、更轻量的模型可有效降低成本
- 控制输出长度:合理设置
max_tokens,并留意输出倍率较高的模型,避免输出过多造成超额消耗 - 额度不足:当剩余额度不足以完成请求时,需升级套餐或提额后重试
注意事项
- 平台支持的模型与倍率会随产品迭代持续更新,请以 易算控制台 → Token Plan → 模型广场 的实时信息为准
- 不同套餐、不同账户可用的模型及倍率可能不同
- 实际计费以平台实时结算为准,具体请以控制台显示为准
- 平台保留相关产品服务定价的最终解释权