Skip to content

计费说明 ​

易算云平台大模型服务按量计费,以统一计费单位额度进行结算。每次请求的额度消耗由 输入倍率 与 输出倍率 共同决定,不同模型定价不同,消耗的额度也不同。

额度计算公式 ​

消耗额度 = 输入token × 输入倍率 + 输出token × 输出倍率

其中:

输出倍率 = 输入倍率 × 补全倍率
倍率含义通俗解释
输入倍率输入 token 的单价倍数决定这个模型输入部分贵不贵
输出倍率输出 token 的单价倍数输出通常比输入贵(例如 GPT-4o 输出是输入的 4 倍),因此输出倍率 = 输入倍率 × 补全倍率
补全倍率输出相对输入的倍数描述输出比输入贵多少倍

计费示例 ​

假设某次请求输入 1000 token、输出 300 token,该模型输入倍率为 0.5、补全倍率为 1(即输出倍率 = 0.5 × 1 = 0.5):

消耗额度 = 1000 × 0.5 + 300 × 0.5 = 650

若某模型补全倍率更高(输出倍率更高),同等输入输出下消耗的额度会更多;反之选择输入倍率更低的轻量模型则可显著节省额度。

模型计费 ​

不同模型的输入倍率与输出倍率如下,实行动态更新,以平台实时展示为准:

模型输入倍率输出倍率
DeepSeek-V4-Flash--
GLM-5.2--
Kimi-K3--

具体倍率数值后续由平台配置,请以 易算控制台 → Token Plan → 模型广场 中的实时信息为准。

如何查看与控制消耗 ​

  • 实时查看:在易算控制台查看每次请求消耗的额度与 Token 用量
  • 模型选择:选择输入倍率更低、更轻量的模型可有效降低成本
  • 控制输出长度:合理设置 max_tokens,并留意输出倍率较高的模型,避免输出过多造成超额消耗
  • 额度不足:当剩余额度不足以完成请求时,需升级套餐或提额后重试

注意事项 ​

  • 平台支持的模型与倍率会随产品迭代持续更新,请以 易算控制台 → Token Plan → 模型广场 的实时信息为准
  • 不同套餐、不同账户可用的模型及倍率可能不同
  • 实际计费以平台实时结算为准,具体请以控制台显示为准
  • 平台保留相关产品服务定价的最终解释权