ZeoAPIZeoAPI API 文档与接入指南
deep-dive

费率计算

计费原理

ZeoAPI 采用按量计费模式,实际消耗以 API 返回的用量为准。

倍率机制

不同令牌分组有不同的计费倍率:

  • 倍率 < 1:享受折扣,如 0.5x 表示半价
  • 倍率 = 1:标准价格
  • 倍率 > 1:需要加价,如 1.5x 表示额外支付 50%

计算示例

假设您选择了 0.5x 倍率的令牌分组:

实际消耗 = API 返回用量
应付金额 = 实际消耗 × 0.5

假设您选择了 1.5x 倍率的令牌分组:

实际消耗 = API 返回用量
应付金额 = 实际消耗 × 1.5

长短上下文分档计费

部分模型采用分档计费(动态计费):根据请求的上下文长度落入不同价格档位,例如「标准档(长度 ≤ 200K)」与「长上下文档(长度 > 200K)」,各档位的输入、输出、缓存单价不同。

在定价页面,这类模型会显示「动态计费」标签,点击可查看完整的分档价格表,每一档都标注了具体的 token 边界(如「长度 ≤ 200K」)与各计费维度单价。

判档依据:上下文长度(含缓存读写)

档位由完整的输入上下文长度决定,这个长度包含缓存读取和缓存创建的 token,不只是纯文本:

上下文长度 = 输入文本 + 缓存读取 + 缓存创建

也就是说,即使某次请求的新增文本很少,只要加上命中的缓存后总上下文超过档位边界(如 200K),就会落入长上下文档。这与上游模型厂商(如 Claude、Gemini)的长上下文计费口径一致。

判档 vs 计费的区别

这是两个独立的步骤,请勿混淆:

  • 判档(选哪一档):用完整上下文长度(含缓存读写)与档位边界比较,决定整个请求走哪一档单价。
  • 计费(算多少钱):在选定的档位内,各维度分别按各自单价计算——输入文本、输出、缓存读取、缓存创建各有单价,缓存 token 按缓存单价单独计价,不会重复计入输入价。
示例(标准档,单价 输入 $3 / 输出 $15 / 缓存读 $0.3,均按每 1M tokens):
  输入文本 172 + 输出 65 + 缓存读 1280(总上下文 1452,≤ 200K → 标准档)
  费用 = 172×$3 + 65×$15 + 1280×$0.3  (每项按各自单价,缓存单独计价)
       ÷ 1,000,000 × 分组倍率

WARNING

分档是整档选择,不是分段累进:一旦上下文超过边界,整个请求都按高档单价计费(与厂商口径一致),而非仅超出部分按高价。因此临近边界的请求,长度略增可能导致整体单价跳档。

查看用量

登录控制台,在「钱包管理」页面可以查看详细的用量明细和费用统计。

TIP

建议定期查看用量统计,确保费用在预期范围内。