费率计算
计费原理
ZeoAPI 采用按量计费模式,实际消耗以 API 返回的用量为准。
倍率机制
不同令牌分组有不同的计费倍率:
- 倍率 < 1:享受折扣,如 0.5x 表示半价
- 倍率 = 1:标准价格
- 倍率 > 1:需要加价,如 1.5x 表示额外支付 50%
计算示例
假设您选择了 0.5x 倍率的令牌分组:
实际消耗 = API 返回用量
应付金额 = 实际消耗 × 0.5
假设您选择了 1.5x 倍率的令牌分组:
实际消耗 = API 返回用量
应付金额 = 实际消耗 × 1.5
长短上下文分档计费
部分模型采用分档计费(动态计费):根据请求的上下文长度落入不同价格档位,例如「标准档(长度 ≤ 200K)」与「长上下文档(长度 > 200K)」,各档位的输入、输出、缓存单价不同。
在定价页面,这类模型会显示「动态计费」标签,点击可查看完整的分档价格表,每一档都标注了具体的 token 边界(如「长度 ≤ 200K」)与各计费维度单价。
判档依据:上下文长度(含缓存读写)
档位由完整的输入上下文长度决定,这个长度包含缓存读取和缓存创建的 token,不只是纯文本:
上下文长度 = 输入文本 + 缓存读取 + 缓存创建
也就是说,即使某次请求的新增文本很少,只要加上命中的缓存后总上下文超过档位边界(如 200K),就会落入长上下文档。这与上游模型厂商(如 Claude、Gemini)的长上下文计费口径一致。
判档 vs 计费的区别
这是两个独立的步骤,请勿混淆:
- 判档(选哪一档):用完整上下文长度(含缓存读写)与档位边界比较,决定整个请求走哪一档单价。
- 计费(算多少钱):在选定的档位内,各维度分别按各自单价计算——输入文本、输出、缓存读取、缓存创建各有单价,缓存 token 按缓存单价单独计价,不会重复计入输入价。
示例(标准档,单价 输入 $3 / 输出 $15 / 缓存读 $0.3,均按每 1M tokens):
输入文本 172 + 输出 65 + 缓存读 1280(总上下文 1452,≤ 200K → 标准档)
费用 = 172×$3 + 65×$15 + 1280×$0.3 (每项按各自单价,缓存单独计价)
÷ 1,000,000 × 分组倍率
WARNING
分档是整档选择,不是分段累进:一旦上下文超过边界,整个请求都按高档单价计费(与厂商口径一致),而非仅超出部分按高价。因此临近边界的请求,长度略增可能导致整体单价跳档。
查看用量
登录控制台,在「钱包管理」页面可以查看详细的用量明细和费用统计。
TIP
建议定期查看用量统计,确保费用在预期范围内。