什么是用量与计费?
每次 API 调用都会消耗配额并生成一条计费记录。本指南将向您展示在哪里查看用量以及费用是如何计算的。每次请求前都会检查配额。如果余额不足,请求将被拒绝。详情请参阅限制与前提条件。
配额工作原理
Model Router 使用两阶段配额系统:- 预扣费:在处理您的请求之前,系统会检查并预留配额
- 结算:请求完成后,根据实际用量计费;失败的请求会回滚预留的配额

您只需为成功的请求按实际 token 用量付费。
在控制台的哪里查看
所有用量与计费视图都位于控制台侧边栏的 Billing 下:
在团队空间中,团队级统计(成员排名、消耗趋势、模型用量)位于团队的 Stats 标签页——参阅团队协作。
查看单次调用计费
- 打开 Billing → Logs
- 点击任意调用查看其详情:
- 输入/输出定价:每个 token 的费用
- 转换过程:费用的计算方式
- 实际扣除配额:消耗了多少配额
- 配额来源:个人、团队还是混合


理解计费详情
- 输入 token:您发送给模型的 token 费用
- 输出 token:模型生成的 token 费用
- 总费用:输入 + 输出
- 配额来源:个人配额、共享的团队配额,或两者混合——根据您当前的空间上下文进行校验
模型定价
在控制台的可用模型页面查看各模型的定价。此处显示的定价属于参考元数据;实际费用在结算时根据真实用量计算。重要说明
- 配额限制:余额不足时请求将被拒绝——在持续负载前请先在 Billing → Credits 充值。
- 上下文很重要:个人上下文和团队上下文使用不同的配额池;在自动化之前请确认当前所处的空间。
- 实时更新:用量统计会随您的调用同步更新。
故障排除
”配额不足”错误
- 在 Billing → Overview 检查您的余额
- 充值额度,或请团队管理员提高您的成员配额
- 确认您处于预期的空间(个人还是团队)
意外扣费
- 在 Billing → Logs 中打开该次调用
- 检查输入/输出 token 数量和转换明细
- 与可用模型页面上该模型的定价进行对比