Skip to content

读懂仪表盘:请求 / Token / 费用

几个指标的区别

指标含义注意
请求数调用了多少次 API流式输出也计一次请求
Token模型处理的文本量(输入+输出)计费的主要单位
费用(消费)按 Token × 单价计算的实际扣费分组的倍率会影响单价
并发同时进行的请求数上限超出会被限流(429)

仪表盘看什么

  • 用量趋势图:按时间看 Token/请求量变化,定位高峰
  • 模型分布:哪个模型用得最多,方便优化成本
  • 分组统计:不同分组(Claude/GPT/Gemini)各自消耗
  • 余额:实时余额,低于阈值会提醒(需开启 余额提醒

费用怎么算

费用 = Token 消耗 × 模型单价 × 分组倍率
  • 分组倍率由站长设定(1.0 = 原价,2.0 = 两倍)
  • 以「用量记录」中的实际扣费为准

常见误解

  • 流式输出不是"边生成边计费",是按最终完整 Token 计费
  • 缓存命中可能不计费或半价(视站点配置)
  • 图片生成为按张/按尺寸计费,不走 Token

TIP

觉得费用异常?去 用量记录 按密钥和日期筛一次,单条请求详情里能看到输入/输出 Token 与扣费。

仅用于合法合规用途,请遵守服务条款与当地法律法规。