读懂仪表盘:请求 / Token / 费用
几个指标的区别
| 指标 | 含义 | 注意 |
|---|---|---|
| 请求数 | 调用了多少次 API | 流式输出也计一次请求 |
| Token | 模型处理的文本量(输入+输出) | 计费的主要单位 |
| 费用(消费) | 按 Token × 单价计算的实际扣费 | 分组的倍率会影响单价 |
| 并发 | 同时进行的请求数上限 | 超出会被限流(429) |
仪表盘看什么
- 用量趋势图:按时间看 Token/请求量变化,定位高峰
- 模型分布:哪个模型用得最多,方便优化成本
- 分组统计:不同分组(Claude/GPT/Gemini)各自消耗
- 余额:实时余额,低于阈值会提醒(需开启 余额提醒)
费用怎么算
费用 = Token 消耗 × 模型单价 × 分组倍率- 分组倍率由站长设定(1.0 = 原价,2.0 = 两倍)
- 以「用量记录」中的实际扣费为准
常见误解
- 流式输出不是"边生成边计费",是按最终完整 Token 计费
- 缓存命中可能不计费或半价(视站点配置)
- 图片生成为按张/按尺寸计费,不走 Token
TIP
觉得费用异常?去 用量记录 按密钥和日期筛一次,单条请求详情里能看到输入/输出 Token 与扣费。
