统计页
统计页聚合请求用量,按模型/密钥/分组维度拆解,支持时序展示。数据持久化于数据库,1 分钟粒度。
入口:控制台 → 统计(admin、normal_user、monitor 可见)。
汇总卡片
顶部 7 张卡片,反映所选时段的总量:
| 卡片 | 含义 |
|---|---|
| 总请求数 | 时段内全部请求 |
| 成功请求 | 2xx |
| 错误请求 | 4xx + 5xx |
| 平均延迟 | 毫秒 |
| 输入 Token | 上游计入的输入 token |
| 输出 Token | 上游计入的输出 token |
| 缓存读取 Token | prompt cache 命中的 token |
维度切换
group_by 切换拆解维度:
| 维度 | 主表首列 |
|---|---|
model | 按模型 |
access_key | 按访问密钥(可展开) |
access_key_group | 按密钥组 |
主表其余列:请求数、成功数、错误数、成功率、平均延迟、输入 token、输出 token、缓存读 token。
时间范围
- 预设:
12h(默认)/24h/7d - 自定义:DateRangePicker 选起止时间,支持相对表达式
时序图
按所选时段自动选粒度:≤24h→5 分钟、≤7d→1 小时、≤30d→4 小时。展示 token 用量(按模型 input+output)与请求数(total/success/error)曲线。
导出 Excel
导出入口在计费页(控制台 → 设置 → 计费 → 月度成本):选月份点导出,得到含 6 个 sheet 的 Excel(model / access key / key group / access key × model 模型分布 / day / week 时间维度),费用按币种拆列。详见 导出账单 Excel 与日志排查。
说明
count_tokens请求(Anthropic token 计数端点)不计入统计,因为它不实际调用上游、不产生费用。- 持久化统计按 1 分钟桶存储;当前分钟桶在网关崩溃时会丢失,已完成的分钟桶保留。
- 统计与计费记录的是映射后的最终模型名。若某访问密钥 / 密钥组配了身份作用域模型映射(如
claude-opus-5 → qwen3.7-max),统计页、导出 Excel、账单里只会出现目标名qwen3.7-max的行,不会出现源名claude-opus-5的行——映射对统计与计费完全透明。需要按客户视角的源名归因时,请在客户端侧自行记录。详见 配置身份作用域模型映射。
常见问题
Q:统计里的请求数和日志对不上? 统计是 1 分钟粒度聚合,日志是逐条记录。短时间窗口内可能有最多 1 分钟的刷盘延迟。count_tokens 请求在日志里能看到但不进统计。
Q:token 数偏高? 确认是否把 count_tokens 也算进去了——它不计入统计。若仍偏高,检查是否有上游返回了虚高的 usage 字段。
Q:配了模型映射,为什么统计里看不到客户端请求的那个模型名? 因为统计与计费用的是映射后的最终模型名。客户端请求 claude-opus-5、被映射到 qwen3.7-max 时,统计里只记 qwen3.7-max。这是预期行为,详见 配置身份作用域模型映射。
下一步:总览仪表板 看全局概览;导出账单 Excel 与日志排查 看导出操作;日志查看器 看逐条请求详情。
