1.6 用量统计(Usage)
看你的组织 / 你自己花了多少 token、调了多少次模型、哪个应用最烧钱、哪个用户最活跃。
进入路径:左侧主导航 → 用量统计(/usage)。
1.6.1 用量总览页 [U]
顶部筛选栏
| 筛选项 | 说明 |
|---|---|
| 渠道 | 全部 / 企微 / 飞书 / 微信客服 / Web Client / OpenAI API / Web 调试 / CLI |
| 时间范围 | 近 24 小时 / 近 7 天 / 近 30 天(Tab 切换) |
| 刷新 | 强制重新拉取数据 |
汇总卡片(UsageSummaryCards)
通常 4 张:
| 卡片 | 内容 |
|---|---|
| 今日 token | input + output 总和 |
| 7 日 token | |
| 30 日 token | |
| 总请求数 | 含成功 + 失败 |
趋势图(UsageTrendChart)
折线图,X 轴时间,Y 轴 token 数。受顶部筛选影响。
三列排行榜
| 维度 | 字段 |
|---|---|
| Top 应用 | 按 application_id 分组,token 消耗 Top 10 |
| Top 模型 | 按 ai_model_id 分组 |
| Top 用户 | 按 sira_user_id 分组 |
每行可点击 → 跳转到 用量详情页 看该实体的多维分析。
最近失败调用(UsageRecentFailures)
近 24 小时内失败的 API 调用列表。常见原因:
- 模型超时
- API Key 失效
- 配额超限
- 上下文超长
每行展开可看具体错误信息。
1.6.2 用量详情 [U]
路径:/usage/{dim}/{id}
dim 是维度,取值之一:
applications— 应用详情agents— 智能体详情users— 用户详情models— 模型详情
id 是该实体的 UUID。
区块说明
顶部 Header
- 返回按钮(回到
/usage) - 维度标签(应用 / 智能体 / 用户 / 模型) + 实体 UUID(可截断)
- 实体显示名称(大标题)
- 右侧:时间范围切换 + 刷新
4 张 Stat 卡片(EntityStatCards)
| 卡片 | 含义 |
|---|---|
| 请求数 | 总调用次数 |
| 成功率 | 百分比 |
| Input Tokens | 输入 token 累计 |
| Output Tokens | 输出 token 累计 |
| 总 Tokens | input + output |
| 成本 (USD) | 按 AI 模型定价 计算的金额 |
(部分版本展示 4 张,部分 6 张,具体看部署)
趋势图
本实体在时间窗口内的 token / 请求数曲线。
两列交叉分析
按当前维度,联动出关联维度的 Top 排行:
| 当前维度 | 左列 | 右列 |
|---|---|---|
| 应用详情 | Top 模型 | Top 用户 |
| 智能体详情 | Top 模型 | Top 应用 |
| 用户详情 | Top 应用 | Top 模型 |
| 模型详情 | Top 应用 | Top 用户 |
每行也可点击,继续钻取到对应维度的详情页。
1.6.3 用法示例
场景 1:这个月谁最费 token?
- 进入
/usage - 时间范围切到「近 30 天」
- 看右下「Top 用户」榜单 → 找到 Top 1
- 点击该用户名 → 进入用户详情
- 看「Top 模型」「Top 应用」交叉分析 → 找出是哪个应用 + 哪个模型组合最贵
场景 2:某个应用的成本异常飙升?
- 进入
/usage→ 看趋势图整体形状 - 切到「近 7 天」看是否有突变
- 点击「Top 应用」中该应用 → 用量详情页
- 看趋势图 → 找异常日期
- 看「Top 用户」 → 是否某个用户疯狂调用
- 翻审计日志 → 查异常时段是否有失败/异常事件
场景 3:对比两个模型的性价比?
- 进入
/usage→ Top 模型榜单 - 分别点 GPT-4 和 DeepSeek-V3 进入详情页
- 对比"请求数 vs 成本"
1.6.4 数据口径说明
| 字段 | 来源 | 备注 |
|---|---|---|
| token | 模型 API 返回的 usage 字段 | 准确,但需要模型实现支持 |
| 成本 | 按模型定价表 × token | 定价由管理员维护,见 AI 模型管理 |
| 请求数 | 后端调用计数 | 包括失败请求 |
| 成功率 | 200 响应数 / 总请求数 |
⚠️ 部分模型(如 streaming 流式调用)可能不返回精确 usage,系统会按估算填充,误差通常 < 5%。
数据延迟
用量数据通常 1~2 分钟内入库,趋势图按 1 小时聚合。如果刚刚发起调用没看到数据,稍等再刷新。
1.6.5 常见问题
Q1:某个用户的请求数远大于 token 数,这正常吗?
可能是大量短调用 / 失败重试。点进该用户详情,看趋势图是否有密集小峰 — 是的话怀疑客户端在循环重试,需要排查应用代码。
Q2:能导出数据吗?
普通用户在前端没有导出按钮。如果你是管理员,可在 审计页 导出原始事件 CSV/JSON,再自己聚合。
Q3:看不到「Top 用户」榜单?
按权限,普通用户只能看到自己的用量,管理员才能看到全组织的用户排行。如果你需要全组织视图,联系管理员或申请 admin 角色。
Q4:成本和实际账单对不上?
可能性:
- 模型定价表过期了 → 让管理员更新
- 部分调用走的是企业自建 / 开源模型,无 token 成本但有算力成本(平台只算 token,不算算力)
- 审计期间有失败重试也会被计入
Q5:数据保留多久?
默认 90 天详细日志 + 2 年聚合数据(具体按部署方设置)。超期数据归档到冷存储,如需查询联系运维。
