Skip to content

1.6 用量统计(Usage)

看你的组织 / 你自己花了多少 token、调了多少次模型、哪个应用最烧钱、哪个用户最活跃。

进入路径:左侧主导航 → 用量统计(/usage)。


1.6.1 用量总览页 [U]

截图:用量总览

顶部筛选栏

筛选项说明
渠道全部 / 企微 / 飞书 / 微信客服 / Web Client / OpenAI API / Web 调试 / CLI
时间范围近 24 小时 / 近 7 天 / 近 30 天(Tab 切换)
刷新强制重新拉取数据

汇总卡片(UsageSummaryCards)

通常 4 张:

卡片内容
今日 tokeninput + output 总和
7 日 token
30 日 token
总请求数含成功 + 失败

趋势图(UsageTrendChart)

折线图,X 轴时间,Y 轴 token 数。受顶部筛选影响。

三列排行榜

维度字段
Top 应用application_id 分组,token 消耗 Top 10
Top 模型ai_model_id 分组
Top 用户sira_user_id 分组

每行可点击 → 跳转到 用量详情页 看该实体的多维分析。

最近失败调用(UsageRecentFailures)

近 24 小时内失败的 API 调用列表。常见原因:

  • 模型超时
  • API Key 失效
  • 配额超限
  • 上下文超长

每行展开可看具体错误信息。


1.6.2 用量详情 [U]

路径:/usage/{dim}/{id}

dim 是维度,取值之一:

  • applications — 应用详情
  • agents — 智能体详情
  • users — 用户详情
  • models — 模型详情

id 是该实体的 UUID。

截图:用量详情页(应用维度)

区块说明

顶部 Header

  • 返回按钮(回到 /usage)
  • 维度标签(应用 / 智能体 / 用户 / 模型) + 实体 UUID(可截断)
  • 实体显示名称(大标题)
  • 右侧:时间范围切换 + 刷新

4 张 Stat 卡片(EntityStatCards)

卡片含义
请求数总调用次数
成功率百分比
Input Tokens输入 token 累计
Output Tokens输出 token 累计
总 Tokensinput + output
成本 (USD)AI 模型定价 计算的金额

(部分版本展示 4 张,部分 6 张,具体看部署)

趋势图

本实体在时间窗口内的 token / 请求数曲线。

两列交叉分析

按当前维度,联动出关联维度的 Top 排行:

当前维度左列右列
应用详情Top 模型Top 用户
智能体详情Top 模型Top 应用
用户详情Top 应用Top 模型
模型详情Top 应用Top 用户

每行也可点击,继续钻取到对应维度的详情页。


1.6.3 用法示例

场景 1:这个月谁最费 token?

  1. 进入 /usage
  2. 时间范围切到「近 30 天」
  3. 看右下「Top 用户」榜单 → 找到 Top 1
  4. 点击该用户名 → 进入用户详情
  5. 看「Top 模型」「Top 应用」交叉分析 → 找出是哪个应用 + 哪个模型组合最贵

场景 2:某个应用的成本异常飙升?

  1. 进入 /usage → 看趋势图整体形状
  2. 切到「近 7 天」看是否有突变
  3. 点击「Top 应用」中该应用 → 用量详情页
  4. 看趋势图 → 找异常日期
  5. 看「Top 用户」 → 是否某个用户疯狂调用
  6. 审计日志 → 查异常时段是否有失败/异常事件

场景 3:对比两个模型的性价比?

  1. 进入 /usage → Top 模型榜单
  2. 分别点 GPT-4 和 DeepSeek-V3 进入详情页
  3. 对比"请求数 vs 成本"

1.6.4 数据口径说明

字段来源备注
token模型 API 返回的 usage 字段准确,但需要模型实现支持
成本按模型定价表 × token定价由管理员维护,见 AI 模型管理
请求数后端调用计数包括失败请求
成功率200 响应数 / 总请求数

⚠️ 部分模型(如 streaming 流式调用)可能不返回精确 usage,系统会按估算填充,误差通常 < 5%。

数据延迟

用量数据通常 1~2 分钟内入库,趋势图按 1 小时聚合。如果刚刚发起调用没看到数据,稍等再刷新。


1.6.5 常见问题

Q1:某个用户的请求数远大于 token 数,这正常吗?

可能是大量短调用 / 失败重试。点进该用户详情,看趋势图是否有密集小峰 — 是的话怀疑客户端在循环重试,需要排查应用代码。

Q2:能导出数据吗?

普通用户在前端没有导出按钮。如果你是管理员,可在 审计页 导出原始事件 CSV/JSON,再自己聚合。

Q3:看不到「Top 用户」榜单?

按权限,普通用户只能看到自己的用量,管理员才能看到全组织的用户排行。如果你需要全组织视图,联系管理员或申请 admin 角色。

Q4:成本和实际账单对不上?

可能性:

  1. 模型定价表过期了 → 让管理员更新
  2. 部分调用走的是企业自建 / 开源模型,无 token 成本但有算力成本(平台只算 token,不算算力)
  3. 审计期间有失败重试也会被计入

Q5:数据保留多久?

默认 90 天详细日志 + 2 年聚合数据(具体按部署方设置)。超期数据归档到冷存储,如需查询联系运维。

Apache-2.0 Licensed