跳到正文
OcHub

查看会话与用量

浏览本机对话,并用统一口径分析请求、Token 和成本。

更新于 查看 Markdown
For humans

“会话”关注一段完整对话,“用量”关注请求和统计。两者数据来源不同,所以一条会话可能 包含多次请求,也可能只被扫描到会话而没有网关级延迟数据。

浏览会话

打开会话后,OcHub 会读取本机受支持 CLI 的历史记录。

  1. 使用应用筛选器只看某个工具。
  2. 选择今天、最近 7 天、最近 30 天或自定义时间范围。
  3. 点击“查看”打开完整对话。
  4. 使用“展开详情”查看较长的工具或系统消息。
  5. 返回列表后可重置筛选或刷新扫描。
逐步界面示意点击画面放大,左右方向键切换步骤;蓝色描边是当前要对照的位置。
1
STEP 01打开会话
2
STEP 02按应用和时间筛选
3
STEP 03打开一段对话
4
STEP 04展开长消息详情
5
STEP 05刷新会话列表

会话卡片会汇总消息数量、用户与助手消息、工具或系统消息,以及会话跨度。

认识用量首页

“用量”顶部显示四个汇总指标:

  • 总成本:按当前定价和倍率计算的输入、输出及缓存成本。
  • 总请求数:当前筛选范围内的请求数量与成功率。
  • 真实 Token:输入、输出、缓存创建和缓存读取。
  • 缓存命中:重复输入被缓存读取复用的比例。

趋势图按时间桶显示 Token、成本和请求数量。当前范围少于两个时间桶时不会绘制趋势。

逐步界面示意点击画面放大,左右方向键切换步骤;蓝色描边是当前要对照的位置。
1
STEP 01打开用量
2
STEP 02阅读四项汇总
3
STEP 03选择时间范围
4
STEP 04筛选 Provider 和模型
5
STEP 05打开单条请求
6
STEP 06核对 Token、成本与延迟

筛选与下钻

  1. 先选时间范围。
  2. 再按状态、Provider 或模型缩小范围。
  3. 点击 Provider 统计行,可把整个面板收窄到该 Provider。
  4. 点击模型统计行,可继续筛选模型。
  5. 在请求日志中打开单条记录,查看请求模型、计价模型、Token、缓存、成本、首 Token 和总延迟。
  6. 使用“重置”回到完整范围。

数据来源

OcHub 可能汇总以下来源:

  • 模型供应商请求
  • Claude 会话
  • Codex 数据库或会话
  • OpenCode 会话
  • Gemini 会话
  • 旧版本地请求
  • 手动同步的会话

只有经过本地网关的请求才能稳定提供网关级状态、延迟和请求 ID;从会话文件导入的数据 取决于各 CLI 实际记录的字段。

配置定价

在“模型定价配置”中:

  1. 查看随安装包提供的 LiteLLM 离线价格目录、更新时间和版本。
  2. 使用“立即同步”检查 LiteLLM main 的最新价格;后台也会每天条件检查一次。
  3. 选择按请求模型还是响应模型计费。
  4. 为 Claude 与 Codex 设置默认倍率和计价模型来源。
  5. 只有目录缺价、Provider / 区域价格有歧义,或实际结算价不同时,才填写模型 ID 和每百万 Token 价格来建立手动覆盖。
  6. 保存后刷新用量,确认请求详情中的计价模型和成本。

手动覆盖始终优先,目录同步不会改写它。模型 ID 应与实际日志一致;自定义别名或转发映射 较多时,优先按响应模型计费。缺价模型会集中显示,不会逐条弹窗。

需要理解历史成本回填、缓存 Token 口径与账单校准时,继续阅读 模型定价与成本校准

Navigation

Type to search…

↑↓ navigate↵ selectEsc close