“会话”关注一段完整对话,“用量”关注请求和统计。两者数据来源不同,所以一条会话可能 包含多次请求,也可能只被扫描到会话而没有网关级延迟数据。
浏览会话
打开会话后,OcHub 会读取本机受支持 CLI 的历史记录。
- 使用应用筛选器只看某个工具。
- 选择今天、最近 7 天、最近 30 天或自定义时间范围。
- 点击“查看”打开完整对话。
- 使用“展开详情”查看较长的工具或系统消息。
- 返回列表后可重置筛选或刷新扫描。
逐步界面示意点击画面放大,左右方向键切换步骤;蓝色描边是当前要对照的位置。
STEP 01打开会话
STEP 02按应用和时间筛选
STEP 03打开一段对话
STEP 04展开长消息详情
STEP 05刷新会话列表
会话卡片会汇总消息数量、用户与助手消息、工具或系统消息,以及会话跨度。
认识用量首页
“用量”顶部显示四个汇总指标:
- 总成本:按当前定价和倍率计算的输入、输出及缓存成本。
- 总请求数:当前筛选范围内的请求数量与成功率。
- 真实 Token:输入、输出、缓存创建和缓存读取。
- 缓存命中:重复输入被缓存读取复用的比例。
趋势图按时间桶显示 Token、成本和请求数量。当前范围少于两个时间桶时不会绘制趋势。
逐步界面示意点击画面放大,左右方向键切换步骤;蓝色描边是当前要对照的位置。
STEP 01打开用量
STEP 02阅读四项汇总
STEP 03选择时间范围
STEP 04筛选 Provider 和模型
STEP 05打开单条请求
STEP 06核对 Token、成本与延迟
筛选与下钻
- 先选时间范围。
- 再按状态、Provider 或模型缩小范围。
- 点击 Provider 统计行,可把整个面板收窄到该 Provider。
- 点击模型统计行,可继续筛选模型。
- 在请求日志中打开单条记录,查看请求模型、计价模型、Token、缓存、成本、首 Token 和总延迟。
- 使用“重置”回到完整范围。
数据来源
OcHub 可能汇总以下来源:
- 模型供应商请求
- Claude 会话
- Codex 数据库或会话
- OpenCode 会话
- Gemini 会话
- 旧版本地请求
- 手动同步的会话
只有经过本地网关的请求才能稳定提供网关级状态、延迟和请求 ID;从会话文件导入的数据 取决于各 CLI 实际记录的字段。
配置定价
在“模型定价配置”中:
- 查看随安装包提供的 LiteLLM 离线价格目录、更新时间和版本。
- 使用“立即同步”检查 LiteLLM
main的最新价格;后台也会每天条件检查一次。 - 选择按请求模型还是响应模型计费。
- 为 Claude 与 Codex 设置默认倍率和计价模型来源。
- 只有目录缺价、Provider / 区域价格有歧义,或实际结算价不同时,才填写模型 ID 和每百万 Token 价格来建立手动覆盖。
- 保存后刷新用量,确认请求详情中的计价模型和成本。
手动覆盖始终优先,目录同步不会改写它。模型 ID 应与实际日志一致;自定义别名或转发映射 较多时,优先按响应模型计费。缺价模型会集中显示,不会逐条弹窗。
需要理解历史成本回填、缓存 Token 口径与账单校准时,继续阅读 模型定价与成本校准。

