---
title: "查看会话与用量"
description: "浏览本机对话，并用统一口径分析请求、Token 和成本。"
version: "zh"
---

> Documentation Index
> Fetch the complete documentation index at: https://docs.ochub.org/zh/llms.txt
> Use this file to discover all available pages before exploring further.

# 查看会话与用量

“会话”关注一段完整对话，“用量”关注请求和统计。两者数据来源不同，所以一条会话可能
包含多次请求，也可能只被扫描到会话而没有网关级延迟数据。

## 浏览会话

打开**会话**后，OcHub 会读取本机受支持 CLI 的历史记录。

1. 使用应用筛选器只看某个工具。
2. 选择今天、最近 7 天、最近 30 天或自定义时间范围。
3. 点击“查看”打开完整对话。
4. 使用“展开详情”查看较长的工具或系统消息。
5. 返回列表后可重置筛选或刷新扫描。

会话卡片会汇总消息数量、用户与助手消息、工具或系统消息，以及会话跨度。

> **删除会话会修改本地历史**
>
> 会话删除不可撤销。确认前核对应用、标题和时间；需要保留时先备份对应 CLI 的会话目录。

## 认识用量首页

“用量”顶部显示四个汇总指标：

- **总成本**：按当前定价和倍率计算的输入、输出及缓存成本。
- **总请求数**：当前筛选范围内的请求数量与成功率。
- **真实 Token**：输入、输出、缓存创建和缓存读取。
- **缓存命中**：重复输入被缓存读取复用的比例。

趋势图按时间桶显示 Token、成本和请求数量。当前范围少于两个时间桶时不会绘制趋势。

## 筛选与下钻

1. 先选时间范围。
2. 再按状态、Provider 或模型缩小范围。
3. 点击 Provider 统计行，可把整个面板收窄到该 Provider。
4. 点击模型统计行，可继续筛选模型。
5. 在请求日志中打开单条记录，查看请求模型、计价模型、Token、缓存、成本、首 Token 和总延迟。
6. 使用“重置”回到完整范围。

## 数据来源

OcHub 可能汇总以下来源：

- 模型供应商请求
- Claude 会话
- Codex 数据库或会话
- OpenCode 会话
- Gemini 会话
- 旧版本地请求
- 手动同步的会话

只有经过本地网关的请求才能稳定提供网关级状态、延迟和请求 ID；从会话文件导入的数据
取决于各 CLI 实际记录的字段。

## 配置定价

在“模型定价配置”中：

1. 查看随安装包提供的 LiteLLM 离线价格目录、更新时间和版本。
2. 使用“立即同步”检查 LiteLLM `main` 的最新价格；后台也会每天条件检查一次。
3. 选择按请求模型还是响应模型计费。
4. 为 Claude 与 Codex 设置默认倍率和计价模型来源。
5. 只有目录缺价、Provider / 区域价格有歧义，或实际结算价不同时，才填写模型 ID 和每百万
   Token 价格来建立手动覆盖。
6. 保存后刷新用量，确认请求详情中的计价模型和成本。

手动覆盖始终优先，目录同步不会改写它。模型 ID 应与实际日志一致；自定义别名或转发映射
较多时，优先按响应模型计费。缺价模型会集中显示，不会逐条弹窗。

需要理解历史成本回填、缓存 Token 口径与账单校准时，继续阅读
[模型定价与成本校准](/zh/advanced/pricing)。

Source: https://docs.ochub.org/zh/guides/sessions-usage/index.mdx
