「セッション」は会話全体、「使用量」はリクエストと集計を扱います。データソースが異なる ため、1 セッションに複数リクエストが含まれることも、ゲートウェイのレイテンシーなしで 履歴だけが見つかることもあります。
セッションを閲覧する
セッションを開くと、対応するローカル CLI の履歴を読み取ります。
- アプリで絞り込みます。
- 今日、過去 7 日、過去 30 日、カスタム期間を選びます。
- 表示で会話全体を開きます。
- 長いツール・システムメッセージは詳細を展開します。
- 一覧へ戻り、フィルターのリセットや再スキャンを行います。
手順ごとの画面画面をクリックして拡大し、← → で手順を切り替えます。青い枠が操作位置です。
STEP 01セッションを開く
STEP 02アプリと期間で絞る
STEP 03会話を開く
STEP 04長い詳細を展開する
STEP 05一覧を更新する
カードには総メッセージ数、ユーザー・アシスタント・ツール/システムの内訳、期間が 表示されます。
使用量サマリーを理解する
- 総コスト:現在の価格と倍率による入力、出力、キャッシュコスト。
- 総リクエスト数:現在の範囲の件数と成功率。
- 実トークン:入力、出力、キャッシュ作成、キャッシュ読み取り。
- キャッシュヒット率:繰り返し入力がキャッシュから再利用された割合。
トレンドは時間バケットごとのトークン、コスト、件数を表示します。少なくとも 2 バケットが 必要です。
手順ごとの画面画面をクリックして拡大し、← → で手順を切り替えます。青い枠が操作位置です。
STEP 01使用量を開く
STEP 024 つの集計を読む
STEP 03期間を選ぶ
STEP 04Provider とモデルで絞る
STEP 051 件のリクエストを開く
STEP 06トークン・コスト・遅延を確認
絞り込みと詳細確認
- 期間を選びます。
- 状態、プロバイダー、モデルで絞り込みます。
- プロバイダー統計の行を選ぶとページ全体がそのプロバイダーへ絞られます。
- モデル行でさらに絞り込みます。
- ログを開き、リクエストモデル、課金モデル、トークン、キャッシュ、コスト、 最初のトークンまでの時間、総レイテンシーを確認します。
- リセットで全範囲へ戻します。
データソース
- モデルプロバイダーのリクエスト
- Claude セッション
- Codex データベースまたはセッション
- OpenCode セッション
- Gemini セッション
- 旧バージョンのローカルリクエスト
- 手動同期したセッション
ローカルゲートウェイを通ったリクエストだけが、ゲートウェイの状態、レイテンシー、リクエスト ID を安定して持ちます。セッションファイルは各 CLI が記録した項目に制限されます。
モデル価格を設定する
- インストールに同梱された LiteLLM オフライン料金カタログ、更新時刻、リビジョンを確認します。
- 「今すぐ同期」で LiteLLM
mainを確認します。バックグラウンドでも 1 日 1 回条件付きで確認します。 - リクエストモデルまたはレスポンスモデルを課金元に選びます。
- Claude と Codex のデフォルト倍率と課金モデル元を設定します。
- カタログにモデルがない、Provider / リージョン料金が曖昧、または実際の精算単価が異なる 場合だけ、100 万トークン単価の手動上書きを追加します。
- 保存して更新し、個別リクエストの課金モデルとコストを確認します。
手動上書きが常に優先され、カタログ同期で変更されることはありません。モデル ID はログと 一致させます。エイリアスやゲートウェイのマッピングが多い場合は、レスポンスモデルを使う方が安定 することがあります。不足料金は繰り返しダイアログを出さず、1 つの通知にまとめられます。
履歴コストの補完、キャッシュトークンの扱い、請求との照合は モデル価格とコスト調整を参照してください。

