本文へスキップ
OcHub

セッションと使用量を確認する

ローカル会話を閲覧し、リクエスト、トークン、コストを同じ基準で分析します。

更新日 Markdown で表示
For humans

「セッション」は会話全体、「使用量」はリクエストと集計を扱います。データソースが異なる ため、1 セッションに複数リクエストが含まれることも、ゲートウェイのレイテンシーなしで 履歴だけが見つかることもあります。

セッションを閲覧する

セッションを開くと、対応するローカル CLI の履歴を読み取ります。

  1. アプリで絞り込みます。
  2. 今日、過去 7 日、過去 30 日、カスタム期間を選びます。
  3. 表示で会話全体を開きます。
  4. 長いツール・システムメッセージは詳細を展開します。
  5. 一覧へ戻り、フィルターのリセットや再スキャンを行います。
手順ごとの画面画面をクリックして拡大し、← → で手順を切り替えます。青い枠が操作位置です。
1
STEP 01セッションを開く
2
STEP 02アプリと期間で絞る
3
STEP 03会話を開く
4
STEP 04長い詳細を展開する
5
STEP 05一覧を更新する

カードには総メッセージ数、ユーザー・アシスタント・ツール/システムの内訳、期間が 表示されます。

使用量サマリーを理解する

  • 総コスト:現在の価格と倍率による入力、出力、キャッシュコスト。
  • 総リクエスト数:現在の範囲の件数と成功率。
  • 実トークン:入力、出力、キャッシュ作成、キャッシュ読み取り。
  • キャッシュヒット率:繰り返し入力がキャッシュから再利用された割合。

トレンドは時間バケットごとのトークン、コスト、件数を表示します。少なくとも 2 バケットが 必要です。

手順ごとの画面画面をクリックして拡大し、← → で手順を切り替えます。青い枠が操作位置です。
1
STEP 01使用量を開く
2
STEP 024 つの集計を読む
3
STEP 03期間を選ぶ
4
STEP 04Provider とモデルで絞る
5
STEP 051 件のリクエストを開く
6
STEP 06トークン・コスト・遅延を確認

絞り込みと詳細確認

  1. 期間を選びます。
  2. 状態、プロバイダー、モデルで絞り込みます。
  3. プロバイダー統計の行を選ぶとページ全体がそのプロバイダーへ絞られます。
  4. モデル行でさらに絞り込みます。
  5. ログを開き、リクエストモデル、課金モデル、トークン、キャッシュ、コスト、 最初のトークンまでの時間、総レイテンシーを確認します。
  6. リセットで全範囲へ戻します。

データソース

  • モデルプロバイダーのリクエスト
  • Claude セッション
  • Codex データベースまたはセッション
  • OpenCode セッション
  • Gemini セッション
  • 旧バージョンのローカルリクエスト
  • 手動同期したセッション

ローカルゲートウェイを通ったリクエストだけが、ゲートウェイの状態、レイテンシー、リクエスト ID を安定して持ちます。セッションファイルは各 CLI が記録した項目に制限されます。

モデル価格を設定する

  1. インストールに同梱された LiteLLM オフライン料金カタログ、更新時刻、リビジョンを確認します。
  2. 「今すぐ同期」で LiteLLM main を確認します。バックグラウンドでも 1 日 1 回条件付きで確認します。
  3. リクエストモデルまたはレスポンスモデルを課金元に選びます。
  4. Claude と Codex のデフォルト倍率と課金モデル元を設定します。
  5. カタログにモデルがない、Provider / リージョン料金が曖昧、または実際の精算単価が異なる 場合だけ、100 万トークン単価の手動上書きを追加します。
  6. 保存して更新し、個別リクエストの課金モデルとコストを確認します。

手動上書きが常に優先され、カタログ同期で変更されることはありません。モデル ID はログと 一致させます。エイリアスやゲートウェイのマッピングが多い場合は、レスポンスモデルを使う方が安定 することがあります。不足料金は繰り返しダイアログを出さず、1 つの通知にまとめられます。

履歴コストの補完、キャッシュトークンの扱い、請求との照合は モデル価格とコスト調整を参照してください。

Navigation

Type to search…

↑↓ navigate↵ selectEsc close