Claude Code Modsの使い方:コンテキストと編集リプレイを見ても、検収とは混同しない

Claude Codeを長時間使う人向けに、Token WeatherとReplay Theaterの選び方、単一セッションでの読み込み、表示の限界、Git・対象テスト・APIプロバイダーのリクエスト記録による最終確認を解説します。

目次
Claude Code Modsの使い方:コンテキストと編集リプレイを見ても、検収とは混同しない

Claude Codeを長く使っていると、別々の二つの疑問が生まれます。直近のターンでコンテキストがどれだけ増えたのか、そしてClaudeがどのファイル編集を呼び出したのかです。Anthropicのplaygroundには、それぞれに対応するサンプルがあります。**Token Weatherはメインセッションのコンテキスト使用量を表示し、Replay Theater**は直近の編集ターンにおけるファイル編集呼び出しを順番に見せます。

最も大切な境界は、どちらも観測ツールであって検収ツールではないことです。コンテキストの割合は残高、費用、タスク完了を示しません。リプレイに編集が出ても、承認されたこと、ツールが成功したこと、最終ファイルに残っていることの証明にはなりません。

いま答えたい質問でModを選ぶ

質問先に読み込むMod分かること証明できないこと
メインのコンテキストはどれくらい埋まり、最近急増したかToken WeatherContext tokens、ウィンドウサイズ、割合、12ターンの推移サブスクリプション残量、課金額、残りリクエスト数、タスク完了
直近の編集ターンでどのEdit、Write、MultiEditが呼ばれたかReplay Theaterファイル、ツール、局所的な前後テキスト、短いdiff承認、ツール成功、最終ディスク状態、テスト成功

診断時は一度に一つだけ読み込むのが安全です。両サンプルはAbovePromptに描画できます。READMEではこの領域が共有されるため、別のModも使うと一方しか表示されない場合があると説明されています。

実行前にバージョンと信頼境界を確認する

現在のサンプルREADMEはClaude Code 2.1.287以降とターミナルを前提にしています。まず確認します。

claude --version

これらのModsはAnthropic DevRelのplaygroundにあるサンプルです。リポジトリは「現状のまま」提供され、Claude Code、API、モデルの変更後も動く保証やサポートはないとしています。実行前に、対象ディレクトリのREADME.md、.claude-plugin/plugin.json、hooks/hooks.json、hooksモジュールを最低限確認してください。

Modはユーザー権限で動きます。「UIを描くだけ」はセキュリティ境界ではありません。最初の試行では--plugin-dirで1セッションだけ読み込むのがおすすめです。そのClaude Codeプロセスを閉じれば試行が終わり、診断用のコードを永続インストールせずに済みます。

公式サンプルを取得して選んだModを検証する

git clone https://github.com/anthropics/claude-code-playground.git
cd claude-code-playground/claude-code/mods

取得できたことと構造が正しいことは別です。セッションを開始する前に対象ディレクトリを検証します。

Token Weatherの場合:

claude plugin validate ./token-weather
claude --plugin-dir ./token-weather

Replay Theaterの場合:

claude plugin validate ./replay-theater
claude --plugin-dir ./replay-theater

validateがエラーを返したら停止し、示されたmanifest、hooks設定、モジュールを復元してください。壊れたパッケージをClaude Codeが安全に無視すると考えて先へ進まないでください。新しいセッションでは/pluginで読み込み状況を確認できます。動作上の成功条件は別です。Token Weatherはメインループのターン完了後に更新され、Replay Theaterは実際にファイル編集を呼んだターンの完了後に入口が現れる必要があります。

Token Weatherはコンテキスト計測であり請求書ではない

Token Weatherは各メインターンの完了後に$.session.usage()を呼び、context内のtokens、window、percentを読みます。プロンプト上部に1行を描き、直近12回の測定と最新ターンの増加量を表示します。

各値の意味は次のとおりです。

  • tokens:直近の応答が参照した入力コンテキスト。uncached、cache-written、cache-readのinput tokensを含む;
  • window:セッションモデルのコンテキストウィンドウ;
  • percent:tokens / window。

最初の応答前に0%なのは正常です。usageを報告した応答がまだないためです。表示はターン中に連続更新されず、完了後に一度更新されます。サブエージェントのターンはメインループの別測定にはなりません。

compaction警告と割合が違う理由

Token Weatherはコンテキストウィンドウ全体を分母にします。一方、Claude Codeのauto-compact警告はそれより低い圧縮開始点を基準にするため、割合が異なる場合があります。公式サンプル画像ではToken Weatherが81%、クライアント側が90%でした。これはサンプル条件で二つの尺度があることを示す例であり、自分のセッションで一致させるべき値ではありません。

履歴バーは、表示中の最大値を基準にした相対表示です。絶対割合が低くても大きく上下して見えることがあります。絶対値は割合とtoken数で判断してください。セッション開始またはplugin reloadで履歴はリセットされます。

Token Weatherから言えること

「最近の数ターンでメインセッションの入力コンテキストが大きく増えた」とは言えます。しかし「アカウント残量が19%」「このターンの費用はこの額」「タスクは完了した」とは言えません。キャッシュは課金方法を変えますが、キャッシュされた入力もコンテキストを占有します。残高、費用、リクエスト状態はプロバイダー記録で確認します。

Replay Theaterで編集の試行を確認する

読み込み後、実際にファイルを変更するタスクをClaudeに依頼し、ターン完了まで待ちます。ヒントが出たら開きます。

/replay

ctrl+x、Tabでバンドにフォーカスし、rを押す方法もあります。パネル内の操作は次のとおりです。

キー操作
n次のステップ
p前のステップ
cまたはEscape閉じる

各ステップにはファイル、ツール、追加・削除行数、短いdiffが表示されます。サンプルは1ステップを12行に制限します。Editではファイル全体ではなくold_stringとnew_stringを比較し、行番号は表示しません。Writeでは呼び出し直前にディスク上の旧内容を読みますが、400行を超えるファイルでは完全な行対応を行いません。

リプレイにある編集が最終ファイルにない理由

Replay Theaterは呼び出しを先に記録してから先へ渡します。そのため、ユーザーが拒否した編集や、ツール実行に失敗した編集も表示されることがあります。後続の呼び出しが前の変更を上書き、または元に戻す場合もあります。

リプレイは現在のセッションのメモリにだけ保持されます。Claude Codeの再起動やplugin reloadで失われます。編集がない次のターンでは前回のリプレイが残ります。「Claudeが何を試したか」を理解するために使い、最終リポジトリのスナップショットとして扱わないでください。

最終確認は実ファイルで行う

Replay Theaterの表示に関係なく、最後はリポジトリを確認します。

git status --short
git diff --stat
git diff -- path/to/file
git diff --check

git status --shortで実際の追加・変更・削除を確認します。git diff --statで想定外に広い変更を見つけます。重要ファイルは12行の抜粋ではなく完全なdiffを読みます。git diff --checkで空白エラーを確認し、そのファイルに直接関係する最小のtest、type check、buildを実行してください。

検収条件は観測可能に書きます。「対象関数が改名され、全参照が更新され、関連unit testが通り、無関係なファイルが変わっていない」なら判定できます。「リプレイに緑の5ステップが出た」は検収条件ではありません。

実際の使用量はプロバイダー記録で確認する

Token Weatherが示すのはコンテキスト占有率であり、API請求ではありません。どのAPIプロバイダーでも、時刻とモデルで対象リクエストを見つけ、status、input/output tokens、該当するcache tokens、記録された費用を確認します。

Claude CodeのAPI経路にBetterTokenを使う場合、現在のページではmodel、time、token counts、cache usage、final cost、statusが一つのリクエスト記録にまとまると説明されています。その記録で実際の使用量を確認してください。BetterTokenがModsを提供する、完全なprompt/responseを保存する、コード変更を自動検収するという意味ではありません。接続方法はBetterTokenのClaude Codeガイドを参照してください。

最短の順序でトラブルシュートする

claude plugin validateが失敗する

バリデーターが示すファイルとフィールドを読みます。現在地がclaude-code-playground/claude-code/modsであること、ダウンロードツールが隠しファイル名を変えていないこと、checkoutが壊れていないことを確認し、再検証してから起動します。

Token Weatherが出ない、または0%のまま

VS Code chat panelだけでなくターミナルを使い、2.1.287以降であることと、現在のセッションに対象Modが読み込まれたことを確認します。通常のリクエストを送り、メインターン完了まで待ちます。最初の応答前の0%は正常です。

Replay Theaterのヒントが出ない

そのターンがEdit、Write、MultiEditを呼び、完了しているか確認します。ファイルを読む、質問に答える、Bashコマンドだけを実行する場合は、記録対象のファイル編集ステップがありません。

replayとgit diffが一致しない

実ファイルを信頼してください。編集が拒否・失敗した、後続編集が置換した、パネルが局所抜粋だけを示している、restart/reloadでメモリ状態が変わった、という可能性があります。完全なdiffと対象テストで再判定します。

二つのModが同時に見えない

一方を無効にし、もう一方だけで新しいセッションを開始します。どちらもAbovePromptを共有するため、二本目が見えないだけで故障とは判断できません。

信頼できる最小ループ

コンテキスト増加を見たいならToken Weather、どの編集呼び出しがあったかを知りたいならReplay Theaterを選びます。読み込み成功は第一段階、メーターやリプレイが見えることは第二段階です。第三段階は必ず、実ファイルの確認、最小の関連検証、必要ならプロバイダーのリクエスト記録の照合です。これで「過程が見えた」を「結果を確認した」に変えられます。

LLM ワークフローを最適化しませんか?

単一 API でモデルを接続し、キーと AI コストを管理できます。

無料で始める