Claude Code Modsの使い方:コンテキストと編集リプレイを見ても、検収とは混同しない
Claude Codeを長時間使う人向けに、Token WeatherとReplay Theaterの選び方、単一セッションでの読み込み、表示の限界、Git・対象テスト・APIプロバイダーのリクエスト記録による最終確認を解説します。
目次

Claude Codeを長く使っていると、別々の二つの疑問が生まれます。直近のターンでコンテキストがどれだけ増えたのか、そしてClaudeがどのファイル編集を呼び出したのかです。Anthropicのplaygroundには、それぞれに対応するサンプルがあります。**Token Weatherはメインセッションのコンテキスト使用量を表示し、Replay Theater**は直近の編集ターンにおけるファイル編集呼び出しを順番に見せます。
最も大切な境界は、どちらも観測ツールであって検収ツールではないことです。コンテキストの割合は残高、費用、タスク完了を示しません。リプレイに編集が出ても、承認されたこと、ツールが成功したこと、最終ファイルに残っていることの証明にはなりません。
いま答えたい質問でModを選ぶ
| 質問 | 先に読み込むMod | 分かること | 証明できないこと |
|---|---|---|---|
| メインのコンテキストはどれくらい埋まり、最近急増したか | Token Weather | Context tokens、ウィンドウサイズ、割合、12ターンの推移 | サブスクリプション残量、課金額、残りリクエスト数、タスク完了 |
直近の編集ターンでどのEdit、Write、MultiEditが呼ばれたか | Replay Theater | ファイル、ツール、局所的な前後テキスト、短いdiff | 承認、ツール成功、最終ディスク状態、テスト成功 |
診断時は一度に一つだけ読み込むのが安全です。両サンプルはAbovePromptに描画できます。READMEではこの領域が共有されるため、別のModも使うと一方しか表示されない場合があると説明されています。
実行前にバージョンと信頼境界を確認する
現在のサンプルREADMEはClaude Code 2.1.287以降とターミナルを前提にしています。まず確認します。
claude --version
これらのModsはAnthropic DevRelのplaygroundにあるサンプルです。リポジトリは「現状のまま」提供され、Claude Code、API、モデルの変更後も動く保証やサポートはないとしています。実行前に、対象ディレクトリのREADME.md、.claude-plugin/plugin.json、hooks/hooks.json、hooksモジュールを最低限確認してください。
Modはユーザー権限で動きます。「UIを描くだけ」はセキュリティ境界ではありません。最初の試行では--plugin-dirで1セッションだけ読み込むのがおすすめです。そのClaude Codeプロセスを閉じれば試行が終わり、診断用のコードを永続インストールせずに済みます。
公式サンプルを取得して選んだModを検証する
git clone https://github.com/anthropics/claude-code-playground.git
cd claude-code-playground/claude-code/mods
取得できたことと構造が正しいことは別です。セッションを開始する前に対象ディレクトリを検証します。
Token Weatherの場合:
claude plugin validate ./token-weather
claude --plugin-dir ./token-weather
Replay Theaterの場合:
claude plugin validate ./replay-theater
claude --plugin-dir ./replay-theater
validateがエラーを返したら停止し、示されたmanifest、hooks設定、モジュールを復元してください。壊れたパッケージをClaude Codeが安全に無視すると考えて先へ進まないでください。新しいセッションでは/pluginで読み込み状況を確認できます。動作上の成功条件は別です。Token Weatherはメインループのターン完了後に更新され、Replay Theaterは実際にファイル編集を呼んだターンの完了後に入口が現れる必要があります。
Token Weatherはコンテキスト計測であり請求書ではない
Token Weatherは各メインターンの完了後に$.session.usage()を呼び、context内のtokens、window、percentを読みます。プロンプト上部に1行を描き、直近12回の測定と最新ターンの増加量を表示します。
各値の意味は次のとおりです。
tokens:直近の応答が参照した入力コンテキスト。uncached、cache-written、cache-readのinput tokensを含む;window:セッションモデルのコンテキストウィンドウ;percent:tokens / window。
最初の応答前に0%なのは正常です。usageを報告した応答がまだないためです。表示はターン中に連続更新されず、完了後に一度更新されます。サブエージェントのターンはメインループの別測定にはなりません。
compaction警告と割合が違う理由
Token Weatherはコンテキストウィンドウ全体を分母にします。一方、Claude Codeのauto-compact警告はそれより低い圧縮開始点を基準にするため、割合が異なる場合があります。公式サンプル画像ではToken Weatherが81%、クライアント側が90%でした。これはサンプル条件で二つの尺度があることを示す例であり、自分のセッションで一致させるべき値ではありません。
履歴バーは、表示中の最大値を基準にした相対表示です。絶対割合が低くても大きく上下して見えることがあります。絶対値は割合とtoken数で判断してください。セッション開始またはplugin reloadで履歴はリセットされます。
Token Weatherから言えること
「最近の数ターンでメインセッションの入力コンテキストが大きく増えた」とは言えます。しかし「アカウント残量が19%」「このターンの費用はこの額」「タスクは完了した」とは言えません。キャッシュは課金方法を変えますが、キャッシュされた入力もコンテキストを占有します。残高、費用、リクエスト状態はプロバイダー記録で確認します。
Replay Theaterで編集の試行を確認する
読み込み後、実際にファイルを変更するタスクをClaudeに依頼し、ターン完了まで待ちます。ヒントが出たら開きます。
/replay
ctrl+x、Tabでバンドにフォーカスし、rを押す方法もあります。パネル内の操作は次のとおりです。
| キー | 操作 |
|---|---|
n | 次のステップ |
p | 前のステップ |
cまたはEscape | 閉じる |
各ステップにはファイル、ツール、追加・削除行数、短いdiffが表示されます。サンプルは1ステップを12行に制限します。Editではファイル全体ではなくold_stringとnew_stringを比較し、行番号は表示しません。Writeでは呼び出し直前にディスク上の旧内容を読みますが、400行を超えるファイルでは完全な行対応を行いません。
リプレイにある編集が最終ファイルにない理由
Replay Theaterは呼び出しを先に記録してから先へ渡します。そのため、ユーザーが拒否した編集や、ツール実行に失敗した編集も表示されることがあります。後続の呼び出しが前の変更を上書き、または元に戻す場合もあります。
リプレイは現在のセッションのメモリにだけ保持されます。Claude Codeの再起動やplugin reloadで失われます。編集がない次のターンでは前回のリプレイが残ります。「Claudeが何を試したか」を理解するために使い、最終リポジトリのスナップショットとして扱わないでください。
最終確認は実ファイルで行う
Replay Theaterの表示に関係なく、最後はリポジトリを確認します。
git status --short
git diff --stat
git diff -- path/to/file
git diff --check
git status --shortで実際の追加・変更・削除を確認します。git diff --statで想定外に広い変更を見つけます。重要ファイルは12行の抜粋ではなく完全なdiffを読みます。git diff --checkで空白エラーを確認し、そのファイルに直接関係する最小のtest、type check、buildを実行してください。
検収条件は観測可能に書きます。「対象関数が改名され、全参照が更新され、関連unit testが通り、無関係なファイルが変わっていない」なら判定できます。「リプレイに緑の5ステップが出た」は検収条件ではありません。
実際の使用量はプロバイダー記録で確認する
Token Weatherが示すのはコンテキスト占有率であり、API請求ではありません。どのAPIプロバイダーでも、時刻とモデルで対象リクエストを見つけ、status、input/output tokens、該当するcache tokens、記録された費用を確認します。
Claude CodeのAPI経路にBetterTokenを使う場合、現在のページではmodel、time、token counts、cache usage、final cost、statusが一つのリクエスト記録にまとまると説明されています。その記録で実際の使用量を確認してください。BetterTokenがModsを提供する、完全なprompt/responseを保存する、コード変更を自動検収するという意味ではありません。接続方法はBetterTokenのClaude Codeガイドを参照してください。
最短の順序でトラブルシュートする
claude plugin validateが失敗する
バリデーターが示すファイルとフィールドを読みます。現在地がclaude-code-playground/claude-code/modsであること、ダウンロードツールが隠しファイル名を変えていないこと、checkoutが壊れていないことを確認し、再検証してから起動します。
Token Weatherが出ない、または0%のまま
VS Code chat panelだけでなくターミナルを使い、2.1.287以降であることと、現在のセッションに対象Modが読み込まれたことを確認します。通常のリクエストを送り、メインターン完了まで待ちます。最初の応答前の0%は正常です。
Replay Theaterのヒントが出ない
そのターンがEdit、Write、MultiEditを呼び、完了しているか確認します。ファイルを読む、質問に答える、Bashコマンドだけを実行する場合は、記録対象のファイル編集ステップがありません。
replayとgit diffが一致しない
実ファイルを信頼してください。編集が拒否・失敗した、後続編集が置換した、パネルが局所抜粋だけを示している、restart/reloadでメモリ状態が変わった、という可能性があります。完全なdiffと対象テストで再判定します。
二つのModが同時に見えない
一方を無効にし、もう一方だけで新しいセッションを開始します。どちらもAbovePromptを共有するため、二本目が見えないだけで故障とは判断できません。
信頼できる最小ループ
コンテキスト増加を見たいならToken Weather、どの編集呼び出しがあったかを知りたいならReplay Theaterを選びます。読み込み成功は第一段階、メーターやリプレイが見えることは第二段階です。第三段階は必ず、実ファイルの確認、最小の関連検証、必要ならプロバイダーのリクエスト記録の照合です。これで「過程が見えた」を「結果を確認した」に変えられます。