Claude Codeのcontextとusage: 不要なtokenを診断する
一つのcontext源だけを変え、usageとタスク結果を比較するClaude CodeのA/B診断です。
目次
大きなcontextはbenchmarkではありません。repository、instructions、MCP、sessionが違うためです。自分のAPI workflowでは、BetterToken Claude Codeガイドに従い、自分のAPI KeyとDashboardのrequest metadataを使って確認します。規則を消す前に測定してください。
baselineを測る
/contextはactive sourceを、/usageはsession usageを表示します。Dashboardにも時刻、status、input/output/cache tokenを記録します。Key、完全なprompt、private logは比較表に入れません。
検証できるtaskを決める
validateInvoice の定義を探す。
関数ファイルと空の amount を確認する test を一つ示す。
ファイルは変更しない。
branch、commit、prompt、model、project rules、skills、MCP、期待するpathを固定します。
Run Aを記録する
新しいsessionで/contextを実行し、taskを送ります。
| 項目 | Run A |
|---|---|
| status | 実際のHTTP status |
| Input / Output / Cache | 測定値 |
| 結果 | functionとtestは正しいか |
sourceを一つだけ分離する
CLAUDE.md、不要なMCP/skills、session history、広すぎるfile searchを順に確認します。長いbuild logを別ファイルへ移しCLAUDE.mdにはpointerだけ残す、という一つのreversible changeを行います。modelとpromptを同時に変えません。
Run Bを比べる
| 項目 | Run A | Run B | 判定 |
|---|---|---|---|
| Input tokens | 実測 | 実測 | 比較 |
| task | 正しい | 正しい | 維持必須 |
tokenが減ってもtestを間違えたり必須ruleを落としたら改善ではありません。変更を戻します。
signalを再確認する
別の小さなtaskでも再現し、両runの時刻、status、model、tokenをDashboardで突き合わせます。Dashboardはmetadataとusageを表示しますが、private promptやresponse全文は保存しません。
CTAとsource
BetterTokenは独立したAnthropic-compatible APIでありClaude.ai subscriptionではありません。自分のKeyを現行ガイドで設定し、実測値を確認してください。固定のtoken削減や価格は約束されません。