Claude Code context와 usage: 불필요한 token 진단
context 원인을 하나만 바꾸고 usage와 task 결과를 비교하는 Claude Code A/B 진단입니다.
목차
큰 context는 benchmark가 아닙니다. repository, instructions, MCP, session이 다르기 때문입니다. API workflow에서는 BetterToken Claude Code 가이드에 따라 자신의 API Key와 Dashboard request metadata로 확인합니다. 규칙을 지우기 전에 측정하세요.
baseline 측정
/context는 active source를, /usage는 session usage를 보여 줍니다. Dashboard에도 시간, status, input/output/cache token을 기록합니다. Key, 전체 prompt, private log는 표에 넣지 않습니다.
검증 가능한 task 선택
validateInvoice 정의를 찾는다.
함수 파일과 빈 amount를 확인하는 test 하나를 말한다.
파일은 수정하지 않는다.
branch, commit, prompt, model, project rules, skills, MCP, 예상 path를 고정합니다.
Run A 기록
새 session에서 /context와 task를 실행합니다.
| 항목 | Run A |
|---|---|
| status | 실제 HTTP status |
| Input / Output / Cache | 측정값 |
| 결과 | function과 test가 맞는가 |
원인 하나만 분리
CLAUDE.md, 불필요한 MCP/skills, session history, 너무 넓은 file search를 차례로 봅니다. 긴 build log를 별도 파일로 옮기고 CLAUDE.md에는 pointer만 남기는 식으로 한 가지 reversible change만 합니다. model과 prompt를 함께 바꾸지 마세요.
Run B 비교
| 항목 | Run A | Run B | 판정 |
|---|---|---|---|
| Input tokens | 실측 | 실측 | 비교 |
| task | 정확 | 정확 | 유지 필요 |
token이 줄어도 test가 틀리거나 필수 rule을 놓치면 개선이 아닙니다. 변경을 되돌립니다.
signal 재검증
다른 작은 task에서도 재현하고 두 run의 시간, status, model, token을 Dashboard에서 맞춥니다. Dashboard는 metadata와 usage를 보여 주지만 private prompt나 response 전체를 보관하지 않습니다.
CTA와 sources
BetterToken은 독립 Anthropic-compatible API이며 Claude.ai subscription이 아닙니다. 현재 가이드로 자신의 Key를 설정하고 실측값을 확인하세요. 고정 token 절감이나 가격은 약속하지 않습니다.