Haiku 5.5 को Claude Code का रीड-ओनली सबएजेंट बनाएं और असली मॉडल सत्यापित करें

Claude Code में स्पष्ट सीमा वाले रीड-ओनली शोध कार्य छोटे मॉडल को सौंपने की व्यावहारिक मार्गदर्शिका। इसमें सटीक मॉडल ID वाला कस्टम सबएजेंट, केवल Explore भूमिका के ओवरराइड और वैश्विक force सेटिंग का अंतर, तथा /tasks और प्रदाता के request records से वास्तविक रनिंग मॉडल की पुष्टि शामिल है।

विषय-सूची
Haiku 5.5 को Claude Code का रीड-ओनली सबएजेंट बनाएं और असली मॉडल सत्यापित करें

सबसे सुरक्षित तरीका पूरी Claude Code session को छोटे मॉडल पर ले जाना नहीं है। Haiku 5.5 को केवल वे काम दें जो सीमित, रीड-ओनली और आसानी से सत्यापित किए जा सकें: symbol references ढूंढना, imports का रास्ता ट्रेस करना, configuration की जगह पहचानना, या तय फ़ाइलों का सारांश बनाना। निर्णय, संपादन, परीक्षण और अंतिम स्वीकृति के लिए main conversation में Sonnet या Opus रखें।

विश्वसनीय configuration के लिए prompt में “Haiku इस्तेमाल करो” लिखना या फ़ाइल में model: haiku डालना पर्याप्त नहीं है। तीन स्तर जांचें: agent definition में लिखा स्पष्ट model, चल रहे task के लिए Claude Code द्वारा दिखाया model, और provider के request record में वास्तविक Model ID। इन तीनों के मेल खाने पर ही run को सत्यापित मानें।

तय करें कि कौन-सा काम सौंपा जा सकता है

Anthropic Haiku 5.5 को summaries, compaction, database queries और classification जैसे तेज़ व दोहराए जाने वाले workloads के लिए प्रस्तुत करता है। वह इसे Sonnet 5.5 या Opus 5.5 के साथ coding subagent के रूप में भी स्पष्ट रूप से बताता है। जटिल agentic coding के लिए Anthropic अब भी बड़े models की सलाह देता है। Haiku 5.5 की आधिकारिक घोषणा देखें।

शुरुआत के लिए यह विभाजन उपयोगी है:

कामसुझाया गया जिम्मेदारकारण
किसी class, function या setting के सभी references ढूंढनारीड-ओनली छोटे मॉडल का subagentinput, output और stopping rule साफ़ हैं
एक directory की फ़ाइलों की जिम्मेदारियां संक्षेप में बतानारीड-ओनली छोटे मॉडल का subagentपढ़ना और synthesis चाहिए, बदलाव नहीं
entry point से database call तक request का रास्ता ट्रेस करनारीड-ओनली छोटे मॉडल का subagentfile paths और line numbers से सत्यापन संभव है
architecture, migration strategy या security boundary चुननाSonnet/Opus main agentव्यापक context, trade-offs और अधिक महत्वपूर्ण निर्णय चाहिए
code बदलना, migrations चलाना, dependencies update करना या permissions बदलनाSonnet/Opus main agentworkspace बदलता है और कड़ी review चाहिए
research के बाद अंतिम fix तय कर लागू करनाSonnet/Opus main agentevidence को जोड़कर परिणाम की जिम्मेदारी लेनी होती है

एक आसान कसौटी है: क्या आप एक वाक्य में बता सकते हैं कि क्या ढूंढना है, क्या लौटाना है और कब रुकना है—और क्या काम फ़ाइल लिखे बिना पूरा हो सकता है? यदि नहीं, तो उसे main conversation में रखें।

चार अलग model controls को समझें

Claude Code में कई model controls हैं जिन्हें आसानी से मिलाया जा सकता है:

  1. Main conversation model: /model, startup flag या settings से चुना जाता है।
  2. Subagent frontmatter का model: केवल उस agent definition पर लागू होता है।
  3. Alias बनाम पूरा Model ID: haiku एक alias है जिसका target provider और version के अनुसार बदल सकता है; claude-haiku-5-5 Anthropic द्वारा प्रकाशित पूरा ID है।
  4. एक role का override बनाम global override: Explore नाम का custom agent केवल built-in Explore को बदलता है, जबकि CLAUDE_CODE_SUBAGENT_MODEL_FORCE=1 लगभग सभी subagents को प्रभावित करता है।

मौजूदा आधिकारिक subagent documentation में model इस क्रम से resolve होता है: per-invocation model, agent definition का model, CLAUDE_CODE_SUBAGENT_MODEL, और अंत में main conversation model। इसलिए केवल CLAUDE_CODE_SUBAGENT_MODEL एक default है; agent definition या invocation उसे override कर सकते हैं। Claude Code subagent documentation देखें।

इस workflow में एक स्पष्ट नाम वाले रीड-ओनली agent से शुरू करें। global forced override से शुरुआत न करें, क्योंकि वह Plan, general-purpose, teammate या workflow agents को भी छोटे मॉडल पर भेज सकता है।

चरण 1: Claude Code version और provider IDs जांचें

पहले client version देखें:

claude --version

Version interface और उपलब्ध verification path दोनों बदलता है:

  • Claude Code v2.1.198 और बाद के versions में /agents creation wizard नहीं खोलता। वह Claude से फ़ाइल बनवाने या .claude/agents/ अथवा ~/.claude/agents/ को सीधे edit करने की याद दिलाता है।
  • v2.1.197 और पुराने versions में /agents Running और Library tabs वाला interactive wizard खोलता है।
  • v2.1.242 और बाद के versions में /tasks running subagent की row पर model दिखाता है। पुराने versions में provider के request record पर अधिक निर्भर रहें।
  • CLAUDE_CODE_SUBAGENT_MODEL_FORCE=1 केवल तब इस्तेमाल करें जब जानबूझकर सभी subagents पर एक model लागू करना हो। इस व्यवहार के लिए v2.1.257 या नया version चाहिए।

इसके बाद पुष्टि करें कि आपका provider कौन-से exact IDs स्वीकार करता है:

  • Anthropic Claude API पर Haiku 5.5 का आधिकारिक Model ID claude-haiku-5-5 है। आधिकारिक model page देखें।
  • किसी cloud platform या third-party gateway पर यह न मानें कि वही ID पहले से उपलब्ध है। Provider deployment name, अपना alias या curated catalog इस्तेमाल कर सकता है।
  • 10 अक्टूबर 2026 को इस guide की जांच के समय BetterToken के public catalog में claude-haiku-4-5-20251001, claude-sonnet-5-5 और claude-opus-5-5 थे, लेकिन claude-haiku-5-5 नहीं था। BetterToken के साथ नया Anthropic ID कॉपी करने के बजाय current catalog में मौजूद ID चुनें। मौजूदा BetterToken catalog देखें।

“Anthropic ने model जारी किया है” और “मेरा gateway उस model को serve करता है” अलग तथ्य हैं। यदि provider catalog में ID नहीं है, तो verbal instruction या family alias से support का अनुमान न लगाएं।

चरण 2: project-level रीड-ओनली subagent बनाएं

Project agents .claude/agents/ में रहते हैं और repository के साथ maintain किए जा सकते हैं। ~/.claude/agents/ के user agents कई projects में उपलब्ध रहते हैं।

Repository root से project directory बनाएं:

mkdir -p .claude/agents

.claude/agents/repo-researcher.md बनाएं। Anthropic Claude API के लिए यह definition इस्तेमाल करें:

---
name: repo-researcher
description: Finds symbols, traces call paths, and summarizes selected files before code changes. Use only for bounded read-only repository research.
tools: Read, Grep, Glob
model: claude-haiku-5-5
---

You are a read-only repository researcher.

For each task:
1. Search only the scope named by the caller.
2. Do not edit, create, delete, or rename files.
3. Return file paths and line numbers for every important finding.
4. Separate direct evidence from inference.
5. Stop when the requested question is answered; do not propose unrelated refactors.

Return:
- Findings
- Evidence: file:line
- Uncertainties
- Suggested next check for the main agent

तीन बातें महत्वपूर्ण हैं:

  • tools केवल Read, Grep और Glob देता है; Write, Edit या Bash नहीं देता।
  • description बताता है कि delegation कब उचित है, जिससे main agent द्वारा modification work भेजने की संभावना घटती है।
  • model provider द्वारा स्वीकार किया गया पूरा ID है, केवल Haiku इस्तेमाल करने की विनती वाला वाक्य नहीं।

Claude Code को BetterToken के जरिए जोड़ने पर जांचे गए catalog में यह छोटा Claude model मौजूद था:

model: claude-haiku-4-5-20251001

यह current-catalog example है, स्थायी वादा नहीं। Mapping बदलने से पहले catalog या Model Plaza दोबारा जांचें। BetterToken की Claude Code documentation के अनुसार exact Model ID इस्तेमाल करें और ANTHROPIC_BASE_URL को https://bettertoken.ai पर सेट करें, अंत में /v1 न जोड़ें। BetterToken Claude Code setup guide देखें।

यदि current session शुरू होने पर .claude/agents/ मौजूद नहीं था और नया agent दिखाई नहीं देता, तो Claude Code को एक बार restart करें। आधिकारिक documentation बताता है कि session start पर पहला agents directory न होने पर running watcher बाद में बने directory को detect नहीं कर सकता।

चरण 3: main agent को Sonnet या Opus पर रखें

Main conversation model अलग से चुनें। उदाहरण:

/model sonnet

या:

/model opus

Gateway के साथ alias के पीछे अंतिम model gateway की mapping पर निर्भर करता है। यदि pinned version चाहिए, तो पूरा provider ID इस्तेमाल करें और फिर provider record में पुष्टि करें।

केवल एक research agent को छोटे model पर रखने के लिए global force variable न लगाएं। नीचे की configuration का असर बहुत व्यापक है:

{
  "env": {
    "CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
    "CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
  }
}

इसे तभी इस्तेमाल करें जब Plan, general-purpose subagents, teammates और workflow agents को भी वही model देना हो। यदि केवल automatic code exploration बदलना है, तो Explore नाम का project या user agent बनाएं और उसी definition में model दें। इससे built-in Explore बदलेगा, बाकी subagents नहीं।

चरण 4: audit किए जा सकने वाले test से agent चलाएं

“पूरी repository समझो” से शुरुआत न करें। ऐसा सीमित task दें जिसका उत्तर manually check किया जा सके:

Use the repo-researcher agent to find every call site of PaymentService.createCharge.
Return file:line, the caller's purpose, and the path from the public entry point.
Do not edit files. Stop after covering this symbol and its direct callers.

Run के बाद चार बातें जांचें:

  1. Main transcript में repo-researcher के लिए delegation row है; main agent ने search चुपचाप खुद नहीं किया।
  2. Subagent ने file paths और line numbers लौटाए तथा direct evidence को inference से अलग रखा।
  3. Working tree नहीं बदला:
git status --short
  1. आगे का निर्णय और code changes research agent नहीं, main agent करता है।

यदि research सुरक्षित रखना उपयोगी है, तो पहले main conversation में review करें। फिर main agent से accepted result project documentation या issue में save करवाएं। Output persist करने के लिए research agent को write access न दें।

चरण 5: वास्तव में चले model का सत्यापन करें

1. Agent definition देखें—लेकिन वहीं न रुकें

पुष्टि करें कि .claude/agents/repo-researcher.md में इच्छित पूरा ID है। यह केवल static configuration साबित करता है। Per-invocation model, organization policy या gateway mapping फिर भी request बदल सकती है।

2. Agent चलते समय /tasks देखें

चलाएं:

/tasks

Claude Code v2.1.242 और बाद के versions subagent row पर model दिखाते हैं। यदि वह फ़ाइल से अलग है, तो जांचें:

  • Claude ने इस invocation के लिए अलग model दिया है या नहीं;
  • CLAUDE_CODE_SUBAGENT_MODEL_FORCE enabled है या नहीं;
  • organization की availableModels policy ने allowed model substitute किया है या नहीं;
  • client version पुराना precedence rule follow करता है या नहीं।

3. Provider request record से मिलान करें

उसी time window का request ढूंढें और उसका वास्तविक Model ID देखें। Third-party gateway पर यह खास तौर पर जरूरी है, क्योंकि client में दिखा alias gateway द्वारा दोबारा map किया जा सकता है।

BetterToken एक request record में model, token counts, final charge और status दिखाता है। इस workflow में verification के लिए केवल model और status fields इस्तेमाल करें; record को unsupported savings claim में न बदलें। Request timestamp को subagent की run window से मिलाने के बाद ही उसे उसी agent से जोड़ें।

यह छोटा acceptance table इस्तेमाल करें:

Checkpointअपेक्षित evidenceअलग होने पर
Agent fileExact Model IDID ठीक करें, जरूरत पर reload या restart करें
/tasksTarget subagent और running modelInvocation settings, force variables और organization policy जांचें
Provider recordउसी time window में actual Model ID और successful statusCatalog, alias mapping, routing और account access जांचें
git status --shortकोई unexpected file change नहींTools सीमित करें, बदलाव revert करें और test दोबारा चलाएं

पहले तीन checkpoints पर model evidence मिलने पर ही “model switch verified” दर्ज करें। Prompt में Haiku लिखा होना, interface में agent का नाम, या completed answer अपने-आप पर्याप्त प्रमाण नहीं हैं।

समस्या निवारण

Agent invoke नहीं होता

जांचें कि फ़ाइल .claude/agents/ या ~/.claude/agents/ में है, frontmatter में name और description दोनों हैं, और YAML सही parse होता है। यदि session शुरू होने के बाद पहली agent directory बनाई है, तो Claude Code restart करें। फिर भी load न हो तो Claude Code को --debug के साथ चलाकर loading error देखें।

/agents creation wizard नहीं दिखाता

यह सामान्यतः expected behavior है, failure नहीं। v2.1.198 और बाद में /agents agent files सीधे edit करने की guidance देता है। Interactive wizard v2.1.197 और पुराने versions का व्यवहार है। पुराने screenshot के बजाय अपने वास्तविक version की documentation follow करें।

model: haiku से Haiku 5.5 साबित नहीं होता

haiku alias है, pinned version नहीं। उसका target Claude Code version, provider या gateway mapping से बदल सकता है। Auditable routing के लिए current provider catalog में मौजूद पूरा ID इस्तेमाल करें और /tasks तथा provider record दोनों जांचें।

Gateway model not found, 403 देता है या silently fallback करता है

पहले जांचें कि ID gateway के live catalog में है और account को उसका access है। यदि catalog में claude-haiku-5-5 नहीं है, तो उसी string को बार-बार retry न करें; listed उपयुक्त model चुनें या gateway के जोड़ने का इंतजार करें। Organization allowlist भी task जारी रखते हुए दूसरे model को substitute कर सकती है, इसलिए runtime evidence देखें।

हर subagent छोटे model पर चला गया

CLAUDE_CODE_SUBAGENT_MODEL_FORCE ढूंढकर हटाएं। केवल एक agent pin करना हो तो उसके frontmatter में पूरा ID डालें। केवल automatic exploration बदलना हो तो Explore override करें।

Research agent ने फ़ाइलें बदल दीं

git status --short से scope पहचानें और unintended changes revert करें। tools को Read, Grep, Glob तक सीमित करें और system prompt में रीड-ओनली सीमा दोहराएं। Write-capable tools हटाना केवल “edit मत करो” लिखने से अधिक विश्वसनीय है।

न्यूनतम rollout

पांच चरणों से शुरू करें:

  1. Claude Code update करें और claude --version चलाएं।
  2. Provider catalog से वास्तव में उपलब्ध पूरा Model ID कॉपी करें।
  3. Read, Grep और Glob तक सीमित एक repo-researcher बनाएं।
  4. एक symbol या directory तक सीमित task से उसे चलाएं।
  5. /tasks, provider request record और git status --short की तुलना करें।

लक्ष्य हर task को सबसे छोटे model पर भेजना नहीं है। लक्ष्य auditable division of labor बनाना है: छोटा model सत्यापित किए जा सकने वाले रीड-ओनली evidence इकट्ठा करे, जबकि Sonnet या Opus main agent महत्वपूर्ण निर्णय और बदलावों की जिम्मेदारी ले। पहले एक सीमित task सत्यापित करें, फिर केवल वहीं pattern बढ़ाएं जहां वही acceptance criteria काम करते हों।

अपना LLM वर्कफ़्लो बेहतर बनाना चाहते हैं?

एक API से मॉडल जोड़ें, कुंजियाँ प्रबंधित करें और AI खर्च नियंत्रित करें।

मुफ़्त शुरू करें