आमंत्रित करें और कमाएँ

आमंत्रण पुरस्कार कैसे काम करते हैं

अपना आमंत्रण लिंक साझा करें। मित्र इसके माध्यम से पंजीकरण करके टॉप-अप करता है तो उसके बाद के टॉप-अप पर आपको दिखाया गया पुरस्कार मिलेगा।

Claude Code में DeepSeek Flash या Pro कैसे सेट करें: जाँच और कीमतें

Claude Code को DeepSeek से जोड़ने, Flash या Pro चुनने, API Key सुरक्षित दर्ज करने, कनेक्शन जाँचने, त्रुटियाँ सुधारने और DeepSeek व BetterToken की कीमतों की तुलना करने की पूरी गाइड।

विषय-सूची
Claude Code में DeepSeek Flash या Pro कैसे सेट करें: जाँच और कीमतें

Claude Code को किसी अतिरिक्त proxy के बिना सीधे DeepSeek के Anthropic-compatible endpoint से जोड़ा जा सकता है। सामान्य coding काम के लिए मौजूदा आधिकारिक deepseek-flash[1m] profile से शुरू करें। कठिन architecture, बड़ा refactor या लंबी debugging के लिए केवल main agent को deepseek-v4-pro पर ले जाएँ और Haiku तथा subagent को Flash पर रखें।

दो बातें गलत निष्कर्ष दे सकती हैं। DeepSeek का मौजूदा all-Flash उदाहरण automatic Claude-name mapping को override करता है। इसके अलावा unsupported model name बिना स्पष्ट error के deepseek-flash पर fallback हो जाता है। इसलिए सामान्य उत्तर मिलना connectivity साबित करता है, यह नहीं कि request वास्तव में Pro पर गई थी।

सेटिंग बदलने से पहले model profile चुनें

27 सितंबर 2026 तक DeepSeek की Claude Code गाइड cost-first all-Flash configuration दिखाती है। अलग Anthropic compatibility गाइड के अनुसार claude-opus से शुरू होने वाले नाम deepseek-v4-pro पर और claude-sonnet या claude-haiku से शुरू होने वाले नाम deepseek-flash पर map होते हैं।

ProfileMain model / OpusSonnetHaiku और subagentसही उपयोग
आधिकारिक default, speed-firstdeepseek-flash[1m]deepseek-flash[1m]deepseek-flashरोज़ का coding, repository पढ़ना, कई छोटे काम
Main thread पर Prodeepseek-v4-prodeepseek-flash[1m]deepseek-flasharchitecture, कठिन refactor, महत्वपूर्ण diagnosis
Automatic Claude-name mappingclaude-opus* → deepseek-v4-proclaude-sonnet* → deepseek-flashclaude-haiku* → deepseek-flashजब आपको पता हो कि client कौन-सा Claude नाम भेज रहा है

Explicit environment variables automatic mapping से ऊपर होते हैं। यदि ANTHROPIC_DEFAULT_OPUS_MODEL=deepseek-flash[1m] सेट है, तो Claude Code में Opus route चुनने पर भी Flash ही चलेगा।

1. Claude Code install करके local CLI पहले जाँचें

Node.js 18 या नया version चाहिए। Windows पर Git for Windows भी आवश्यक है। Provider configure करने से पहले CLI version जाँचें, ताकि local installation और API problem एक-दूसरे में न मिलें।

npm install -g @anthropic-ai/claude-code
claude --version

IFS= read -rs ANTHROPIC_AUTH_TOKEN
export ANTHROPIC_AUTH_TOKEN
export ANTHROPIC_BASE_URL="https://api.deepseek.com/anthropic"
export ANTHROPIC_MODEL="deepseek-flash[1m]"
export ANTHROPIC_DEFAULT_OPUS_MODEL="deepseek-flash[1m]"
export ANTHROPIC_DEFAULT_SONNET_MODEL="deepseek-flash[1m]"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek-flash"
export CLAUDE_CODE_SUBAGENT_MODEL="deepseek-flash"
export CLAUDE_CODE_EFFORT_LEVEL="max"
export CLAUDE_CODE_AUTO_COMPACT_WINDOW="786432"

IFS= read -rs ANTHROPIC_AUTH_TOKEN terminal में API Key paste होने का इंतज़ार करता है और input नहीं दिखाता। Key paste करके Enter दबाएँ; अगली line उसे current shell में export करती है। असली Key को command, shell history, script या repository में न लिखें।

PowerShell में secret को सुरक्षित रूप से पढ़कर केवल current process में रखें:

npm install -g @anthropic-ai/claude-code
claude --version

$secure = Read-Host -AsSecureString
$ptr = [Runtime.InteropServices.Marshal]::SecureStringToBSTR($secure)
try {
  $env:ANTHROPIC_AUTH_TOKEN = [Runtime.InteropServices.Marshal]::PtrToStringBSTR($ptr)
} finally {
  [Runtime.InteropServices.Marshal]::ZeroFreeBSTR($ptr)
}
$env:ANTHROPIC_BASE_URL="https://api.deepseek.com/anthropic"
$env:ANTHROPIC_MODEL="deepseek-flash[1m]"
$env:ANTHROPIC_DEFAULT_OPUS_MODEL="deepseek-flash[1m]"
$env:ANTHROPIC_DEFAULT_SONNET_MODEL="deepseek-flash[1m]"
$env:ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek-flash"
$env:CLAUDE_CODE_SUBAGENT_MODEL="deepseek-flash"
$env:CLAUDE_CODE_EFFORT_LEVEL="max"
$env:CLAUDE_CODE_AUTO_COMPACT_WINDOW="786432"

ये variables उसी terminal से शुरू हुए Claude Code पर लागू होते हैं। पहले temporary session में route जाँचें। उसके बाद non-secret settings को protected profile में रखें और Key को proper secret store में रखें।

2. केवल main thread को Pro पर ले जाएँ

मौजूदा models and pricing page पर Pro का exact ID deepseek-v4-pro और current version DeepSeek-V4-Pro-0813 है। वर्तमान Claude Code page [1m] suffix केवल Flash example में दिखाती है, deepseek-v4-pro[1m] का example नहीं देती। इसलिए नीचे documented model-table ID ही इस्तेमाल किया गया है।

export ANTHROPIC_MODEL="deepseek-v4-pro"
export ANTHROPIC_DEFAULT_OPUS_MODEL="deepseek-v4-pro"
export ANTHROPIC_DEFAULT_SONNET_MODEL="deepseek-flash[1m]"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek-flash"
export CLAUDE_CODE_SUBAGENT_MODEL="deepseek-flash"

अब main session और Opus route Pro पर जाएँगे, जबकि Sonnet, Haiku और subagent Flash पर रहेंगे। Repository scan, file reads और छोटे delegated edits कई calls बना सकते हैं; जहाँ deep reasoning की ज़रूरत नहीं है वहाँ Pro rate देने से बचना बेहतर है।

[1m] का अर्थ और सीमा

DeepSeek की मौजूदा documentation [1m] को अलग वाक्य में define नहीं करती। वह main Flash model और Opus/Sonnet overrides में suffix दिखाती है, Haiku तथा CLAUDE_CODE_SUBAGENT_MODEL के लिए plain deepseek-flash रखती है, और model table में 1M context length बताती है। इन बातों को साथ पढ़ने पर सुरक्षित अर्थ यह है कि [1m] को केवल उन models के लिए million-token context route माँगने वाली Claude Code notation मानें जहाँ integration guide इसे दिखाती है—इसे नया model, अलग price या 1 million output tokens न मानें।

ध्यान रखें:

  • published maximum output 384K है, 1M नहीं;
  • CLAUDE_CODE_AUTO_COMPACT_WINDOW=786432 context limit से पहले compaction के लिए जगह छोड़ता है;
  • billing IDs deepseek-flash और deepseek-v4-pro हैं; जिस model के लिए current integration page suffix नहीं दिखाती, उसके नाम में suffix खुद से न जोड़ें।

3. लंबा काम शुरू करने से पहले छोटा validation करें

किसी disposable या low-risk project में Claude Code शुरू करें:

test -n "${ANTHROPIC_AUTH_TOKEN:-}"
test "$ANTHROPIC_BASE_URL" = "https://api.deepseek.com/anthropic"
claude --version
cd /path/to/your/project
claude

Read-only और observable task दें: “package.json या pyproject.toml पढ़ो, available scripts बताओ और files edit मत करो।” Success signal है normal response, successful file-read tool call और 401, 402, 429, connection या model error का न होना। यह synchronous interaction है; कोई job ID या polling नहीं है, output current session में मिलता है।

Claude Code fail हो तो documented Anthropic SDK pattern से endpoint को client से अलग जाँचें और response save करें:

python3 -m pip install anthropic
python3 - <<'PY'
import os
from pathlib import Path
import anthropic

client = anthropic.Anthropic(
    base_url=os.environ["ANTHROPIC_BASE_URL"],
    api_key=os.environ["ANTHROPIC_AUTH_TOKEN"],
)
message = client.messages.create(
    model="deepseek-flash",
    max_tokens=200,
    messages=[{"role": "user", "content": "Reply with: endpoint OK"}],
)
text = "\n".join(block.text for block in message.content if block.type == "text")
Path("deepseek-smoke.txt").write_text(text, encoding="utf-8")
print("saved deepseek-smoke.txt")
PY

यदि deepseek-smoke.txt बनता है लेकिन Claude Code fail रहता है, environment variables, conflicting settings और पुराने process देखें। यदि SDK भी fail करे, तो पहले Base URL, Key, balance और provider status जाँचें।

DeepSeek के अनुसार unsupported model name deepseek-flash पर fallback होता है। SDK check केवल transport साबित करता है, जबकि read-only Claude Code task एक basic tool call भी जाँचता है; दोनों में से कोई model identity साबित नहीं करता। Pro benchmark या cost estimate से पहले provider द्वारा उपलब्ध request, usage या billing detail देखें। यदि वहाँ model नहीं दिखता, तो successful response को Pro इस्तेमाल होने का प्रमाण न मानें।

Tools, thinking और web search की compatibility सीमित है

Anthropic Messages के core request और tool structures supported हैं, पर DeepSeek का व्यवहार Claude जैसा पूरी तरह समान नहीं हो जाता। Compatibility table में Claude Code के लिए मुख्य बातें ये हैं:

CapabilityCurrent statusइसका असर
tools, tool_use, tool_resultCore fields supportedLocal file और command tools के लिए protocol foundation मौजूद है
tool_choiceSupported; disable_parallel_tool_use ignoredइस flag से strict serial execution पर भरोसा न करें
Claude Code Web SearchNatively supportedSearch result summary अतिरिक्त LLM calls और token cost बनाती है
Anthropic cache_controlIgnoredAnthropic directive देखकर actual cache hit न मानें
ThinkingSupported; budget_tokens ignored, effort supportedCurrent profile CLAUDE_CODE_EFFORT_LEVEL=max रखता है; Claude budget field यहाँ spend control नहीं है
document और search_result input blocksNot supportedइन blocks पर निर्भर use case पहले छोटे sample पर जाँचें
code_execution_tool_result, mcp_tool_use blocksNot supportedServer-side code execution और Anthropic-specific MCP blocks equivalent नहीं हैं
tool_result.is_errorIgnoredCustom middleware failure meaning केवल इस field से न भेजे

DeepSeek की integration guide कहती है कि Claude Code Web Search DeepSeek API से चल सकता है। Model जब search चुनता है, retrieved content को summarize करने के लिए अतिरिक्त model requests होते हैं। Cost estimate में search, retries, tool loops और long context को शामिल करें।

Symptom के आधार पर troubleshooting करें

Symptomपहले क्या जाँचेंFix और retest
401 / authentication failureगलत Key, extra spaces, current shell में variable नहींHidden input से Key फिर डालें, Claude Code restart करें और वही read-only task दोहराएँ
402 / insufficient balanceDeepSeek balanceTop up करके वही छोटा request चलाएँ
400 / 422Invalid field, model ID या middleware rewriteOfficial variables restore करें; custom Thinking + tools client हर turn का reasoning_content वापस भेजे
429Request rate और parallel sessionsConcurrency कम करें और backoff के साथ retry करें
500 / 503Provider error या overloadथोड़ी देर बाद retry करें; लगातार होने पर समय note करें
जवाब आता है, लेकिन Pro जैसा नहींTypo या unsupported-name fallbackExact deepseek-v4-pro इस्तेमाल करें और dashboard में model/billing verify करें
Settings बदलती नहीं दिखतींपुराना process या दूसरी settings layerसभी Claude Code processes बंद करें, नया terminal खोलें, variables फिर set करें
Web Search trigger नहीं होताModel ने search को अनावश्यक माना हो सकता हैCurrent web info स्पष्ट रूप से माँगें; search न होना connection failure नहीं है

DeepSeek error-code page 401, 402, 429, 500 और 503 के अलग कारण बताती है। एक समय में केवल एक setting बदलें और हर बार वही छोटा task दोहराएँ।

27 सितंबर 2026 को सत्यापित DeepSeek और BetterToken कीमतें

नीचे सभी rates USD per 1 million tokens हैं। DeepSeek peak/off-peak tiers रखता है; BetterToken public catalog में वही time split नहीं है। बड़े run से पहले DeepSeek official pricing और एकमात्र BetterToken pricing page फिर देखें।

DeepSeek official pricing

Model ID / current versionTierCache-miss inputCache-hit inputOutput
deepseek-flash / DeepSeek-V4.1-FlashOff-peak$0.15$0.003$0.60
deepseek-flash / DeepSeek-V4.1-FlashPeak$0.30$0.006$1.20
deepseek-v4-pro / DeepSeek-V4-Pro-0813Off-peak$0.66$0.022$1.98
deepseek-v4-pro / DeepSeek-V4-Pro-0813Peak$1.32$0.044$3.96

Peak hours सोमवार से शुक्रवार 01:00–04:00 और 06:00–10:00 UTC हैं, Chinese public holidays को छोड़कर; बाकी समय off-peak है। 10 सितंबर की change log के अनुसार deepseek-flash अब V4.1 Flash चलाता है और पुराने deepseek-v4-flash नाम अस्थायी रूप से उसी पर route होते हैं।

BetterToken public catalog pricing

BetterToken ID / current mappingEndpoint typesInputCache hitOutput
deepseek-flash / latest Flash, अभी V4.1 FlashAnthropic, OpenAI$0.132$0.00264$0.528
deepseek-pro / latest Pro, अभी V4-Pro-0813OpenAI$0.5808$0.01936$1.7424
deepseek-v4-pro-0813 / V4-Pro-0813Anthropic, OpenAI$0.5896$0.0176$1.7644

deepseek-pro catalog में थोड़ा सस्ता है, लेकिन उसका endpoint type केवल OpenAI है। Similar name या price उसे Claude Code Anthropic Messages के लिए valid नहीं बनाती। BetterToken पर Pro के लिए deepseek-v4-pro-0813 verify करें, क्योंकि उसके record में Anthropic स्पष्ट है।

1 million cache-miss input और 200,000 output tokens के उदाहरण में, cache benefit, web search और retries के बिना:

  • Flash: DeepSeek off-peak लगभग $0.27, peak $0.54, BetterToken catalog लगभग $0.2376।
  • Pro: DeepSeek off-peak लगभग $1.056, peak $2.112, BetterToken Anthropic-capable Pro ID लगभग $0.9425।

ये 27 सितंबर 2026 के catalog snapshot की संख्याएँ हैं, हर दिन या हर invoice पर BetterToken के सस्ता होने का वादा नहीं। Context, tools, search, retries और price changes final cost बदलते हैं।

BetterToken route को बिना mapping अनुमान लगाए जाँचें

BetterToken public catalog में deepseek-flash और deepseek-v4-pro-0813 Anthropic-capable हैं, जबकि deepseek-pro केवल OpenAI endpoint पर है। इससे price comparison और candidate ID चुनना संभव है, लेकिन इससे confirmed Claude Code mapping सिद्ध नहीं होता।

मौजूदा BetterToken Claude Code guide https://bettertoken.ai को बिना /v1 के Base URL, authentication, restart behavior और Claude/Kimi/GLM mappings बताती है। वह DeepSeek-specific Claude Code profile नहीं देती। Claude provider के लिए guide ANTHROPIC_MODEL और ANTHROPIC_DEFAULT_*_MODEL को manually set न करने को भी कहती है। इसलिए केवल pricing catalog देखकर DeepSeek mapping बनाकर persist न करें।

यदि BetterToken का current Setup dialog या नई documentation DeepSeek profile दिखाए, तो वही exact model ID लें और ऊपर वाला read-only task तथा SDK smoke test दोहराएँ। Pro के लिए केवल Anthropic-capable deepseek-v4-pro-0813 पर विचार करें; OpenAI-only deepseek-pro को substitute न करें। DeepSeek-specific mapping document या account में confirm होने तक direct DeepSeek endpoint ही known configuration है।

Route evaluate करने से पहले current prices देखें, फिर account और API Key बनाएँ।

किस स्थिति में कौन-सा route चुनें

  • अधिकांश coding: direct DeepSeek endpoint और deepseek-flash[1m]; यह current official default है और iterative work का cost कम रखता है।
  • कठिन, high-value work: main thread और Opus पर deepseek-v4-pro; Sonnet, Haiku और subagent Flash पर। Scale करने से पहले fallback न होने की पुष्टि करें।
  • एक balance या multi-provider routing: BetterToken तभी evaluate करें जब current Setup DeepSeek profile दिखाए। supported_endpoint_types को candidate filter मानें, फिर actual mapping, exact ID और same-day price verify करें।
  • Claude-specific blocks या behavior parity: Claude model इस्तेमाल करें। Transport compatibility identical model behavior या complete tool parity साबित नहीं करती।

महत्वपूर्ण repository पर इस्तेमाल से पहले पूरा loop बंद करें: CLI version दिखाई दे, Key screen पर न आए, Base URL exact हो, read-only task सफल हो और model identity उपलब्ध records से confirm हो या साफ़ तौर पर unconfirmed लिखी जाए।

अपना LLM वर्कफ़्लो बेहतर बनाना चाहते हैं?

एक API से मॉडल जोड़ें, कुंजियाँ प्रबंधित करें और AI खर्च नियंत्रित करें।

मुफ़्त शुरू करें