आमंत्रित करें और कमाएँ

आमंत्रण पुरस्कार कैसे काम करते हैं

अपना आमंत्रण लिंक साझा करें। मित्र इसके माध्यम से पंजीकरण करके टॉप-अप करता है तो उसके बाद के टॉप-अप पर आपको दिखाया गया पुरस्कार मिलेगा।

Gemini CLI की सीमाएँ: दैनिक कोटा, उपयोग जाँच, रीसेट और आगे क्या करें

Gemini CLI की दैनिक अनुरोध सीमाओं, /stats model, अनिश्चित रीसेट समय और limit reached के बाद प्रतीक्षा, अपग्रेड या pay-as-you-go चुनने की व्यावहारिक गाइड।

विषय-सूची
Gemini CLI की सीमाएँ: दैनिक कोटा, उपयोग जाँच, रीसेट और आगे क्या करें

आप किसी बड़े refactor के बीच हैं और Gemini CLI अचानक बताता है कि सीमा पूरी हो गई है। अगला कदम इस बात पर निर्भर करता है कि आपने Google account, व्यक्तिगत paid plan, Workspace license, Gemini API key या Vertex AI से लॉगिन किया है। यह गाइड आपकी वास्तविक दैनिक सीमा पहचानने, /stats model से मौजूदा उपयोग देखने और प्रतीक्षा, अपग्रेड, pay-as-you-go या किसी दूसरे coding agent में काम जारी रखने के बीच निर्णय लेने में मदद करती है।

Gemini CLI की दैनिक सीमाएँ एक नज़र में

आधिकारिक Gemini CLI quotas and pricing पेज हर उपयोगकर्ता के लिए प्रतिदिन अधिकतम model requests इस तरह बताता है।

प्रमाणीकरण तरीकाTier या subscriptionप्रति उपयोगकर्ता प्रतिदिन अधिकतम model requestsमहत्वपूर्ण शर्त
Google accountGemini Code Assist for individuals1,000Gemini CLI, Gemini model family में से model चुनता है
Google accountGoogle AI Pro1,500व्यक्तिगत account, fixed-price subscription
Google accountGoogle AI Ultra2,000व्यक्तिगत account, fixed-price subscription
Gemini API keyFree tier, unpaid250केवल Flash models
Gemini API keyPay-as-you-goअलग-अलगPricing tier, model और token usage पर निर्भर
Vertex AIExpress Modeअलग-अलगAccount-specific; billing की आवश्यकता से पहले 90 दिन
Vertex AIRegular pay-as-you-goअलग-अलगDynamic shared quota या provisioned throughput
Google WorkspaceCode Assist Standard1,500संगठन द्वारा license assign होना चाहिए
Google WorkspaceCode Assist Enterprise2,000संगठन द्वारा license assign होना चाहिए
Google WorkspaceWorkspace AI Ultra2,000केवल समर्थित Workspace tier पर लागू

ये संख्याएँ model requests के लिए हैं, न कि निश्चित संख्या में prompts, code edits या पूरी हुई coding tasks के लिए। उसी आधिकारिक पेज के अनुसार प्रति उपयोगकर्ता प्रति मिनट भी सीमाएँ लागू होती हैं, और अधिक मांग के समय सेवा की उपलब्धता प्रभावित हो सकती है। इसलिए दैनिक सीमा अकेली संभावित रुकावट नहीं है।

पहले पता करें कि आप वास्तव में किस तरीके से लॉगिन हैं

Gemini CLI का कोटा सक्रिय authentication और subscription से तय होता है, केवल CLI install होने से नहीं।

व्यक्तिगत Google account से लॉगिन

Gemini Code Assist for individuals की आधार सीमा प्रतिदिन 1,000 model requests है। Google AI Pro के लिए 1,500 और Google AI Ultra के लिए 2,000 requests सूचीबद्ध हैं।

व्यक्तिगत और Workspace account में अंतर जानने के लिए आधिकारिक पेज Google One खोलने का सुझाव देता है। व्यक्तिगत account में personal dashboard दिखता है; Workspace account में यह संदेश दिखता है कि आप Google Workspace account से signed in हैं।

Google Workspace account से लॉगिन

आपकी सीमा संगठन द्वारा दिए गए license पर निर्भर करती है: Code Assist Standard के लिए 1,500, Code Assist Enterprise के लिए 2,000 और समर्थित Workspace AI Ultra tier के लिए 2,000 requests प्रतिदिन।

यह न मानें कि हर paid Workspace AI plan Gemini CLI का कोटा बढ़ाता है। आधिकारिक पेज के अनुसार सूची में न दिए गए tiers, जिनमें Workspace AI Standard/Plus और AI Expanded शामिल हैं, इस उपयोग के लिए समर्थित नहीं हैं। कुछ Workspace Gemini plans केवल web products पर लागू होते हैं, Gemini CLI चलाने वाली API usage पर नहीं।

Gemini API key से लॉगिन

Unpaid Gemini API key की सीमा Google-account login से कम है: प्रतिदिन 250 model requests, और केवल Flash models। इसलिए 1,000-request वाले व्यक्तिगत Google login से free API key पर जाना कोटा अपग्रेड नहीं है।

Paid API key pay-as-you-go pricing का उपयोग करती है। कोटा pricing tier के अनुसार बदलता है, जबकि लागत model और token usage पर निर्भर करती है। यह लगातार काम करने के लिए अधिक लचीला है, लेकिन fixed daily allowance की जगह metered billing आती है।

Vertex AI का उपयोग

Vertex AI Express Mode में models और quotas account-specific होते हैं। आधिकारिक पेज बताता है कि billing enable करने की आवश्यकता से पहले 90 दिन उपलब्ध होते हैं।

Regular Vertex AI pay-as-you-go है। इसका quota dynamic shared quota या पहले से खरीदे गए provisioned throughput से नियंत्रित होता है, और लागत model व token usage पर आधारित होती है।

/stats model से Gemini CLI का उपयोग जाँचें

Gemini CLI के अंदर यह command चलाएँ:

/stats model

आधिकारिक दस्तावेज़ के अनुसार यह मौजूदा session के token usage का snapshot और सक्रिय quota से जुड़ी limits की जानकारी देता है। Session से बाहर निकलते समय Gemini CLI model usage का सार भी दिखाता है।

इस output का उपयोग तीन जाँचों के लिए करें:

  1. देखें कि मौजूदा session किस model और quota context में चल रहा है।
  2. किसी बड़ी task से पहले session token usage की समीक्षा करें।
  3. दोबारा login या authentication बदलने के बाद पुष्टि करें कि नया quota context सक्रिय है।

/stats model को उसके वास्तविक output से अधिक सटीक न मानें। Gemini CLI का आधिकारिक quota पेज यह वादा नहीं करता कि command “आज कितनी पूरी coding tasks बची हैं” का exact countdown दिखाएगी, और वह universal reset timestamp भी नहीं देता। जो fields दिखें, उन्हें उसी अर्थ में पढ़ें।

Gemini CLI का दैनिक कोटा किस समय रीसेट होता है?

Gemini CLI का आधिकारिक quota पेज किसी निश्चित reset hour या timezone का उल्लेख नहीं करता। वह limits को “per user per day” बताता है, लेकिन यह नहीं कहता कि reset स्थानीय आधी रात, Pacific Time की आधी रात, या पहले request के ठीक 24 घंटे बाद होगा।

यह फर्क महत्वपूर्ण है क्योंकि कई अनौपचारिक उत्तर इनमें से किसी एक संभावना को पक्का नियम बताते हैं। Gemini CLI के आधिकारिक quota पेज के आधार पर सुरक्षित निष्कर्ष यही है कि exact reset clock उस पेज पर documented नहीं है।

यदि काम रुक सकता है, तो मौजूदा state save करें, अगले quota window में फिर कोशिश करें और /stats model दोबारा चलाएँ। यदि काम रुक नहीं सकता, तो किसी अप्रमाणित “midnight reset” पर schedule न बनाएँ; इसके बजाय समर्थित higher fixed tier, paid API key, Vertex AI या किसी दूसरे coding agent को चुनें।

“Limit reached” के बाद स्थिति के अनुसार रास्ता चुनें

एक ही समाधान सबके लिए सही नहीं है। निर्णय urgency, billing model और authentication बदलने की इच्छा पर करें।

आपकी स्थितिपहला सही कदमकारण
Task प्रतीक्षा कर सकती हैProgress save करें और daily allowance renew होने पर लौटेंकोई अतिरिक्त लागत या account बदलाव नहीं
व्यक्तिगत Google account बार-बार 1,000 पर रुकता हैAI Pro के 1,500 और AI Ultra के 2,000 की तुलना करेंअधिक fixed daily ceiling और predictable subscription cost
Access कंपनी संभालती हैपूछें कि Code Assist Standard, Enterprise या Workspace AI Ultra assign है या नहींसंगठन का quota licensed tier से तय होता है
Long-running काम आज ही जारी रहना चाहिएPaid Gemini API key या regular Vertex AI पर जाएँFixed daily limit के बाद यह आधिकारिक flexible path है
Metered billing नहीं चाहिएकाम रोकें, scope घटाएँ या दूसरे coding agent में जाएँBilling model बचता है, लेकिन context transfer करना होगा
Free API key उपयोग कर रहे हैं और अधिक capacity चाहिएनए free-key workflow के बजाय Google login या paid usage जाँचेंFree key केवल 250 requests/day और Flash-only है

Continuity जरूरी न हो तो प्रतीक्षा सबसे सरल है

Repository state commit या save करें, अगला स्पष्ट step लिखें और session ठीक से बंद करें। लौटने पर बड़ा prompt भेजने से पहले /stats model चलाएँ, ताकि current session और quota information सामने हो।

लेकिन deployment, incident या long autonomous run के लिए प्रतीक्षा कमजोर योजना है। क्योंकि official source reset hour प्रकाशित नहीं करता, “midnight तक इंतज़ार करें” operational guarantee नहीं है।

Predictable cost के लिए supported fixed-price upgrade बेहतर है

व्यक्तिगत Google account में AI Pro और AI Ultra listed daily ceiling बढ़ाते हैं, पर per-token billing में नहीं ले जाते। संगठनों में Code Assist Standard और Enterprise licensed daily limits देते हैं।

Payment से पहले exact tier का support जाँचें। Official page स्पष्ट करता है कि Google AI Plus supported personal tiers में नहीं है, और कई Workspace AI plans भी बाहर हैं।

रुकने की लागत variable billing से अधिक हो तो pay-as-you-go चुनें

Paid Gemini API key सबसे सीधा metered option है, जबकि Vertex AI Google Cloud controls और enterprise governance जोड़ता है। दोनों में quota एक universal daily number नहीं रहता; वह tier या allocated resources पर निर्भर करता है।

Metered access के साथ cost discipline जरूरी है। Official page कहता है कि कम tokens वाले बहुत से छोटे calls भी महँगे हो सकते हैं। इसलिए precise prompts लिखें, अनावश्यक back-and-forth घटाएँ और /stats model से session usage देखते रहें।

दूसरा coding agent workflow fallback है, Gemini quota upgrade नहीं

Task को किसी और tool में ले जाने से Gemini CLI की limit नहीं बदलती। इससे केवल account या billing बदले बिना काम जारी रखा जा सकता है।

Switch करने से पहले current branch, uncommitted diff, failed command, acceptance criteria और अगला intended action सुरक्षित करें। इससे नया agent काम दोहराने या पुराने context पर बदलाव करने से बचता है।

Daily number पूरा न दिखे फिर भी error क्यों आ सकता है?

दैनिक सीमा एकमात्र कारण नहीं है। Gemini CLI का आधिकारिक quota पेज per-user, per-minute limits और high-demand periods में service availability का भी उल्लेख करता है, लेकिन कोई universal per-minute number प्रकाशित नहीं करता।

कम लागत वाले क्रम में troubleshooting करें:

  1. /stats model चलाकर active model, session usage और quota information देखें।
  2. जाँचें कि क्या आपने बहुत कम समय में requests का burst भेजा था; ऐसा हो तो तुरंत plan बदलने के बजाय pause करके retry करें।
  3. Active account और authentication method की पुष्टि करें। Free API key, personal Google login और Workspace login की ceilings अलग हैं।
  4. यदि daily allowance सचमुच खत्म है, तो प्रतीक्षा, supported fixed tier या pay-as-you-go चुनें।
  5. यदि quota उपलब्ध दिखती है लेकिन error बनी रहती है, तो service availability को अलग संभावना मानें और बाद में retry करें; upgrade को guaranteed fix न समझें।

यह क्रम गलत समस्या पर पैसा खर्च होने से बचाता है। Upgrade daily ceiling बदल सकता है, लेकिन हर transient या per-minute restriction हटाने की गारंटी नहीं देता।

गलत quota निर्णय कराने वाली सामान्य भूलें

भूल 1: हर paid Gemini plan को CLI पर लागू मानना

Capacity planning के लिए केवल वे tiers मानें जो official CLI quota page पर स्पष्ट रूप से listed हैं। Gemini web product की subscription अपने-आप CLI के पीछे वाली API quota नहीं बढ़ाती।

भूल 2: अधिक quota के लिए free API key पर जाना

Published numbers इसका उल्टा बताते हैं: personal Google login के लिए 1,000 requests/day, जबकि unpaid API key के लिए 250 और वह भी Flash models तक सीमित।

भूल 3: “Per day” को documented reset time मान लेना

“Per day” allowance period बताता है, clock नहीं। Gemini CLI का आधिकारिक quota पेज timezone या exact renewal hour नहीं बताता।

भूल 4: Request count को completed-task capacity समझना

Official table model requests गिनती है। Repository-wide migration, छोटा explanation और iterative debugging एक जैसी units of work नहीं हैं। Long tasks को margin के साथ plan करें, किसी कल्पित requests-per-task संख्या से daily quota को divide न करें।

लंबी Gemini CLI session से पहले checklist

  1. तय करें कि session personal Google login, Workspace, API key या Vertex AI उपयोग करती है।
  2. Official quota page पर exact supported tier और daily ceiling जाँचें।
  3. /stats model चलाकर current session information नोट करें।
  4. Long autonomous task से पहले clean checkpoint save या commit करें।
  5. Limit आने पर पहले से route चुनें: प्रतीक्षा, upgrade, paid authentication या दूसरे agent में transfer।
  6. Pay-as-you-go में cost monitoring रखें और repeated small calls के बजाय precise prompts लिखें।
  7. किसी exact reset hour पर तब तक निर्भर न रहें जब तक Google आपके account और authentication path के लिए उसे document न करे।

इन निर्णयों को पहले लेने पर limit message emergency नहीं, केवल routing choice बन जाता है।

आधिकारिक संदर्भ

अपना LLM वर्कफ़्लो बेहतर बनाना चाहते हैं?

एक API से मॉडल जोड़ें, कुंजियाँ प्रबंधित करें और AI खर्च नियंत्रित करें।

मुफ़्त शुरू करें