Invitez et gagnez

Fonctionnement des récompenses

Partagez votre lien. Lorsqu’un ami s’inscrit avec ce lien et recharge son solde, vous recevez la récompense affichée sur ses recharges ultérieures.

Limites de Gemini CLI : quotas, suivi, réinitialisation et solutions

Guide pratique sur les quotas de Gemini CLI, la commande /stats model, l’absence d’heure officielle de réinitialisation et les choix après une limite atteinte.

Sommaire
Limites de Gemini CLI : quotas, suivi, réinitialisation et solutions

Vous êtes en plein refactoring quand Gemini CLI indique qu’une limite a été atteinte. La bonne décision dépend surtout du mode d’authentification utilisé : compte Google, abonnement personnel payant, licence Workspace, clé Gemini API ou Vertex AI. Ce guide vous aide à trouver le plafond quotidien applicable, à contrôler l’usage avec /stats model et à choisir entre attendre, passer à une offre supérieure, utiliser la facturation à l’usage ou poursuivre la tâche dans un autre agent de programmation.

Les limites quotidiennes de Gemini CLI en un coup d’œil

La page officielle Gemini CLI: Quotas and pricing indique les nombres maximums suivants de requêtes au modèle par utilisateur et par jour.

Méthode d’authentificationOffre ou abonnementMaximum de requêtes au modèle par utilisateur et par jourCondition importante
Compte GoogleGemini Code Assist pour les particuliers1 000Gemini CLI choisit parmi les modèles de la famille Gemini
Compte GoogleGoogle AI Pro1 500Compte personnel, abonnement à prix fixe
Compte GoogleGoogle AI Ultra2 000Compte personnel, abonnement à prix fixe
Clé Gemini APIOffre gratuite, non payante250Modèles Flash uniquement
Clé Gemini APIPaiement à l’usageVariableDépend du niveau tarifaire, du modèle et des tokens
Vertex AIExpress ModeVariableDépend du compte ; 90 jours avant de devoir activer la facturation
Vertex AIPaiement à l’usage standardVariableDynamic Shared Quota ou capacité provisionnée
Google WorkspaceCode Assist Standard1 500Licence attribuée par l’organisation nécessaire
Google WorkspaceCode Assist Enterprise2 000Licence attribuée par l’organisation nécessaire
Google WorkspaceWorkspace AI Ultra2 000Uniquement pour l’offre Workspace prise en charge

Ces chiffres comptent des requêtes au modèle, et non un nombre garanti de prompts, de modifications de code ou de tâches terminées. La même documentation précise que des limites par utilisateur et par minute s’appliquent également, et que le service dépend de sa disponibilité pendant les périodes de forte demande. Le plafond quotidien n’est donc pas la seule contrainte possible.

Commencez par identifier l’authentification réellement utilisée

Le quota dépend de l’authentification et de l’abonnement actifs, pas simplement de l’installation de Gemini CLI.

Connexion avec un compte Google personnel

Gemini Code Assist pour les particuliers offre une base de 1 000 requêtes au modèle par jour. La limite publiée passe à 1 500 avec Google AI Pro et à 2 000 avec Google AI Ultra.

Pour distinguer un compte personnel d’un compte Workspace, la page officielle conseille d’ouvrir Google One. Un compte personnel affiche son tableau de bord individuel ; un compte Workspace affiche un message indiquant que vous êtes connecté avec un compte Google Workspace.

Connexion avec un compte Google Workspace

La limite dépend de la licence attribuée par l’organisation : 1 500 requêtes par jour pour Code Assist Standard, 2 000 pour Code Assist Enterprise et 2 000 pour l’offre Workspace AI Ultra prise en charge.

Ne supposez pas que tout abonnement Workspace AI payant augmente le quota de Gemini CLI. La documentation indique que les offres non listées, notamment Workspace AI Standard/Plus et AI Expanded, ne sont pas prises en charge dans ce cadre. Elle précise aussi que certains abonnements Gemini pour Workspace concernent des produits web, pas l’usage de l’API qui alimente le CLI.

Utilisation d’une clé Gemini API

Une clé gratuite sans facturation a une limite publiée inférieure à celle d’une connexion Google : 250 requêtes par jour, uniquement vers les modèles Flash. Passer d’un compte Google personnel offrant 1 000 requêtes à une clé gratuite n’augmente donc pas la capacité.

Une clé payante fonctionne en paiement à l’usage. Le quota varie selon le niveau tarifaire, tandis que le coût dépend du modèle et des tokens consommés. Cette voie est plus souple pour maintenir un travail continu, mais elle remplace un forfait quotidien fixe par une dépense variable.

Utilisation de Vertex AI

Avec Vertex AI Express Mode, les modèles et quotas dépendent du compte. La page officielle indique une période de 90 jours avant qu’il soit nécessaire d’activer la facturation.

Vertex AI en mode standard est facturé à l’usage. Sa capacité est régie par un quota partagé dynamique ou par du débit provisionné acheté à l’avance, et le coût dépend du modèle et des tokens.

Vérifier l’usage avec /stats model

Exécutez cette commande dans Gemini CLI :

/stats model

D’après la documentation officielle, elle fournit un instantané de l’usage des tokens dans la session en cours ainsi que des informations sur les limites associées au quota actif. Gemini CLI affiche également un résumé de l’usage des modèles à la fermeture de la session.

Servez-vous du résultat pour trois vérifications :

  1. Confirmer le contexte de modèle et de quota de la session actuelle.
  2. Examiner les tokens de la session avant de lancer une nouvelle tâche volumineuse.
  3. Vérifier que la nouvelle authentification est bien active après une reconnexion.

N’attribuez pas à /stats model une précision supérieure à ce qu’affiche réellement la commande. La documentation officielle des quotas de Gemini CLI ne promet pas un compteur exact du nombre de tâches complètes encore possibles aujourd’hui et ne donne pas d’horodatage universel de réinitialisation. Lisez les champs affichés tels quels.

À quelle heure le quota quotidien est-il réinitialisé ?

La documentation officielle des quotas de Gemini CLI ne précise ni heure ni fuseau horaire universel de réinitialisation. Elle définit les plafonds en requêtes « par utilisateur et par jour », sans affirmer que le renouvellement se produit à minuit local, à minuit heure du Pacifique ou exactement 24 heures après la première requête.

Cette nuance compte, car de nombreuses réponses non officielles présentent l’une de ces hypothèses comme une règle certaine. D’après la documentation officielle de Gemini CLI, la conclusion rigoureuse est que l’heure exacte n’est pas documentée sur cette page.

Si le travail peut attendre, sauvegardez l’état, réessayez lors de la prochaine fenêtre de quota et relancez /stats model. S’il ne peut pas s’arrêter, ne construisez pas une opération critique autour d’un « minuit » non vérifié : choisissez une offre fixe compatible plus élevée, une clé payante, Vertex AI ou un autre agent de programmation.

Après « limit reached », choisissez selon votre situation

Il n’existe pas de réponse unique. L’urgence, le modèle de coût et la possibilité de modifier l’authentification déterminent la meilleure option.

Votre situationPremière action recommandéePourquoi
La tâche peut attendreSauvegarder puis reprendre après le renouvellement de l’allocation quotidienneAucun coût supplémentaire ni changement de compte
Le compte personnel atteint souvent 1 000Comparer AI Pro à 1 500 et AI Ultra à 2 000Plafond fixe plus élevé avec coût d’abonnement prévisible
L’entreprise gère les accèsVérifier l’attribution de Code Assist Standard, Enterprise ou Workspace AI UltraLe quota professionnel suit la licence attribuée
Une tâche longue doit continuer aujourd’huiPasser à une clé Gemini API payante ou à Vertex AI standardVoie officielle flexible après épuisement d’un quota fixe
Vous refusez la facturation variableMettre en pause, réduire le périmètre ou transférer à un autre agentConserve le modèle de coût, mais exige de transmettre le contexte
Vous utilisez une clé gratuite et manquez de capacitéÉvaluer la connexion Google ou l’usage payant plutôt qu’une autre solution gratuiteLa clé gratuite est limitée à 250 requêtes et aux modèles Flash

Attendre convient lorsque la continuité n’est pas critique

Sauvegardez ou validez l’état du dépôt, notez l’étape suivante et fermez proprement la session. Au retour, exécutez /stats model avant d’envoyer une consigne volumineuse afin de revoir le contexte d’usage et de quota.

L’attente est peu fiable pour un déploiement, un incident ou une exécution autonome longue. Puisque la source officielle ne publie pas l’heure de renouvellement, « attendre minuit » n’est pas un plan opérationnel robuste.

Une offre fixe supérieure convient aux usages prévisibles

Sur un compte personnel, AI Pro et AI Ultra augmentent le plafond quotidien publié sans passer à une facturation par token. Dans une organisation, Code Assist Standard et Enterprise fournissent des limites journalières sous licence.

Vérifiez la compatibilité exacte de l’offre avant de payer. La page officielle précise que Google AI Plus ne fait pas partie des niveaux personnels pris en charge et que plusieurs offres Workspace AI sont également exclues.

Le paiement à l’usage convient lorsque l’arrêt coûte plus cher

Une clé Gemini API payante est la voie mesurée la plus directe, tandis que Vertex AI ajoute les contrôles Google Cloud et des fonctions de gouvernance pour les organisations. Dans les deux cas, le quota varie au lieu de devenir un nombre quotidien universel.

Le contrôle des coûts reste indispensable. La documentation note qu’un grand nombre de petits appels contenant peu de tokens peut revenir cher. Formulez des consignes précises, limitez les allers-retours inutiles et suivez la session avec /stats model.

Un autre agent de programmation est un secours de workflow, pas une hausse de quota

Transférer la tâche vers un autre outil ne modifie pas la limite de Gemini CLI. Cela permet seulement de poursuivre sans changer le compte Gemini ni activer la facturation à l’usage.

Avant la transition, conservez la branche actuelle, le diff non validé, la commande en échec, les critères d’acceptation et la prochaine action prévue. Le nouvel agent risque ainsi moins de répéter le travail ou d’agir sur un contexte obsolète.

Si l’erreur apparaît avant l’épuisement apparent du plafond quotidien

Le quota journalier n’est pas la seule explication. La documentation officielle de Gemini CLI mentionne aussi des limites par utilisateur et par minute ainsi que la disponibilité en période de forte demande, mais ne donne pas de valeur universelle par minute.

Procédez du contrôle le moins coûteux au plus coûteux :

  1. Exécutez /stats model et examinez le modèle actif, l’usage de la session et les informations de quota.
  2. Vérifiez si de nombreuses requêtes ont été envoyées en rafale ; si oui, faites une pause et réessayez avant de changer d’offre.
  3. Confirmez le compte et le mode d’authentification actifs. Une clé gratuite, un compte personnel et Workspace ont des plafonds différents.
  4. Si l’allocation quotidienne est réellement épuisée, choisissez entre attendre, prendre une offre fixe compatible ou passer au paiement à l’usage.
  5. Si le quota semble disponible mais que le message persiste, considérez la disponibilité du service comme une cause distincte et réessayez plus tard ; ne supposez pas qu’un paiement supplémentaire corrigera forcément le problème.

Cet ordre évite de payer pour résoudre le mauvais problème. Une offre supérieure modifie le plafond quotidien, mais ne garantit pas la disparition de toute limitation transitoire ou par minute.

Les erreurs fréquentes qui faussent la décision

Erreur 1 : croire que tout abonnement Gemini payant s’applique au CLI

Pour planifier la capacité, retenez uniquement les niveaux explicitement listés sur la page officielle des quotas du CLI. Un abonnement à un produit web Gemini n’augmente pas automatiquement le quota de l’API utilisée dans le terminal.

Erreur 2 : passer à une clé gratuite pour obtenir plus de requêtes

Les chiffres publiés montrent l’inverse : 1 000 requêtes quotidiennes pour une connexion Google personnelle contre 250 pour une clé non payante, limitée en plus aux modèles Flash.

Erreur 3 : transformer « par jour » en heure officielle de remise à zéro

« Par jour » décrit la période d’allocation, pas l’horloge. La documentation officielle des quotas de Gemini CLI ne précise ni fuseau ni heure exacte de renouvellement.

Erreur 4 : assimiler une requête à une tâche terminée

Le tableau officiel compte des requêtes au modèle. Une migration complète de dépôt, une courte explication et un débogage itératif ne représentent pas le même travail. Prévoyez une marge pour les tâches longues plutôt que de diviser le plafond par un nombre inventé de requêtes par tâche.

Checklist avant une longue session Gemini CLI

  1. Identifiez si la session utilise un compte Google personnel, Workspace, une clé API ou Vertex AI.
  2. Confirmez le niveau pris en charge et son plafond quotidien sur la page officielle.
  3. Exécutez /stats model et notez les informations de la session actuelle.
  4. Sauvegardez ou validez un point propre avant une longue tâche autonome.
  5. Décidez à l’avance de la conduite à tenir à la limite : attendre, changer d’offre, passer à une authentification payante ou transférer la tâche.
  6. En paiement à l’usage, mettez en place un suivi des coûts et privilégiez des consignes précises à de nombreux petits appels.
  7. Ne dépendez pas d’une heure précise de réinitialisation tant que Google ne l’a pas documentée pour votre compte et votre méthode d’authentification.

Avec ces décisions prises avant le lancement, un message de limite devient un simple choix d’itinéraire, pas une urgence au milieu du travail.

Références officielles

Prêt à optimiser votre workflow LLM ?

Connectez vos modèles via une API unique, gérez les clés et maîtrisez vos dépenses d’IA.

Commencer gratuitement