Limites de Gemini CLI : quotas, suivi, réinitialisation et solutions
Guide pratique sur les quotas de Gemini CLI, la commande /stats model, l’absence d’heure officielle de réinitialisation et les choix après une limite atteinte.
Sommaire

Vous êtes en plein refactoring quand Gemini CLI indique qu’une limite a été atteinte. La bonne décision dépend surtout du mode d’authentification utilisé : compte Google, abonnement personnel payant, licence Workspace, clé Gemini API ou Vertex AI. Ce guide vous aide à trouver le plafond quotidien applicable, à contrôler l’usage avec /stats model et à choisir entre attendre, passer à une offre supérieure, utiliser la facturation à l’usage ou poursuivre la tâche dans un autre agent de programmation.
Les limites quotidiennes de Gemini CLI en un coup d’œil
La page officielle Gemini CLI: Quotas and pricing indique les nombres maximums suivants de requêtes au modèle par utilisateur et par jour.
| Méthode d’authentification | Offre ou abonnement | Maximum de requêtes au modèle par utilisateur et par jour | Condition importante |
|---|---|---|---|
| Compte Google | Gemini Code Assist pour les particuliers | 1 000 | Gemini CLI choisit parmi les modèles de la famille Gemini |
| Compte Google | Google AI Pro | 1 500 | Compte personnel, abonnement à prix fixe |
| Compte Google | Google AI Ultra | 2 000 | Compte personnel, abonnement à prix fixe |
| Clé Gemini API | Offre gratuite, non payante | 250 | Modèles Flash uniquement |
| Clé Gemini API | Paiement à l’usage | Variable | Dépend du niveau tarifaire, du modèle et des tokens |
| Vertex AI | Express Mode | Variable | Dépend du compte ; 90 jours avant de devoir activer la facturation |
| Vertex AI | Paiement à l’usage standard | Variable | Dynamic Shared Quota ou capacité provisionnée |
| Google Workspace | Code Assist Standard | 1 500 | Licence attribuée par l’organisation nécessaire |
| Google Workspace | Code Assist Enterprise | 2 000 | Licence attribuée par l’organisation nécessaire |
| Google Workspace | Workspace AI Ultra | 2 000 | Uniquement pour l’offre Workspace prise en charge |
Ces chiffres comptent des requêtes au modèle, et non un nombre garanti de prompts, de modifications de code ou de tâches terminées. La même documentation précise que des limites par utilisateur et par minute s’appliquent également, et que le service dépend de sa disponibilité pendant les périodes de forte demande. Le plafond quotidien n’est donc pas la seule contrainte possible.
Commencez par identifier l’authentification réellement utilisée
Le quota dépend de l’authentification et de l’abonnement actifs, pas simplement de l’installation de Gemini CLI.
Connexion avec un compte Google personnel
Gemini Code Assist pour les particuliers offre une base de 1 000 requêtes au modèle par jour. La limite publiée passe à 1 500 avec Google AI Pro et à 2 000 avec Google AI Ultra.
Pour distinguer un compte personnel d’un compte Workspace, la page officielle conseille d’ouvrir Google One. Un compte personnel affiche son tableau de bord individuel ; un compte Workspace affiche un message indiquant que vous êtes connecté avec un compte Google Workspace.
Connexion avec un compte Google Workspace
La limite dépend de la licence attribuée par l’organisation : 1 500 requêtes par jour pour Code Assist Standard, 2 000 pour Code Assist Enterprise et 2 000 pour l’offre Workspace AI Ultra prise en charge.
Ne supposez pas que tout abonnement Workspace AI payant augmente le quota de Gemini CLI. La documentation indique que les offres non listées, notamment Workspace AI Standard/Plus et AI Expanded, ne sont pas prises en charge dans ce cadre. Elle précise aussi que certains abonnements Gemini pour Workspace concernent des produits web, pas l’usage de l’API qui alimente le CLI.
Utilisation d’une clé Gemini API
Une clé gratuite sans facturation a une limite publiée inférieure à celle d’une connexion Google : 250 requêtes par jour, uniquement vers les modèles Flash. Passer d’un compte Google personnel offrant 1 000 requêtes à une clé gratuite n’augmente donc pas la capacité.
Une clé payante fonctionne en paiement à l’usage. Le quota varie selon le niveau tarifaire, tandis que le coût dépend du modèle et des tokens consommés. Cette voie est plus souple pour maintenir un travail continu, mais elle remplace un forfait quotidien fixe par une dépense variable.
Utilisation de Vertex AI
Avec Vertex AI Express Mode, les modèles et quotas dépendent du compte. La page officielle indique une période de 90 jours avant qu’il soit nécessaire d’activer la facturation.
Vertex AI en mode standard est facturé à l’usage. Sa capacité est régie par un quota partagé dynamique ou par du débit provisionné acheté à l’avance, et le coût dépend du modèle et des tokens.
Vérifier l’usage avec /stats model
Exécutez cette commande dans Gemini CLI :
/stats model
D’après la documentation officielle, elle fournit un instantané de l’usage des tokens dans la session en cours ainsi que des informations sur les limites associées au quota actif. Gemini CLI affiche également un résumé de l’usage des modèles à la fermeture de la session.
Servez-vous du résultat pour trois vérifications :
- Confirmer le contexte de modèle et de quota de la session actuelle.
- Examiner les tokens de la session avant de lancer une nouvelle tâche volumineuse.
- Vérifier que la nouvelle authentification est bien active après une reconnexion.
N’attribuez pas à /stats model une précision supérieure à ce qu’affiche réellement la commande. La documentation officielle des quotas de Gemini CLI ne promet pas un compteur exact du nombre de tâches complètes encore possibles aujourd’hui et ne donne pas d’horodatage universel de réinitialisation. Lisez les champs affichés tels quels.
À quelle heure le quota quotidien est-il réinitialisé ?
La documentation officielle des quotas de Gemini CLI ne précise ni heure ni fuseau horaire universel de réinitialisation. Elle définit les plafonds en requêtes « par utilisateur et par jour », sans affirmer que le renouvellement se produit à minuit local, à minuit heure du Pacifique ou exactement 24 heures après la première requête.
Cette nuance compte, car de nombreuses réponses non officielles présentent l’une de ces hypothèses comme une règle certaine. D’après la documentation officielle de Gemini CLI, la conclusion rigoureuse est que l’heure exacte n’est pas documentée sur cette page.
Si le travail peut attendre, sauvegardez l’état, réessayez lors de la prochaine fenêtre de quota et relancez /stats model. S’il ne peut pas s’arrêter, ne construisez pas une opération critique autour d’un « minuit » non vérifié : choisissez une offre fixe compatible plus élevée, une clé payante, Vertex AI ou un autre agent de programmation.
Après « limit reached », choisissez selon votre situation
Il n’existe pas de réponse unique. L’urgence, le modèle de coût et la possibilité de modifier l’authentification déterminent la meilleure option.
| Votre situation | Première action recommandée | Pourquoi |
|---|---|---|
| La tâche peut attendre | Sauvegarder puis reprendre après le renouvellement de l’allocation quotidienne | Aucun coût supplémentaire ni changement de compte |
| Le compte personnel atteint souvent 1 000 | Comparer AI Pro à 1 500 et AI Ultra à 2 000 | Plafond fixe plus élevé avec coût d’abonnement prévisible |
| L’entreprise gère les accès | Vérifier l’attribution de Code Assist Standard, Enterprise ou Workspace AI Ultra | Le quota professionnel suit la licence attribuée |
| Une tâche longue doit continuer aujourd’hui | Passer à une clé Gemini API payante ou à Vertex AI standard | Voie officielle flexible après épuisement d’un quota fixe |
| Vous refusez la facturation variable | Mettre en pause, réduire le périmètre ou transférer à un autre agent | Conserve le modèle de coût, mais exige de transmettre le contexte |
| Vous utilisez une clé gratuite et manquez de capacité | Évaluer la connexion Google ou l’usage payant plutôt qu’une autre solution gratuite | La clé gratuite est limitée à 250 requêtes et aux modèles Flash |
Attendre convient lorsque la continuité n’est pas critique
Sauvegardez ou validez l’état du dépôt, notez l’étape suivante et fermez proprement la session. Au retour, exécutez /stats model avant d’envoyer une consigne volumineuse afin de revoir le contexte d’usage et de quota.
L’attente est peu fiable pour un déploiement, un incident ou une exécution autonome longue. Puisque la source officielle ne publie pas l’heure de renouvellement, « attendre minuit » n’est pas un plan opérationnel robuste.
Une offre fixe supérieure convient aux usages prévisibles
Sur un compte personnel, AI Pro et AI Ultra augmentent le plafond quotidien publié sans passer à une facturation par token. Dans une organisation, Code Assist Standard et Enterprise fournissent des limites journalières sous licence.
Vérifiez la compatibilité exacte de l’offre avant de payer. La page officielle précise que Google AI Plus ne fait pas partie des niveaux personnels pris en charge et que plusieurs offres Workspace AI sont également exclues.
Le paiement à l’usage convient lorsque l’arrêt coûte plus cher
Une clé Gemini API payante est la voie mesurée la plus directe, tandis que Vertex AI ajoute les contrôles Google Cloud et des fonctions de gouvernance pour les organisations. Dans les deux cas, le quota varie au lieu de devenir un nombre quotidien universel.
Le contrôle des coûts reste indispensable. La documentation note qu’un grand nombre de petits appels contenant peu de tokens peut revenir cher. Formulez des consignes précises, limitez les allers-retours inutiles et suivez la session avec /stats model.
Un autre agent de programmation est un secours de workflow, pas une hausse de quota
Transférer la tâche vers un autre outil ne modifie pas la limite de Gemini CLI. Cela permet seulement de poursuivre sans changer le compte Gemini ni activer la facturation à l’usage.
Avant la transition, conservez la branche actuelle, le diff non validé, la commande en échec, les critères d’acceptation et la prochaine action prévue. Le nouvel agent risque ainsi moins de répéter le travail ou d’agir sur un contexte obsolète.
Si l’erreur apparaît avant l’épuisement apparent du plafond quotidien
Le quota journalier n’est pas la seule explication. La documentation officielle de Gemini CLI mentionne aussi des limites par utilisateur et par minute ainsi que la disponibilité en période de forte demande, mais ne donne pas de valeur universelle par minute.
Procédez du contrôle le moins coûteux au plus coûteux :
- Exécutez
/stats modelet examinez le modèle actif, l’usage de la session et les informations de quota. - Vérifiez si de nombreuses requêtes ont été envoyées en rafale ; si oui, faites une pause et réessayez avant de changer d’offre.
- Confirmez le compte et le mode d’authentification actifs. Une clé gratuite, un compte personnel et Workspace ont des plafonds différents.
- Si l’allocation quotidienne est réellement épuisée, choisissez entre attendre, prendre une offre fixe compatible ou passer au paiement à l’usage.
- Si le quota semble disponible mais que le message persiste, considérez la disponibilité du service comme une cause distincte et réessayez plus tard ; ne supposez pas qu’un paiement supplémentaire corrigera forcément le problème.
Cet ordre évite de payer pour résoudre le mauvais problème. Une offre supérieure modifie le plafond quotidien, mais ne garantit pas la disparition de toute limitation transitoire ou par minute.
Les erreurs fréquentes qui faussent la décision
Erreur 1 : croire que tout abonnement Gemini payant s’applique au CLI
Pour planifier la capacité, retenez uniquement les niveaux explicitement listés sur la page officielle des quotas du CLI. Un abonnement à un produit web Gemini n’augmente pas automatiquement le quota de l’API utilisée dans le terminal.
Erreur 2 : passer à une clé gratuite pour obtenir plus de requêtes
Les chiffres publiés montrent l’inverse : 1 000 requêtes quotidiennes pour une connexion Google personnelle contre 250 pour une clé non payante, limitée en plus aux modèles Flash.
Erreur 3 : transformer « par jour » en heure officielle de remise à zéro
« Par jour » décrit la période d’allocation, pas l’horloge. La documentation officielle des quotas de Gemini CLI ne précise ni fuseau ni heure exacte de renouvellement.
Erreur 4 : assimiler une requête à une tâche terminée
Le tableau officiel compte des requêtes au modèle. Une migration complète de dépôt, une courte explication et un débogage itératif ne représentent pas le même travail. Prévoyez une marge pour les tâches longues plutôt que de diviser le plafond par un nombre inventé de requêtes par tâche.
Checklist avant une longue session Gemini CLI
- Identifiez si la session utilise un compte Google personnel, Workspace, une clé API ou Vertex AI.
- Confirmez le niveau pris en charge et son plafond quotidien sur la page officielle.
- Exécutez
/stats modelet notez les informations de la session actuelle. - Sauvegardez ou validez un point propre avant une longue tâche autonome.
- Décidez à l’avance de la conduite à tenir à la limite : attendre, changer d’offre, passer à une authentification payante ou transférer la tâche.
- En paiement à l’usage, mettez en place un suivi des coûts et privilégiez des consignes précises à de nombreux petits appels.
- Ne dépendez pas d’une heure précise de réinitialisation tant que Google ne l’a pas documentée pour votre compte et votre méthode d’authentification.
Avec ces décisions prises avant le lancement, un message de limite devient un simple choix d’itinéraire, pas une urgence au milieu du travail.