Convide e ganhe

Como funcionam as recompensas

Compartilhe seu link. Quando um amigo se cadastrar por ele e adicionar saldo, você receberá a recompensa exibida nas recargas posteriores.

Limites do Gemini CLI: cota diária, uso, redefinição e como continuar

Guia prático sobre os limites do Gemini CLI, o comando /stats model, a ausência de um horário oficial de redefinição e as opções após atingir a cota.

Conteúdo
Limites do Gemini CLI: cota diária, uso, redefinição e como continuar

Você está no meio de uma refatoração quando o Gemini CLI informa que um limite foi atingido. A próxima decisão depende principalmente de como a autenticação foi feita: conta Google, plano pessoal pago, licença do Workspace, chave da Gemini API ou Vertex AI. Este guia mostra o teto diário aplicável, como verificar o uso com /stats model e quando vale a pena esperar, fazer upgrade, migrar para pagamento por uso ou continuar a tarefa em outro agente de programação.

Limites diários do Gemini CLI em uma tabela

A página oficial de cotas e preços do Gemini CLI informa os seguintes máximos de solicitações ao modelo por usuário por dia.

Método de autenticaçãoNível ou assinaturaMáximo de solicitações ao modelo por usuário por diaCondição importante
Conta GoogleGemini Code Assist para indivíduos1.000O Gemini CLI escolhe entre modelos da família Gemini
Conta GoogleGoogle AI Pro1.500Conta pessoal; assinatura de preço fixo
Conta GoogleGoogle AI Ultra2.000Conta pessoal; assinatura de preço fixo
Chave da Gemini APICamada gratuita, sem pagamento250Somente modelos Flash
Chave da Gemini APIPagamento por usoVariaDepende da faixa de preços, do modelo e dos tokens
Vertex AIExpress ModeVariaEspecífico da conta; 90 dias antes de exigir faturamento
Vertex AIPagamento por uso regularVariaCota compartilhada dinâmica ou capacidade provisionada
Google WorkspaceCode Assist Standard1.500Exige licença atribuída pela organização
Google WorkspaceCode Assist Enterprise2.000Exige licença atribuída pela organização
Google WorkspaceWorkspace AI Ultra2.000Somente para o nível do Workspace compatível

Esses números representam solicitações ao modelo, não uma quantidade garantida de prompts, alterações de código ou tarefas concluídas. A mesma documentação informa que há limites por usuário por minuto e que a disponibilidade do serviço pode variar em períodos de alta demanda. Portanto, a cota diária não é a única restrição possível.

Primeiro, identifique qual autenticação está realmente ativa

A cota é determinada pela autenticação e pela assinatura em uso, não apenas pelo fato de o Gemini CLI estar instalado.

Login com uma conta Google pessoal

O Gemini Code Assist para indivíduos oferece um limite base de 1.000 solicitações ao modelo por dia. O Google AI Pro eleva o máximo publicado para 1.500, e o Google AI Ultra para 2.000.

Para distinguir uma conta pessoal de uma conta do Workspace, a página oficial recomenda abrir o Google One. Uma conta pessoal mostra o painel individual; uma conta corporativa exibe uma mensagem informando que o login foi feito com uma conta Google Workspace.

Login com uma conta Google Workspace

O limite depende da licença atribuída pela organização: 1.500 solicitações por dia no Code Assist Standard, 2.000 no Code Assist Enterprise e 2.000 no nível compatível do Workspace AI Ultra.

Não presuma que qualquer plano pago do Workspace AI aumenta a cota do Gemini CLI. A documentação diz que níveis não listados, como Workspace AI Standard/Plus e AI Expanded, não são compatíveis para essa finalidade. Ela também explica que alguns planos Gemini para Workspace cobrem produtos web, mas não o uso de API que sustenta o CLI.

Uso de uma chave da Gemini API

Uma chave gratuita e sem faturamento tem um limite publicado menor que o login com conta Google: 250 solicitações por dia e apenas para modelos Flash. Migrar do acesso pessoal do Google, com 1.000 solicitações, para uma chave gratuita não aumenta a capacidade.

Uma chave paga funciona no modelo pay-as-you-go. A cota varia conforme a faixa de preços, enquanto o custo depende do modelo e do volume de tokens. É uma opção mais flexível para manter uma execução em andamento, mas substitui uma franquia diária fixa por faturamento variável.

Uso do Vertex AI

No Vertex AI Express Mode, modelos e cotas dependem da conta. A página oficial informa um período de 90 dias sem necessidade de ativar o faturamento; depois disso, ele precisa ser habilitado.

O Vertex AI regular é cobrado por uso. A capacidade é controlada por cota compartilhada dinâmica ou por throughput provisionado adquirido antecipadamente, e o custo depende do modelo e dos tokens.

Como verificar o uso com /stats model

Execute dentro do Gemini CLI:

/stats model

Segundo a documentação oficial, o comando mostra um retrato do uso de tokens na sessão atual e informações sobre os limites associados à cota ativa. O Gemini CLI também apresenta um resumo de uso dos modelos quando a sessão é encerrada.

Use a saída para três verificações:

  1. Confirmar o contexto de modelo e cota da sessão atual.
  2. Avaliar o consumo de tokens antes de iniciar outra tarefa grande.
  3. Verificar se o novo método de autenticação está ativo depois de entrar novamente.

Não atribua ao /stats model mais precisão do que a saída realmente oferece. A documentação oficial de cotas do Gemini CLI não promete um contador exato de quantas tarefas completas ainda cabem no dia nem apresenta um horário universal de renovação. Leia literalmente os campos exibidos na sua versão do CLI.

A que horas a cota diária do Gemini CLI é redefinida?

A documentação oficial de cotas do Gemini CLI não especifica um horário nem um fuso universal de redefinição. Ela define os máximos como solicitações “por usuário por dia”, mas não afirma que a renovação ocorra à meia-noite local, à meia-noite no horário do Pacífico ou exatamente 24 horas após a primeira solicitação.

Essa diferença é importante porque muitas respostas não oficiais transformam uma dessas possibilidades em regra garantida. Segundo a documentação oficial do Gemini CLI, a conclusão correta é que o relógio exato de renovação não está documentado nessa página.

Se o trabalho puder esperar, salve o estado, tente novamente na próxima janela de cota e execute /stats model outra vez. Se não puder parar, não planeje uma operação crítica em torno de uma “meia-noite” não confirmada: escolha um nível fixo compatível mais alto, uma chave paga, Vertex AI ou outro agente de programação.

Ao atingir o limite, escolha de acordo com a situação

Não existe uma única resposta ideal. A urgência, o modelo de custo e a possibilidade de alterar a autenticação determinam a melhor rota.

Sua situaçãoPrimeira ação recomendadaMotivo
A tarefa pode esperarSalve o trabalho e retome quando a franquia diária for renovadaNão adiciona custo nem exige alterar a conta
A conta pessoal atinge 1.000 com frequênciaCompare AI Pro, com 1.500, e AI Ultra, com 2.000Eleva o teto fixo com custo de assinatura previsível
A empresa gerencia o acessoConfirme se há Code Assist Standard, Enterprise ou Workspace AI Ultra atribuídoA cota corporativa segue a licença disponível
Uma tarefa longa precisa continuar hojeMigre para uma chave paga da Gemini API ou Vertex AI regularÉ a rota oficial flexível após esgotar uma cota fixa
Você não quer faturamento variávelPause, reduza o escopo ou mova a tarefa para outro agenteMantém o modelo de cobrança, mas exige transferir contexto
Você usa uma chave gratuita e precisa de mais capacidadeAvalie login com Google ou uso pago, não outra solução gratuitaA chave gratuita oferece apenas 250 solicitações e modelos Flash

Esperar faz sentido quando a continuidade não é essencial

Salve ou faça commit do estado do repositório, registre o próximo passo concreto e encerre a sessão de forma organizada. Ao voltar, rode /stats model antes de enviar uma instrução grande para revisar o contexto de uso e cota.

Esperar é uma estratégia fraca para deploy, incidente ou execução autônoma longa. Como a fonte oficial não publica o horário de renovação, “aguardar até meia-noite” não é um plano operacional confiável.

Um plano de preço fixo funciona melhor quando você precisa de previsibilidade

Em uma conta pessoal, AI Pro e AI Ultra aumentam o máximo diário publicado sem levar o uso para cobrança por token. Em organizações, Code Assist Standard e Enterprise fornecem limites diários por licença.

Confirme a compatibilidade do plano antes de pagar. A documentação afirma expressamente que o Google AI Plus não está entre os níveis pessoais suportados e que vários planos do Workspace AI também não aumentam a cota do CLI.

Pagamento por uso é indicado quando parar custa mais que uma conta variável

Uma chave paga da Gemini API é o caminho medido mais direto, enquanto o Vertex AI acrescenta controles do Google Cloud e recursos de governança empresarial. Nos dois casos, a cota varia em vez de se tornar um número diário universal.

Ainda é necessário controlar os custos. A página oficial observa que muitas chamadas pequenas com poucos tokens podem sair caras. Escreva prompts precisos, evite idas e vindas desnecessárias e acompanhe a sessão com /stats model.

Outro agente de programação é um plano de continuidade, não mais cota

Mover a tarefa para outra ferramenta não altera o limite do Gemini CLI. Isso apenas permite continuar sem mudar a conta Gemini nem habilitar cobrança por uso.

Antes da mudança, preserve a branch atual, o diff não commitado, o comando que falhou, os critérios de aceitação e o próximo passo pretendido. Assim, o novo agente tem menos chance de repetir trabalho ou agir com contexto desatualizado.

Se o erro surgir antes de o número diário parecer esgotado

A cota diária não é a única explicação. A documentação oficial do Gemini CLI também menciona limites por usuário por minuto e disponibilidade em momentos de alta demanda, mas não publica um único valor por minuto.

Siga uma ordem de diagnóstico de menor custo:

  1. Execute /stats model e confira o modelo ativo, o consumo da sessão e as informações da cota.
  2. Verifique se houve uma sequência intensa de solicitações em pouco tempo; nesse caso, pause e tente novamente antes de mudar de plano.
  3. Confirme a conta e o método de autenticação ativos. Chave gratuita, conta pessoal e Workspace têm tetos diferentes.
  4. Se a franquia diária realmente acabou, escolha entre esperar, contratar um nível fixo compatível ou usar pay-as-you-go.
  5. Se a cota parecer disponível e a mensagem persistir, trate a disponibilidade do serviço como hipótese separada e tente mais tarde; não suponha que pagar mais seja uma correção garantida.

Essa sequência evita gastar para resolver o problema errado. Um plano superior muda o teto diário, mas não garante o fim de toda limitação transitória ou por minuto.

Erros comuns que levam à decisão errada

Erro 1: achar que qualquer plano pago do Gemini vale para o CLI

Para planejar capacidade, considere apenas os níveis explicitamente listados na página oficial de cotas do CLI. Uma assinatura de produto web do Gemini não aumenta automaticamente a cota da API usada no terminal.

Erro 2: trocar para uma chave gratuita em busca de mais solicitações

Os números publicados mostram o contrário: 1.000 solicitações diárias no login pessoal do Google contra 250 na chave sem pagamento, que ainda fica limitada aos modelos Flash.

Erro 3: transformar “por dia” em um horário oficial de renovação

“Por dia” descreve o período da franquia, não o relógio. A documentação oficial de cotas do Gemini CLI não identifica fuso nem horário exato.

Erro 4: tratar solicitações como tarefas concluídas

A tabela oficial mede solicitações ao modelo. Uma migração de repositório inteiro, uma explicação curta e uma depuração iterativa representam trabalhos diferentes. Planeje tarefas longas com margem, sem dividir o número diário por uma estimativa inventada de solicitações por tarefa.

Checklist antes de uma sessão longa

  1. Identifique se a sessão usa conta Google pessoal, Workspace, chave de API ou Vertex AI.
  2. Confirme o nível compatível e o teto diário na página oficial.
  3. Execute /stats model e registre as informações da sessão atual.
  4. Salve ou faça commit de um ponto limpo antes de uma tarefa autônoma longa.
  5. Decida antecipadamente o que fazer ao atingir o limite: esperar, subir de plano, mudar para acesso pago ou transferir a tarefa.
  6. No pay-as-you-go, mantenha controle de custos e prefira prompts precisos a muitas chamadas pequenas.
  7. Não dependa de um horário específico de redefinição até que o Google o documente para sua conta e seu método de autenticação.

Com essas decisões tomadas antes do início, a mensagem de limite vira uma escolha de rota, e não uma emergência no meio do trabalho.

Referências oficiais

Quer otimizar seu fluxo de trabalho com LLMs?

Conecte modelos por uma única API, gerencie chaves e controle os gastos com IA.

Começar grátis