Invita y gana

Cómo funcionan las recompensas

Comparte tu enlace. Cuando un amigo se registre con él y recargue saldo, recibirás la recompensa indicada por sus recargas posteriores.

Límites de Gemini CLI: cuota diaria, uso, reinicio y cómo continuar

Guía práctica sobre los límites de Gemini CLI, el comando /stats model, la falta de una hora oficial de reinicio y las opciones tras alcanzar la cuota.

Índice
Límites de Gemini CLI: cuota diaria, uso, reinicio y cómo continuar

Estás en mitad de una refactorización y Gemini CLI muestra que alcanzaste un límite. La decisión correcta depende sobre todo de cómo te autenticaste: una cuenta de Google, un plan personal de pago, una licencia de Workspace, una clave de Gemini API o Vertex AI. Esta guía te permite identificar el máximo diario aplicable, revisar el uso con /stats model y decidir si conviene esperar, subir de plan, pasar a pago por uso o continuar la tarea en otro agente de programación.

Límites diarios de Gemini CLI de un vistazo

La página oficial de cuotas y precios de Gemini CLI publica los siguientes máximos de solicitudes al modelo por usuario y día.

Método de autenticaciónNivel o suscripciónMáximo de solicitudes al modelo por usuario y díaCondición importante
Cuenta de GoogleGemini Code Assist para particulares1.000Gemini CLI selecciona modelos dentro de la familia Gemini
Cuenta de GoogleGoogle AI Pro1.500Cuenta personal; suscripción de precio fijo
Cuenta de GoogleGoogle AI Ultra2.000Cuenta personal; suscripción de precio fijo
Clave de Gemini APINivel gratuito, sin pago250Solo modelos Flash
Clave de Gemini APIPago por usoVariableDepende del nivel de precios, el modelo y los tokens
Vertex AIExpress ModeVariableDepende de la cuenta; 90 días antes de tener que activar facturación
Vertex AIPago por uso normalVariableCuota compartida dinámica o capacidad aprovisionada
Google WorkspaceCode Assist Standard1.500Requiere una licencia asignada por la organización
Google WorkspaceCode Assist Enterprise2.000Requiere una licencia asignada por la organización
Google WorkspaceWorkspace AI Ultra2.000Solo para el nivel de Workspace compatible

Las cifras se expresan en solicitudes al modelo, no en una cantidad garantizada de prompts, ediciones o tareas terminadas. La misma página oficial indica que también existen límites por usuario y por minuto, y que el servicio está sujeto a disponibilidad en momentos de alta demanda. Por eso, el máximo diario no es la única restricción posible.

Primero identifica qué autenticación estás usando realmente

La cuota depende de la autenticación y la suscripción activas, no simplemente de tener Gemini CLI instalado.

Iniciaste sesión con una cuenta personal de Google

Gemini Code Assist para particulares incluye un máximo base de 1.000 solicitudes al modelo al día. Google AI Pro eleva la cifra publicada a 1.500 y Google AI Ultra a 2.000.

Para distinguir una cuenta personal de una cuenta de Workspace, la documentación recomienda abrir Google One. Una cuenta personal muestra su panel individual; una cuenta corporativa muestra un mensaje que indica que has iniciado sesión con Google Workspace.

Iniciaste sesión con una cuenta de Google Workspace

El máximo depende de la licencia asignada por la organización: 1.500 solicitudes al día para Code Assist Standard, 2.000 para Code Assist Enterprise y 2.000 para el nivel compatible de Workspace AI Ultra.

No des por hecho que cualquier plan de pago de Workspace AI aumenta la cuota de Gemini CLI. La página oficial dice que los niveles no incluidos, entre ellos Workspace AI Standard/Plus y AI Expanded, no son compatibles para este fin. También aclara que algunos planes de Gemini para Workspace cubren productos web, pero no el uso de API que alimenta Gemini CLI.

Usas una clave de Gemini API

Una clave gratuita y sin facturación tiene un máximo publicado menor que el acceso con cuenta de Google: 250 solicitudes al día y solo para modelos Flash. Cambiar desde el acceso personal de Google, que ofrece 1.000, a una clave gratuita no es una ampliación de cuota.

Una clave de pago funciona con facturación por uso. La cuota varía según el nivel de precios y el coste depende del modelo y de los tokens consumidos. Es una opción más flexible para mantener un proceso en marcha, pero sustituye una asignación diaria fija por un gasto variable.

Usas Vertex AI

En Vertex AI Express Mode, los modelos y las cuotas dependen de la cuenta. La página oficial indica que el modo sin facturación dura 90 días antes de que sea necesario activarla.

Vertex AI en modo normal se factura por uso. Su capacidad se rige por una cuota compartida dinámica o por rendimiento aprovisionado comprado de antemano, y el coste depende del modelo y de los tokens.

Cómo revisar el uso con /stats model

Ejecuta este comando dentro de Gemini CLI:

/stats model

Según la documentación oficial, muestra una instantánea del uso de tokens en la sesión actual y datos sobre los límites asociados a la cuota activa. Gemini CLI también presenta un resumen del uso de modelos al salir de una sesión.

Utiliza el resultado para tres comprobaciones:

  1. Confirmar el contexto de modelo y cuota de la sesión actual.
  2. Revisar los tokens de la sesión antes de iniciar otra tarea grande.
  3. Verificar que el nuevo método de autenticación esté activo después de volver a iniciar sesión.

No atribuyas a /stats model más precisión de la que muestre. La documentación oficial de cuotas de Gemini CLI no promete un contador exacto de cuántas tareas completas quedan hoy ni ofrece una marca de tiempo universal para el reinicio. Interpreta literalmente los campos presentes en tu versión del CLI.

¿A qué hora se reinicia la cuota diaria de Gemini CLI?

La documentación oficial de cuotas de Gemini CLI no especifica una hora ni una zona horaria universal de reinicio. Define los máximos como solicitudes “por usuario y día”, pero no afirma que se renueven a medianoche local, a medianoche del Pacífico o exactamente 24 horas después de la primera solicitud.

La diferencia importa porque muchas respuestas no oficiales presentan una de esas posibilidades como regla segura. Según la documentación oficial de Gemini CLI, la conclusión responsable es que el reloj exacto de renovación no está documentado en esa página.

Si el trabajo puede esperar, guarda el estado, vuelve a intentarlo en la siguiente ventana de cuota y ejecuta de nuevo /stats model. Si no puede detenerse, no organices una operación crítica alrededor de una “medianoche” no verificada: elige un nivel fijo compatible más alto, una clave de pago, Vertex AI u otro agente de programación.

Al alcanzar el límite, elige según tu situación

No existe una única respuesta correcta. La urgencia, el modelo de coste y la disposición a cambiar la autenticación determinan la mejor opción.

Tu situaciónPrimer paso recomendadoMotivo
La tarea puede esperarGuarda el trabajo y continúa cuando se renueve la asignación diariaNo añade coste ni exige cambiar la cuenta
Tu cuenta personal llega a 1.000 con frecuenciaCompara AI Pro, con 1.500, y AI Ultra, con 2.000Aumenta el máximo fijo con un coste de suscripción predecible
La empresa administra el accesoConfirma si tienes Code Assist Standard, Enterprise o Workspace AI UltraLa cuota corporativa sigue la licencia asignada
Una tarea larga debe seguir hoyCambia a una clave de Gemini API de pago o a Vertex AI normalEs la vía oficial flexible después de agotar una cuota fija
No quieres facturación variablePausa, reduce el alcance o mueve la tarea a otro agenteMantiene el modelo de coste, aunque exige transferir contexto
Usas una clave gratuita y necesitas más capacidadEvalúa el acceso con Google o el pago por uso, no otra variante gratuitaLa clave gratuita ofrece solo 250 solicitudes y modelos Flash

Esperar tiene sentido cuando la continuidad no es crítica

Guarda o confirma los cambios del repositorio, anota el siguiente paso concreto y cierra la sesión de forma ordenada. Al regresar, ejecuta /stats model antes de enviar una instrucción grande para revisar el contexto de uso y cuota.

Esperar es una mala estrategia para un despliegue, una incidencia o una ejecución autónoma larga. Como la fuente oficial no publica la hora de renovación, “esperar hasta medianoche” no es un plan operativo fiable.

Un plan de precio fijo encaja cuando buscas previsibilidad

En una cuenta personal, AI Pro y AI Ultra elevan el máximo diario publicado sin trasladarte a facturación por token. En una organización, Code Assist Standard y Enterprise ofrecen límites diarios mediante licencias.

Comprueba que el plan concreto sea compatible antes de pagar. La documentación indica expresamente que Google AI Plus no está entre los niveles personales admitidos y que varios planes de Workspace AI tampoco sirven para aumentar la cuota del CLI.

El pago por uso conviene cuando detenerse cuesta más que una factura variable

Una clave de Gemini API de pago es la opción medida más directa, mientras que Vertex AI incorpora controles de Google Cloud y funciones orientadas a organizaciones. En ambos casos, la cuota varía en lugar de convertirse en una cifra diaria universal.

Aun así, debes controlar el coste. La página oficial advierte que muchas llamadas pequeñas con pocos tokens pueden resultar caras. Formula solicitudes precisas, evita rondas innecesarias y vigila la sesión con /stats model.

Otro agente de programación es un respaldo de flujo, no más cuota

Mover la tarea a otra herramienta no modifica el límite de Gemini CLI. Solo permite continuar sin cambiar la cuenta de Gemini ni habilitar facturación por uso.

Antes del cambio, conserva la rama actual, el diff sin confirmar, el comando que falló, los criterios de aceptación y el siguiente paso previsto. Así reduces el riesgo de que el nuevo agente repita trabajo o actúe con contexto obsoleto.

Si el error aparece antes de agotar el número diario

La cuota diaria no es la única explicación. La documentación oficial de Gemini CLI menciona límites por usuario y por minuto, además de la disponibilidad en periodos de alta demanda, pero no publica una cifra universal por minuto.

Sigue un orden de diagnóstico de menor a mayor coste:

  1. Ejecuta /stats model y revisa el modelo activo, el uso de la sesión y la información de cuota.
  2. Comprueba si enviaste muchas solicitudes en poco tiempo; si fue así, pausa y reintenta antes de cambiar de plan.
  3. Confirma la cuenta y el método de autenticación activos. Una clave gratuita, una cuenta personal y Workspace tienen máximos distintos.
  4. Si realmente se agotó la asignación diaria, elige entre esperar, un nivel fijo compatible o pago por uso.
  5. Si la cuota parece disponible pero el mensaje persiste, considera la disponibilidad del servicio como causa separada y reintenta después; no supongas que pagar más lo resolverá necesariamente.

Este orden evita pagar por el problema equivocado. Un plan superior cambia el máximo diario, pero no garantiza que desaparezca toda limitación transitoria o por minuto.

Errores comunes que llevan a elegir mal

Error 1: creer que cualquier plan de Gemini sirve para el CLI

Para planificar capacidad, usa solo los niveles que aparecen explícitamente en la página oficial de cuotas del CLI. Una suscripción a un producto web de Gemini no aumenta automáticamente la cuota de API que utiliza la terminal.

Error 2: cambiar a una clave gratuita para obtener más solicitudes

Los números publicados muestran lo contrario: 1.000 solicitudes diarias con acceso personal de Google frente a 250 con una clave sin pago, limitada además a modelos Flash.

Error 3: convertir “por día” en una hora oficial de reinicio

“Por día” describe el periodo de asignación, no el reloj. La documentación oficial de cuotas de Gemini CLI no identifica zona horaria ni hora exacta de renovación.

Error 4: equiparar solicitudes con tareas terminadas

La tabla oficial cuenta solicitudes al modelo. Una migración de todo el repositorio, una explicación corta y una depuración iterativa no representan el mismo trabajo. Planifica las tareas largas con margen, sin dividir la cifra diaria por una cantidad inventada de solicitudes por tarea.

Lista de comprobación antes de una sesión larga

  1. Identifica si la sesión usa una cuenta personal de Google, Workspace, una clave de API o Vertex AI.
  2. Confirma el nivel compatible y su máximo diario en la página oficial.
  3. Ejecuta /stats model y registra la información de la sesión actual.
  4. Guarda o confirma un punto limpio antes de una tarea autónoma larga.
  5. Decide de antemano qué ocurrirá al alcanzar el límite: esperar, subir de plan, cambiar a acceso de pago o transferir la tarea.
  6. Con pago por uso, establece control de costes y prioriza instrucciones precisas sobre muchas llamadas pequeñas.
  7. No dependas de una hora concreta de reinicio hasta que Google la documente para tu cuenta y método de autenticación.

Con esas decisiones tomadas antes de empezar, un mensaje de límite se convierte en una elección de ruta, no en una emergencia.

Referencias oficiales

¿Quieres optimizar tu flujo de trabajo con LLM?

Conecta modelos mediante una API, gestiona claves y controla el gasto en IA.

Empezar gratis