Límites de Gemini CLI: cuota diaria, uso, reinicio y cómo continuar
Guía práctica sobre los límites de Gemini CLI, el comando /stats model, la falta de una hora oficial de reinicio y las opciones tras alcanzar la cuota.
Índice

Estás en mitad de una refactorización y Gemini CLI muestra que alcanzaste un límite. La decisión correcta depende sobre todo de cómo te autenticaste: una cuenta de Google, un plan personal de pago, una licencia de Workspace, una clave de Gemini API o Vertex AI. Esta guía te permite identificar el máximo diario aplicable, revisar el uso con /stats model y decidir si conviene esperar, subir de plan, pasar a pago por uso o continuar la tarea en otro agente de programación.
Límites diarios de Gemini CLI de un vistazo
La página oficial de cuotas y precios de Gemini CLI publica los siguientes máximos de solicitudes al modelo por usuario y día.
| Método de autenticación | Nivel o suscripción | Máximo de solicitudes al modelo por usuario y día | Condición importante |
|---|---|---|---|
| Cuenta de Google | Gemini Code Assist para particulares | 1.000 | Gemini CLI selecciona modelos dentro de la familia Gemini |
| Cuenta de Google | Google AI Pro | 1.500 | Cuenta personal; suscripción de precio fijo |
| Cuenta de Google | Google AI Ultra | 2.000 | Cuenta personal; suscripción de precio fijo |
| Clave de Gemini API | Nivel gratuito, sin pago | 250 | Solo modelos Flash |
| Clave de Gemini API | Pago por uso | Variable | Depende del nivel de precios, el modelo y los tokens |
| Vertex AI | Express Mode | Variable | Depende de la cuenta; 90 días antes de tener que activar facturación |
| Vertex AI | Pago por uso normal | Variable | Cuota compartida dinámica o capacidad aprovisionada |
| Google Workspace | Code Assist Standard | 1.500 | Requiere una licencia asignada por la organización |
| Google Workspace | Code Assist Enterprise | 2.000 | Requiere una licencia asignada por la organización |
| Google Workspace | Workspace AI Ultra | 2.000 | Solo para el nivel de Workspace compatible |
Las cifras se expresan en solicitudes al modelo, no en una cantidad garantizada de prompts, ediciones o tareas terminadas. La misma página oficial indica que también existen límites por usuario y por minuto, y que el servicio está sujeto a disponibilidad en momentos de alta demanda. Por eso, el máximo diario no es la única restricción posible.
Primero identifica qué autenticación estás usando realmente
La cuota depende de la autenticación y la suscripción activas, no simplemente de tener Gemini CLI instalado.
Iniciaste sesión con una cuenta personal de Google
Gemini Code Assist para particulares incluye un máximo base de 1.000 solicitudes al modelo al día. Google AI Pro eleva la cifra publicada a 1.500 y Google AI Ultra a 2.000.
Para distinguir una cuenta personal de una cuenta de Workspace, la documentación recomienda abrir Google One. Una cuenta personal muestra su panel individual; una cuenta corporativa muestra un mensaje que indica que has iniciado sesión con Google Workspace.
Iniciaste sesión con una cuenta de Google Workspace
El máximo depende de la licencia asignada por la organización: 1.500 solicitudes al día para Code Assist Standard, 2.000 para Code Assist Enterprise y 2.000 para el nivel compatible de Workspace AI Ultra.
No des por hecho que cualquier plan de pago de Workspace AI aumenta la cuota de Gemini CLI. La página oficial dice que los niveles no incluidos, entre ellos Workspace AI Standard/Plus y AI Expanded, no son compatibles para este fin. También aclara que algunos planes de Gemini para Workspace cubren productos web, pero no el uso de API que alimenta Gemini CLI.
Usas una clave de Gemini API
Una clave gratuita y sin facturación tiene un máximo publicado menor que el acceso con cuenta de Google: 250 solicitudes al día y solo para modelos Flash. Cambiar desde el acceso personal de Google, que ofrece 1.000, a una clave gratuita no es una ampliación de cuota.
Una clave de pago funciona con facturación por uso. La cuota varía según el nivel de precios y el coste depende del modelo y de los tokens consumidos. Es una opción más flexible para mantener un proceso en marcha, pero sustituye una asignación diaria fija por un gasto variable.
Usas Vertex AI
En Vertex AI Express Mode, los modelos y las cuotas dependen de la cuenta. La página oficial indica que el modo sin facturación dura 90 días antes de que sea necesario activarla.
Vertex AI en modo normal se factura por uso. Su capacidad se rige por una cuota compartida dinámica o por rendimiento aprovisionado comprado de antemano, y el coste depende del modelo y de los tokens.
Cómo revisar el uso con /stats model
Ejecuta este comando dentro de Gemini CLI:
/stats model
Según la documentación oficial, muestra una instantánea del uso de tokens en la sesión actual y datos sobre los límites asociados a la cuota activa. Gemini CLI también presenta un resumen del uso de modelos al salir de una sesión.
Utiliza el resultado para tres comprobaciones:
- Confirmar el contexto de modelo y cuota de la sesión actual.
- Revisar los tokens de la sesión antes de iniciar otra tarea grande.
- Verificar que el nuevo método de autenticación esté activo después de volver a iniciar sesión.
No atribuyas a /stats model más precisión de la que muestre. La documentación oficial de cuotas de Gemini CLI no promete un contador exacto de cuántas tareas completas quedan hoy ni ofrece una marca de tiempo universal para el reinicio. Interpreta literalmente los campos presentes en tu versión del CLI.
¿A qué hora se reinicia la cuota diaria de Gemini CLI?
La documentación oficial de cuotas de Gemini CLI no especifica una hora ni una zona horaria universal de reinicio. Define los máximos como solicitudes “por usuario y día”, pero no afirma que se renueven a medianoche local, a medianoche del Pacífico o exactamente 24 horas después de la primera solicitud.
La diferencia importa porque muchas respuestas no oficiales presentan una de esas posibilidades como regla segura. Según la documentación oficial de Gemini CLI, la conclusión responsable es que el reloj exacto de renovación no está documentado en esa página.
Si el trabajo puede esperar, guarda el estado, vuelve a intentarlo en la siguiente ventana de cuota y ejecuta de nuevo /stats model. Si no puede detenerse, no organices una operación crítica alrededor de una “medianoche” no verificada: elige un nivel fijo compatible más alto, una clave de pago, Vertex AI u otro agente de programación.
Al alcanzar el límite, elige según tu situación
No existe una única respuesta correcta. La urgencia, el modelo de coste y la disposición a cambiar la autenticación determinan la mejor opción.
| Tu situación | Primer paso recomendado | Motivo |
|---|---|---|
| La tarea puede esperar | Guarda el trabajo y continúa cuando se renueve la asignación diaria | No añade coste ni exige cambiar la cuenta |
| Tu cuenta personal llega a 1.000 con frecuencia | Compara AI Pro, con 1.500, y AI Ultra, con 2.000 | Aumenta el máximo fijo con un coste de suscripción predecible |
| La empresa administra el acceso | Confirma si tienes Code Assist Standard, Enterprise o Workspace AI Ultra | La cuota corporativa sigue la licencia asignada |
| Una tarea larga debe seguir hoy | Cambia a una clave de Gemini API de pago o a Vertex AI normal | Es la vía oficial flexible después de agotar una cuota fija |
| No quieres facturación variable | Pausa, reduce el alcance o mueve la tarea a otro agente | Mantiene el modelo de coste, aunque exige transferir contexto |
| Usas una clave gratuita y necesitas más capacidad | Evalúa el acceso con Google o el pago por uso, no otra variante gratuita | La clave gratuita ofrece solo 250 solicitudes y modelos Flash |
Esperar tiene sentido cuando la continuidad no es crítica
Guarda o confirma los cambios del repositorio, anota el siguiente paso concreto y cierra la sesión de forma ordenada. Al regresar, ejecuta /stats model antes de enviar una instrucción grande para revisar el contexto de uso y cuota.
Esperar es una mala estrategia para un despliegue, una incidencia o una ejecución autónoma larga. Como la fuente oficial no publica la hora de renovación, “esperar hasta medianoche” no es un plan operativo fiable.
Un plan de precio fijo encaja cuando buscas previsibilidad
En una cuenta personal, AI Pro y AI Ultra elevan el máximo diario publicado sin trasladarte a facturación por token. En una organización, Code Assist Standard y Enterprise ofrecen límites diarios mediante licencias.
Comprueba que el plan concreto sea compatible antes de pagar. La documentación indica expresamente que Google AI Plus no está entre los niveles personales admitidos y que varios planes de Workspace AI tampoco sirven para aumentar la cuota del CLI.
El pago por uso conviene cuando detenerse cuesta más que una factura variable
Una clave de Gemini API de pago es la opción medida más directa, mientras que Vertex AI incorpora controles de Google Cloud y funciones orientadas a organizaciones. En ambos casos, la cuota varía en lugar de convertirse en una cifra diaria universal.
Aun así, debes controlar el coste. La página oficial advierte que muchas llamadas pequeñas con pocos tokens pueden resultar caras. Formula solicitudes precisas, evita rondas innecesarias y vigila la sesión con /stats model.
Otro agente de programación es un respaldo de flujo, no más cuota
Mover la tarea a otra herramienta no modifica el límite de Gemini CLI. Solo permite continuar sin cambiar la cuenta de Gemini ni habilitar facturación por uso.
Antes del cambio, conserva la rama actual, el diff sin confirmar, el comando que falló, los criterios de aceptación y el siguiente paso previsto. Así reduces el riesgo de que el nuevo agente repita trabajo o actúe con contexto obsoleto.
Si el error aparece antes de agotar el número diario
La cuota diaria no es la única explicación. La documentación oficial de Gemini CLI menciona límites por usuario y por minuto, además de la disponibilidad en periodos de alta demanda, pero no publica una cifra universal por minuto.
Sigue un orden de diagnóstico de menor a mayor coste:
- Ejecuta
/stats modely revisa el modelo activo, el uso de la sesión y la información de cuota. - Comprueba si enviaste muchas solicitudes en poco tiempo; si fue así, pausa y reintenta antes de cambiar de plan.
- Confirma la cuenta y el método de autenticación activos. Una clave gratuita, una cuenta personal y Workspace tienen máximos distintos.
- Si realmente se agotó la asignación diaria, elige entre esperar, un nivel fijo compatible o pago por uso.
- Si la cuota parece disponible pero el mensaje persiste, considera la disponibilidad del servicio como causa separada y reintenta después; no supongas que pagar más lo resolverá necesariamente.
Este orden evita pagar por el problema equivocado. Un plan superior cambia el máximo diario, pero no garantiza que desaparezca toda limitación transitoria o por minuto.
Errores comunes que llevan a elegir mal
Error 1: creer que cualquier plan de Gemini sirve para el CLI
Para planificar capacidad, usa solo los niveles que aparecen explícitamente en la página oficial de cuotas del CLI. Una suscripción a un producto web de Gemini no aumenta automáticamente la cuota de API que utiliza la terminal.
Error 2: cambiar a una clave gratuita para obtener más solicitudes
Los números publicados muestran lo contrario: 1.000 solicitudes diarias con acceso personal de Google frente a 250 con una clave sin pago, limitada además a modelos Flash.
Error 3: convertir “por día” en una hora oficial de reinicio
“Por día” describe el periodo de asignación, no el reloj. La documentación oficial de cuotas de Gemini CLI no identifica zona horaria ni hora exacta de renovación.
Error 4: equiparar solicitudes con tareas terminadas
La tabla oficial cuenta solicitudes al modelo. Una migración de todo el repositorio, una explicación corta y una depuración iterativa no representan el mismo trabajo. Planifica las tareas largas con margen, sin dividir la cifra diaria por una cantidad inventada de solicitudes por tarea.
Lista de comprobación antes de una sesión larga
- Identifica si la sesión usa una cuenta personal de Google, Workspace, una clave de API o Vertex AI.
- Confirma el nivel compatible y su máximo diario en la página oficial.
- Ejecuta
/stats modely registra la información de la sesión actual. - Guarda o confirma un punto limpio antes de una tarea autónoma larga.
- Decide de antemano qué ocurrirá al alcanzar el límite: esperar, subir de plan, cambiar a acceso de pago o transferir la tarea.
- Con pago por uso, establece control de costes y prioriza instrucciones precisas sobre muchas llamadas pequeñas.
- No dependas de una hora concreta de reinicio hasta que Google la documente para tu cuenta y método de autenticación.
Con esas decisiones tomadas antes de empezar, un mensaje de límite se convierte en una elección de ruta, no en una emergencia.