Лимиты Gemini CLI: квоты, проверка расхода, сброс и что делать дальше
Практическое руководство по лимитам Gemini CLI: суточные квоты, команда /stats model, неизвестное точное время сброса и варианты продолжения работы.
Содержание

Вы запустили большой рефакторинг, а в середине работы Gemini CLI сообщил, что лимит исчерпан. Дальнейшие действия зависят прежде всего от способа авторизации: личный аккаунт Google, платная подписка, лицензия Workspace, ключ Gemini API или Vertex AI. Ниже — точные суточные значения из официальной документации, способ проверить текущую сессию через /stats model и понятный выбор между ожиданием, повышением тарифа, оплатой по факту использования и переносом задачи в другой coding agent.
Суточные лимиты Gemini CLI в одной таблице
На официальной странице Gemini CLI: Quotas and pricing указано максимальное число запросов к модели на одного пользователя в сутки.
| Способ авторизации | Тариф или подписка | Максимум запросов к модели на пользователя в сутки | Важное условие |
|---|---|---|---|
| Аккаунт Google | Gemini Code Assist для частных пользователей | 1 000 | Gemini CLI сам выбирает модель из семейства Gemini |
| Аккаунт Google | Google AI Pro | 1 500 | Личный аккаунт, подписка с фиксированной ценой |
| Аккаунт Google | Google AI Ultra | 2 000 | Личный аккаунт, подписка с фиксированной ценой |
| Ключ Gemini API | Бесплатный, без оплаты | 250 | Только модели Flash |
| Ключ Gemini API | Оплата по факту использования | Зависит от тарифа | Лимит и стоимость зависят от уровня, модели и токенов |
| Vertex AI | Express Mode | Зависит от аккаунта | До включения биллинга доступен период 90 дней |
| Vertex AI | Обычный режим с оплатой по факту | Зависит от квоты | Dynamic Shared Quota или заранее купленный Provisioned Throughput |
| Google Workspace | Code Assist Standard | 1 500 | Нужна назначенная лицензия организации |
| Google Workspace | Code Assist Enterprise | 2 000 | Нужна назначенная лицензия организации |
| Google Workspace | Workspace AI Ultra | 2 000 | Работает только для поддерживаемого уровня Workspace |
Единица измерения здесь — запрос к модели, а не гарантированное число промптов, правок или законченных задач. В той же официальной статье сказано, что действуют ограничения на число запросов в минуту, а в периоды высокой нагрузки доступность сервиса может снижаться. Поэтому суточная квота — не единственная причина временного отказа.
Сначала определите, как именно вы вошли в Gemini CLI
Квота привязана к активному способу авторизации и тарифу, а не просто к установленной программе.
Вход через личный аккаунт Google
Базовый Gemini Code Assist для частных пользователей дает до 1 000 запросов к модели в сутки. Для Google AI Pro в официальной таблице указано 1 500, для Google AI Ultra — 2 000.
Если вы не уверены, личный это аккаунт или рабочий, официальная страница предлагает открыть Google One. Для личного аккаунта откроется персональная панель. Для Workspace появится сообщение о том, что выполнен вход в аккаунт Google Workspace.
Вход через аккаунт Google Workspace
Лимит определяется лицензией, назначенной организацией: Code Assist Standard — 1 500 запросов в сутки, Code Assist Enterprise — 2 000, поддерживаемый Workspace AI Ultra — 2 000.
Не любая платная подписка Workspace AI повышает квоту Gemini CLI. В официальной документации прямо указано, что не перечисленные уровни, включая Workspace AI Standard/Plus и AI Expanded, для этой цели не поддерживаются. Часть планов Gemini для Workspace относится к веб-продуктам и не распространяется на API, через который работает CLI.
Вход по ключу Gemini API
У бесплатного ключа лимит ниже, чем у обычного входа через Google: 250 запросов в сутки, причем только к моделям Flash. Переход с личного Google-аккаунта с лимитом 1 000 на бесплатный API key не увеличит доступный объем.
Платный ключ работает по модели pay-as-you-go. Квота зависит от ценового уровня, а счет — от выбранной модели и числа токенов. Такой вариант удобнее для непрерывной работы, но вместо фиксированной суточной нормы появляется переменная стоимость.
Работа через Vertex AI
В Express Mode набор моделей и квоты зависят от аккаунта. Согласно официальной странице, режим без включенного биллинга доступен 90 дней, после чего потребуется активировать оплату.
Обычный Vertex AI оплачивается по факту использования. Квота задается системой Dynamic Shared Quota либо заранее приобретенным Provisioned Throughput, а стоимость рассчитывается по модели и токенам.
Как проверить расход с помощью /stats model
Выполните внутри Gemini CLI:
/stats model
По официальному описанию команда показывает снимок расхода токенов в текущей сессии и сведения об ограничениях, связанных с активной квотой. При выходе из сессии Gemini CLI также выводит итоговую статистику использования моделей.
Команда полезна для трех проверок:
- Убедиться, в каком модельном и квотном контексте работает текущая сессия.
- Оценить расход токенов перед новой крупной задачей.
- После повторного входа проверить, что выбранный способ авторизации действительно применяется.
Не приписывайте /stats model точность, которой нет в фактическом выводе. В официальной документации Gemini CLI по квотам не обещан счетчик «сколько завершенных задач осталось сегодня» и не указан универсальный момент обновления суточной квоты. Ориентируйтесь только на поля, которые действительно показывает ваша версия CLI.
Когда сбрасывается суточная квота Gemini CLI
В официальной документации Gemini CLI по квотам не указаны ни единое время сброса, ни часовой пояс. Там говорится лишь о максимуме запросов «на пользователя в день», но нет утверждения о полуночи по местному времени, полуночи по тихоокеанскому времени или о скользящих 24 часах с первого запроса.
Это важно, потому что неофициальные ответы часто выдают один из этих вариантов за гарантированное правило. Согласно официальной документации Gemini CLI корректный вывод такой: точные часы обновления квоты на этой странице не документированы.
Если задача терпит паузу, сохраните состояние, попробуйте снова в следующем квотном окне и повторно выполните /stats model. Если остановка недопустима, не стройте рабочий процесс вокруг неподтвержденной «полуночи»: заранее переходите на поддерживаемый более высокий фиксированный тариф, платный API key, Vertex AI или другой coding agent.
Лимит исчерпан: что выбрать в вашей ситуации
Универсального решения нет. Важны срочность, модель оплаты и готовность менять авторизацию.
| Ситуация | Что сделать сначала | Почему |
|---|---|---|
| Задача может подождать | Сохранить прогресс и вернуться после обновления суточной квоты | Нет дополнительных расходов и изменений аккаунта |
| Личный аккаунт регулярно упирается в 1 000 | Сравнить AI Pro с 1 500 и AI Ultra с 2 000 | Выше фиксированный суточный предел и предсказуемая подписка |
| Доступом управляет компания | Уточнить, назначены ли Code Assist Standard, Enterprise или Workspace AI Ultra | Квота рабочего аккаунта определяется лицензией |
| Долгая задача должна продолжиться сегодня | Перейти на платный Gemini API key или обычный Vertex AI | Это официальный гибкий путь после исчерпания фиксированной квоты |
| Вы не хотите поминутной или поточной оплаты | Поставить задачу на паузу, уменьшить объем или перенести ее в другой agent | Сохраняется прежняя модель оплаты, но нужно передать контекст |
| Сейчас используется бесплатный API key | Не создавать новые бесплатные схемы, а оценить вход через Google или платный режим | Бесплатный ключ дает только 250 запросов в сутки и только Flash |
Ожидание подходит, когда непрерывность не критична
Сделайте commit или иным способом сохраните состояние репозитория, зафиксируйте следующий конкретный шаг и корректно завершите сессию. При возвращении сначала выполните /stats model, а уже затем отправляйте крупный запрос.
Для релиза, инцидента или длительного автономного запуска ожидание ненадежно. Поскольку точное время сброса не опубликовано, инструкция «просто подождите до полуночи» не годится как производственный план.
Фиксированная подписка подходит для предсказуемой личной или командной нагрузки
В личном аккаунте AI Pro и AI Ultra повышают заявленный дневной максимум, не переводя вас на оплату за токены. В организации аналогичную роль выполняют лицензии Code Assist Standard и Enterprise.
Перед оплатой проверьте поддержку именно выбранного плана. Официальная страница отдельно отмечает, что Google AI Plus не относится к поддерживаемым личным уровням; несколько тарифов Workspace AI также исключены.
Pay-as-you-go нужен, когда остановка дороже переменного счета
Платный Gemini API key — наиболее прямой способ перейти на тарификацию по факту, а Vertex AI добавляет инструменты Google Cloud и возможности управления для организаций. В обоих случаях нет единого универсального суточного числа: доступная квота зависит от тарифа или ресурсов.
Контролировать расходы все равно необходимо. В официальной статье отмечено, что множество небольших вызовов с малым числом токенов может оказаться дорогим. Формулируйте запросы точнее, избегайте лишних итераций и следите за сессией через /stats model.
Другой coding agent — резервный маршрут, а не увеличение квоты
Перенос задачи в другой инструмент не меняет лимит Gemini CLI. Он лишь позволяет продолжить работу без смены аккаунта Gemini и без включения тарификации по факту.
Перед переносом сохраните текущую ветку, незакоммиченный diff, упавшую команду, критерии приемки и следующий планируемый шаг. Так новый agent меньше рискует повторить уже сделанное или действовать по устаревшему контексту.
Почему ошибка может появиться раньше суточного лимита
Суточная квота — не единственное возможное ограничение. Официальная документация Gemini CLI также упоминает лимиты на пользователя в минуту и зависимость от доступности сервиса при высокой нагрузке, но не приводит единого числового значения в минуту.
Проверяйте от самого дешевого шага к самому дорогому:
- Выполните
/stats modelи посмотрите активную модель, расход сессии и сведения о квоте. - Вспомните, не было ли серии запросов за короткое время. Если была, сделайте паузу и повторите попытку, не покупая тариф сразу.
- Проверьте активный аккаунт и способ входа: бесплатный API key, личный Google и Workspace имеют разные пределы.
- Если суточная квота действительно закончилась, выбирайте ожидание, поддерживаемую фиксированную подписку или pay-as-you-go.
- Если квота доступна, но ошибка остается, рассматривайте доступность сервиса как отдельную причину и попробуйте позже, а не считайте повышение тарифа гарантированным исправлением.
Такой порядок помогает не платить за решение другой проблемы. Повышение тарифа меняет суточный максимум, но не обещает отменить каждое временное или поминутное ограничение.
Четыре частые ошибки при выборе квоты
Ошибка 1: считать, что любая платная подписка Gemini действует в CLI
Для планирования подходят только уровни, прямо перечисленные на официальной странице квот CLI. Подписка на веб-продукты Gemini не обязана увеличивать API-квоту, на которой работает командная строка.
Ошибка 2: переходить на бесплатный API key ради большего лимита
Опубликованные числа говорят об обратном: 1 000 запросов в сутки при личном входе через Google против 250 у бесплатного ключа, причем ключ ограничен моделями Flash.
Ошибка 3: превращать формулировку «в сутки» в точное время сброса
Суточный период описывает размер квоты, но не часы ее обновления. Официальная документация Gemini CLI не называет часовой пояс и конкретное время.
Ошибка 4: считать запросы готовыми задачами
Официальная таблица измеряет запросы к модели. Миграция всего репозитория, короткий вопрос и многораундовая отладка — разная работа, поэтому для длинных задач нужен запас, а не деление суточного числа на выдуманное количество запросов на задачу.
Чек-лист перед длинной сессией Gemini CLI
- Уточните, используется личный Google, Workspace, API key или Vertex AI.
- Проверьте поддерживаемый тариф и его суточный предел по официальной странице.
- Выполните
/stats modelи зафиксируйте сведения о текущей сессии. - Перед автономной работой создайте чистую точку сохранения или commit.
- Заранее выберите маршрут при исчерпании лимита: ждать, повысить тариф, перейти на платную авторизацию или передать задачу другому agent.
- При pay-as-you-go настройте контроль расходов и предпочитайте точные запросы множеству мелких итераций.
- Не полагайтесь на конкретный час сброса, пока Google не документирует его для вашего аккаунта и способа входа.
После такой подготовки сообщение о лимите становится обычным выбором маршрута, а не аварией посреди работы.