Gemini CLIの制限:1日の上限、使用量確認、リセットと継続方法
Gemini CLIの日次クォータ、/stats modelによる確認、公式に明記されていないリセット時刻、上限到達後の現実的な選択肢をまとめたガイドです。
目次

大規模なリファクタリングの途中で、Gemini CLIに「limit reached」と表示されたとします。次の行動は、Googleアカウント、個人向け有料プラン、Workspaceライセンス、Gemini APIキー、Vertex AIのどれで認証しているかによって変わります。この記事では、該当する日次上限を特定し、/stats modelで使用状況を確認し、待機・プラン変更・従量課金・別のコーディングエージェントへの移行から適切な方法を選べるようにします。
Gemini CLIの日次上限一覧
公式のGemini CLIのクォータと料金ページには、ユーザー1人あたり1日に利用できるモデルリクエストの最大数が次のように記載されています。
| 認証方法 | ティアまたはサブスクリプション | ユーザー1人・1日あたりの最大モデルリクエスト | 主な条件 |
|---|---|---|---|
| Googleアカウント | 個人向けGemini Code Assist | 1,000 | Gemini CLIがGeminiモデル群から使用モデルを選択 |
| Googleアカウント | Google AI Pro | 1,500 | 個人アカウント、固定料金のサブスクリプション |
| Googleアカウント | Google AI Ultra | 2,000 | 個人アカウント、固定料金のサブスクリプション |
| Gemini APIキー | 無料枠、未課金 | 250 | Flashモデルのみ |
| Gemini APIキー | 従量課金 | 変動 | 料金ティア、モデル、トークン使用量による |
| Vertex AI | Express Mode | 変動 | アカウントごとに異なる。課金有効化が必要になるまで90日 |
| Vertex AI | 通常の従量課金 | 変動 | Dynamic Shared QuotaまたはProvisioned Throughput |
| Google Workspace | Code Assist Standard | 1,500 | 組織からライセンスが割り当てられていること |
| Google Workspace | Code Assist Enterprise | 2,000 | 組織からライセンスが割り当てられていること |
| Google Workspace | Workspace AI Ultra | 2,000 | 対応するWorkspaceティアのみ |
この表の単位はモデルリクエストです。プロンプト数、コード変更回数、完了したタスク数が同じだけ保証されるわけではありません。公式ページには、ユーザーごとの分単位の制限があり、高負荷時にはサービスの利用可能性にも左右されると書かれています。つまり、日次上限だけが停止理由ではありません。
まず実際の認証方法を確認する
Gemini CLIのクォータは、インストールの有無ではなく、現在有効な認証方法と契約によって決まります。
個人のGoogleアカウントでログインしている場合
個人向けGemini Code Assistの基本上限は1日1,000モデルリクエストです。Google AI Proは1,500、Google AI Ultraは2,000と記載されています。
個人アカウントかWorkspaceアカウントか分からない場合、公式ページはGoogle Oneを開く方法を案内しています。個人アカウントなら個人用ダッシュボードが表示され、WorkspaceアカウントならGoogle Workspaceアカウントでログイン中であることを示すメッセージが表示されます。
Google Workspaceアカウントでログインしている場合
上限は組織から割り当てられたライセンスで決まります。Code Assist Standardは1日1,500、Code Assist Enterpriseは2,000、対応するWorkspace AI Ultraは2,000です。
有料のWorkspace AIプランなら必ずGemini CLIの上限が増える、と考えてはいけません。公式ページでは、一覧にないWorkspace AI Standard/PlusやAI Expandedなどはこの用途でサポートされないと説明しています。また、一部のWorkspace向けGeminiプランはWeb製品用であり、Gemini CLIを動かすAPI利用には適用されません。
Gemini APIキーを使っている場合
未課金の無料APIキーは、Googleアカウントでのログインより上限が低く、1日250モデルリクエストです。さらにFlashモデルに限定されます。個人向けGoogleログインの1,000から無料APIキーへ切り替えても、容量の増加にはなりません。
有料APIキーは従量課金です。クォータは料金ティアによって変わり、費用はモデルとトークン使用量で決まります。継続的な処理には柔軟ですが、固定の日次枠ではなく変動費になります。
Vertex AIを使っている場合
Vertex AI Express Modeのモデルとクォータはアカウントごとに異なります。公式ページでは、課金を有効にする必要が生じるまで90日間利用できるとしています。
通常のVertex AIは従量課金で、Dynamic Shared Quotaまたは事前購入したProvisioned Throughputによって容量が管理されます。費用はモデルとトークン使用量に基づきます。
/stats modelで使用状況を確認する
Gemini CLI内で次のコマンドを実行します。
/stats model
公式ドキュメントによると、このコマンドは現在のセッションのトークン使用量のスナップショットと、現在のクォータに関連する制限情報を表示します。セッション終了時にもモデル使用量の概要が表示されます。
主に次の3点を確認してください。
- 現在のセッションがどのモデルとクォータの文脈で動いているか。
- 大きな作業を始める前に、セッションでどの程度トークンを使っているか。
- 再ログインや認証変更後に、新しいクォータの文脈が有効になっているか。
/stats modelを、実際の表示以上に精密なものとして扱わないでください。Gemini CLIの公式クォータ文書は、「今日あと何件の完成タスクを処理できるか」という正確なカウントダウンや、全ユーザー共通のリセット時刻を保証していません。表示された項目をそのまま読み取るのが安全です。
Gemini CLIの日次クォータは何時にリセットされるのか
Gemini CLIの公式クォータ文書には、共通のリセット時刻やタイムゾーンが記載されていません。「ユーザー1人・1日あたり」という上限は示されていますが、現地時間の午前0時、太平洋時間の午前0時、最初のリクエストから24時間後のいずれとも明記されていません。
この違いは重要です。非公式な説明では、いずれかの時刻が確定ルールのように書かれることがあります。しかし、Gemini CLIの公式クォータ文書に基づく正確な答えは、「そのページでは具体的なリセット時刻が公開されていない」です。
作業を止められるなら、現在の状態を保存し、次のクォータ期間に再試行してから /stats model をもう一度実行します。止められないなら、未確認の「午前0時リセット」を前提に運用せず、対応する上位固定プラン、有料APIキー、Vertex AI、または別のコーディングエージェントを選びます。
「limit reached」後は状況別に選ぶ
最適解は一つではありません。緊急度、費用の考え方、認証変更の可否で決めます。
| 状況 | 最初に取る行動 | 理由 |
|---|---|---|
| 作業を待たせられる | 進捗を保存し、日次枠の更新後に再開 | 追加費用もアカウント変更も不要 |
| 個人アカウントで1,000に頻繁に達する | AI Proの1,500とAI Ultraの2,000を比較 | 固定の日次上限を増やし、費用を予測しやすい |
| 会社がアクセスを管理している | Code Assist Standard、Enterprise、Workspace AI Ultraの割り当てを確認 | 組織の上限はライセンスで決まる |
| 長時間タスクを今日中に続けたい | 有料Gemini APIキーまたは通常のVertex AIへ移行 | 固定枠を使い切った後の公式な柔軟ルート |
| 従量課金を避けたい | 一時停止、範囲縮小、別エージェントへの移行 | 費用体系を維持できるが、文脈の引き継ぎが必要 |
| 無料APIキーで容量不足 | 別の無料キーではなくGoogleログインか有料利用を検討 | 無料キーは1日250かつFlashのみ |
継続性が不要なら待機が最も簡単
リポジトリの状態をコミットまたは保存し、次の具体的な作業を書き残して、セッションを正常に終了します。再開時は大きな指示を送る前に /stats model を実行し、現在のセッションとクォータ情報を確認します。
一方、デプロイ、障害対応、長時間の自動実行では待機は不安定です。公式資料にリセット時刻がない以上、「午前0時まで待つ」は運用計画として信頼できません。
予測可能な費用を重視するなら固定料金の上位プラン
個人アカウントではAI ProとAI Ultraが、トークン課金へ移行せずに公開上限を引き上げます。組織ではCode Assist StandardとEnterpriseがライセンス単位の日次枠を提供します。
支払う前に、対象プランが対応しているか確認してください。公式ページはGoogle AI Plusを対応する個人向けティアに含めておらず、Workspace AIの複数プランも対象外としています。
停止コストが変動費より高いなら従量課金
有料Gemini APIキーは最も直接的な従量課金手段です。Vertex AIはGoogle Cloudの管理機能や企業向けガバナンスも利用できます。どちらも、すべてのユーザーに共通する固定日次数ではなく、ティアやリソースに応じてクォータが変わります。
費用管理は必要です。公式ページは、少ないトークンの小さな呼び出しを大量に行うと高くなる可能性を指摘しています。指示を明確にし、不要な往復を減らし、/stats modelでセッション使用量を確認してください。
別のコーディングエージェントは継続手段であり、クォータ増加ではない
別ツールへ移してもGemini CLIの上限は変わりません。Geminiのアカウントや課金方式を変えずに作業を続けるための手段です。
移行前に、現在のブランチ、未コミットのdiff、失敗したコマンド、受け入れ条件、次に実行する予定の作業を保存します。これにより、新しいエージェントが同じ作業を繰り返したり、古い文脈で変更したりするリスクを減らせます。
日次上限前にエラーが出たように見える場合
日次クォータだけが原因とは限りません。Gemini CLIの公式クォータ文書はユーザーごとの分単位制限と高負荷時のサービス可用性にも言及していますが、共通の毎分数値は公開していません。
低コストな確認から順に進めます。
/stats modelを実行し、アクティブなモデル、セッション使用量、クォータ情報を確認する。- 短時間にリクエストを集中させていないか確認し、該当するならすぐ契約変更せず、少し間を置いて再試行する。
- 現在のアカウントと認証方法を確認する。無料APIキー、個人Googleログイン、Workspaceでは上限が異なる。
- 日次枠を本当に使い切っているなら、待機、対応する固定プラン、従量課金から選ぶ。
- 枠が残っているように見えてもエラーが続く場合、サービス可用性を別の可能性として扱い、後で再試行する。上位プランで必ず直るとは考えない。
この順序なら、別の原因に対して料金を支払う失敗を避けられます。プラン変更は日次上限を変えますが、一時的な制限や分単位制限がすべて消える保証はありません。
クォータ判断でよくある誤り
誤り1:有料のGeminiプランならすべてCLIに適用される
容量計画には、公式CLIクォータページに明記されたティアだけを使います。GeminiのWeb製品向けサブスクリプションが、CLIのAPIクォータを自動的に増やすわけではありません。
誤り2:リクエストを増やすため無料APIキーへ切り替える
公開値は逆です。個人Googleログインは1日1,000、未課金APIキーは1日250で、さらにFlashモデルに限定されます。
誤り3:「1日あたり」を公式のリセット時刻と解釈する
「1日あたり」は枠の期間を示すだけで、時計を示しません。Gemini CLIの公式クォータ文書にはタイムゾーンも具体的な更新時刻もありません。
誤り4:リクエスト数を完了タスク数と同一視する
公式表が数えるのはモデルリクエストです。リポジトリ全体の移行、短い説明、多段階のデバッグは同じ作業量ではありません。長いタスクは余裕を持って計画し、仮定した「1タスクあたりのリクエスト数」で日次枠を割らないでください。
長時間セッション前のチェックリスト
- 個人Googleログイン、Workspace、APIキー、Vertex AIのどれを使っているか確認する。
- 公式クォータページで対応ティアと日次上限を確認する。
/stats modelを実行し、現在のセッション情報を記録する。- 長時間の自動作業前に、きれいなチェックポイントを保存またはコミットする。
- 上限到達時の方針を事前に決める。待機、アップグレード、有料認証への切り替え、別エージェントへの移行のいずれか。
- 従量課金では費用監視を行い、小さな呼び出しの反復より明確な指示を優先する。
- Googleが自分のアカウントと認証方式について明記するまで、特定のリセット時刻を前提にしない。
事前に方針を決めておけば、上限メッセージは緊急事態ではなく、次のルートを選ぶための合図になります。