Limite Codex atteinte ? Vérifier le reset et continuer à travailler (2026)
Guide pratique pour distinguer les limites de forfait, d’API, de security review et de contexte dans Codex ; consulter /status et le Usage Dashboard ; comprendre la période de cinq heures et les plafonds hebdomadaires ; comparer les modèles et poursuivre une tâche locale urgente via un fournisseur API facturé séparément.
Sommaire

Dernière vérification : 18 septembre 2026. Les limites de Codex, la disponibilité des modèles, les barèmes de crédits et les commandes peuvent évoluer ; consultez les pages officielles citées à la fin avant publication.
Lorsque Codex s’arrête avec « You’ve hit your usage limit », « You are out of Codex and Work usage » ou « You have reached your Codex usage limits for security reviews. Please try again later. », répéter la même demande en boucle est rarement utile. Il faut d’abord identifier la limite réellement atteinte, puis appliquer la bonne solution.
Ce guide explique comment connaître l’heure de réinitialisation, comment fonctionnent la période de cinq heures et les éventuelles limites hebdomadaires, pourquoi Codex peut partager un même quota avec d’autres fonctions agentiques, en quoi une limite de contexte est différente, et comment poursuivre une tâche locale urgente dans Codex CLI via un fournisseur API facturé séparément.
À retenir
- Dans une session Codex CLI active, saisissez
/status. Pour le quota du compte, les crédits et l’heure de réinitialisation, ouvrez le Codex Usage Dashboard. - Toutes les erreurs ne signifient pas que « Codex n’a plus de messages ». Une limite du forfait ChatGPT, une erreur API 429, un échec de security review et
context_length_exceededn’ont ni la même cause ni la même correction. - OpenAI publie actuellement des estimations de messages locaux par période de cinq heures, pas un nombre fixe garanti. Les tâches locales et cloud partagent le quota, et des limites hebdomadaires peuvent aussi s’appliquer.
- Les options officielles consistent à attendre la réinitialisation affichée, réduire la consommation, acheter des crédits lorsqu’ils sont disponibles, changer de forfait ou exécuter du travail local supplémentaire avec une clé API. Un fournisseur API ne remet pas le quota de l’abonnement à zéro : il utilise un budget distinct.
Vérifier la limite Codex en 5 secondes
Dans la session Codex CLI en cours, saisissez :
/status
/status affiche l’identifiant du chat, l’utilisation du contexte et les informations de rate limit. Ouvrez ensuite Settings → Usage ou le Codex Usage Dashboard pour consulter le quota, les crédits et l’heure de réinitialisation propre à votre compte.
Certains articles tiers recommandent /usage. Au 18 septembre 2026, la référence officielle des commandes slash de Codex documente /status, mais pas /usage. Si le CLI ne reconnaît pas /usage, c’est normal : utilisez /status avec le tableau de bord web.
Décodeur des erreurs Codex
| Message affiché | Signification habituelle | Action suivante |
|---|---|---|
You've hit your usage limit ou 5-hour limit reached | Le quota agentique inclus dans ChatGPT/Codex pour la période en cours est épuisé. | Vérifiez /status et le Dashboard. Attendez la réinitialisation affichée, utilisez des crédits si possible, choisissez un modèle moins coûteux ou basculez le travail local urgent vers une facturation API. |
You are out of Codex and Work usage | Codex et les produits agentiques pris en charge consomment le même quota inclus ou le même pool de crédits. | Regardez dans Settings quel produit a consommé le pool, puis suivez les options de réinitialisation ou d’achat de crédits affichées. |
You have reached your Codex usage limits for security reviews. Please try again later. | L’échec concerne le flux de security review Codex hébergé sur GitHub, pas forcément votre session CLI locale. Il peut s’agir d’un quota propre aux revues ou d’un problème produit. | Notez le dépôt, la PR, l’heure et la revue échouée. Consultez l’Issue officiel Codex et contactez le support si le Dashboard ne l’explique pas. Vous pouvez suspendre les revues automatiques déclenchées en boucle pendant le diagnostic, sans supposer que cela rétablit le quota. |
429 Too Many Requests ou rate_limit_exceeded | Une limite d’organisation, de projet, de modèle, de TPM/RPM, de concurrence ou de fournisseur API est atteinte. | Consultez l’usage et les limites chez le fournisseur réel, réduisez la concurrence, ajoutez un backoff ou demandez une hausse de limite. Attendre le reset ChatGPT peut être inutile. |
insufficient_quota | Le projet API ne dispose plus d’un solde utilisable, d’une autorisation de dépense ou d’une capacité de facturation. | Vérifiez la facturation API, le budget du projet, la portée de la clé et le solde chez le fournisseur. |
context_length_exceeded | L’historique, les fichiers ou les sorties d’outils dépassent le contexte accepté par le modèle ou le fournisseur choisi. | Utilisez /compact, ouvrez un nouveau chat avec une note de relais, retirez les pièces jointes volumineuses ou choisissez un modèle offrant davantage de contexte. Ce n’est pas une limite de cinq heures. |
Quelle limite avez-vous réellement atteinte ?
1. Limite du forfait ChatGPT ou d’usage agentique
C’est le cas le plus fréquent derrière les recherches codex hit usage limit, codex usage limit et you've hit your usage limit codex. La capacité dépend du forfait et de l’utilisation récente. Le modèle, la complexité de la tâche, le niveau de reasoning, la taille du contexte, l’exécution locale ou cloud et l’usage d’autres produits agentiques modifient la vitesse de consommation.
2. Limite de débit ou de facturation API
L’API est facturée et limitée séparément du quota inclus dans ChatGPT. Les crédits API n’augmentent pas le quota de l’abonnement ChatGPT/Codex, et les crédits ChatGPT ne deviennent pas un solde API. Une erreur 429 ou insufficient_quota impose donc de vérifier le compte ou le fournisseur qui a traité la requête.
3. Limite de fenêtre de contexte
Le contexte détermine la quantité de contenu qu’une requête ou une conversation peut transporter, et non le volume de travail autorisé pendant cinq heures. Il n’existe pas de valeur universelle de 272k valable pour tous les modèles Codex, tous les clients et tous les fournisseurs personnalisés. Surveillez l’usage avec /status, puis compactez ou transmettez l’état avant que la session devienne trop lourde.
4. Limite de security review GitHub
Le message exact de security review apparaît déjà dans le tracker officiel openai/codex. Les éléments publics confirment l’erreur, mais pas une cause unique ni un contournement garanti. Traitez-la comme un incident distinct de revue GitHub : recueillez les preuves, vérifiez le service et le compte, évitez les déclenchements automatiques répétés et transmettez au support les détails de la PR concernée.
Période de cinq heures, limite hebdomadaire et pool partagé
De nombreuses pages parlent de « fenêtre glissante de cinq heures ». La page tarifaire officielle actuelle est plus précise : elle publie des estimations de messages locaux par période de cinq heures et renvoie au Dashboard pour le quota et l’heure de réinitialisation réels. Ne supposez pas un reset à minuit, à une heure ronde ou à une date mondiale ; suivez l’horodatage de votre compte.
Trois points expliquent la plupart des écarts :
- Le nombre de messages est une estimation, pas une promesse. Une petite modification et une longue exécution agentique avec outils, contexte volumineux et reasoning élevé ne consomment pas la même chose.
- Les tâches locales et cloud partagent la capacité. Passer du CLI au cloud ne crée pas forcément un nouveau pool.
- Une limite hebdomadaire peut s’appliquer. La période de cinq heures peut être réinitialisée alors qu’un plafond hebdomadaire bloque encore l’usage inclus.
La requête exacte « Codex, ChatGPT Work, ChatGPT for Excel, and Workspace Agents draw from the same agentic usage and credit pool » résume l’idée principale, même si la liste des produits varie selon le forfait et la disponibilité. La documentation actuelle mentionne aussi des expériences agentiques dans Word et PowerPoint lorsqu’elles sont disponibles. Pour votre compte, fiez-vous à la liste affichée dans Settings.
Estimations actuelles sur cinq heures par modèle
Les plages suivantes sont les estimations officielles de messages locaux par période de cinq heures, vérifiées le 18 septembre 2026. Elles ne constituent pas des quotas garantis.
| Modèle | Plus | Pro 5× | Pro 20× | Standard Business |
|---|---|---|---|---|
| GPT-6 Astra | 5–45 | 25–225 | 100–900 | 5–45 |
| GPT-5.6 Sol | 10–100 | 50–500 | 200–2 000 | 10–100 |
| GPT-5.6 Terra | 25–200 | 125–1 000 | 500–4 000 | 25–200 |
| GPT-5.6 Luna | 250–2 000 | 1 250–10 000 | 5 000–40 000 | 250–2 000 |
Une plage aussi large est normale : taille du dépôt, longueur du prompt, appels d’outils, contexte en cache, niveau de reasoning et fast mode influent sur la consommation. Utilisez ce tableau pour planifier, pas pour prédire un nombre exact de messages.
Barème des crédits achetés par modèle
Lorsque votre forfait permet l’achat de crédits, OpenAI mesure actuellement la consommation agentique en crédits par million de tokens :
| Modèle | Entrée | Entrée en cache | Sortie |
|---|---|---|---|
| GPT-6 Astra | 250 | 25 | 1 250 |
| GPT-5.6 Sol | 100 | 10 | 500 |
| GPT-5.6 Terra | 50 | 5 | 300 |
| GPT-5.6 Luna | 5 | 0,5 | 30 |
Une tâche Codex typique avec GPT-5.6 Sol est actuellement estimée à environ 5–30 crédits, mais la consommation réelle dépend de la tâche. Consultez le Rate Card à jour avant de définir un budget.
Option A : rester dans l’usage officiel inclus
Choisissez cette voie si la tâche n’est pas urgente ou si vous avez besoin de fonctions réservées au cloud :
- Exécutez
/statuset ouvrez le Usage Dashboard. - Déterminez si le blocage provient de la période de cinq heures, d’une limite hebdomadaire ou de crédits épuisés.
- Attendez la réinitialisation affichée, achetez des crédits si votre forfait le permet ou changez de forfait si cela est économiquement pertinent.
- Utilisez Terra ou Luna pour les tâches courantes, réduisez le reasoning, limitez le périmètre et ouvrez une nouvelle session lorsque l’ancien contexte n’est plus utile.
- Si l’usage affiché semble faux, enregistrez l’erreur exacte, l’heure, le compte, la version du client et le type de tâche avant de contacter le support.
Ne renvoyez pas continuellement la même grosse tâche. Les nouvelles tentatives peuvent consommer davantage de capacité sans modifier la limite sous-jacente.
Option B : poursuivre une tâche locale urgente avec un budget API séparé
Si une tâche locale du CLI ne peut pas attendre la réinitialisation, Codex accepte des fournisseurs de modèles personnalisés. Un fournisseur comme BetterToken peut relier le Codex CLI local à un endpoint compatible OpenAI et facturer à l’usage par token.
Il s’agit d’un budget distinct, pas d’une réinitialisation ni d’une faille. Il n’ajoute pas de quota d’abonnement, ne supprime pas les rate limits API, ne débloque pas les droits du forfait et ne fournit pas les fonctions cloud ou GitHub dépendant de l’environnement hébergé officiel.
Étape 1 : conserver un relais propre
Avant de changer de fournisseur ou de lancer une nouvelle session, enregistrez hors du chat une note courte :
Objectif :
État actuel :
Fichiers déjà modifiés :
Commandes déjà exécutées :
Échecs connus :
Prochaine étape minimale :
Ne pas modifier :
Si une modification de code est inachevée, conservez l’arbre de travail ou un patch selon votre processus habituel. L’objectif est que la nouvelle session puisse reconstruire la tâche sans reprendre toute l’historique.
Étape 2 : trouver CODEX_HOME et vérifier la version du CLI
Codex utilise ~/.codex par défaut, sauf si CODEX_HOME est défini.
macOS ou Linux :
export CODEX_HOME="${CODEX_HOME:-$HOME/.codex}"
mkdir -p "$CODEX_HOME"
echo "$CODEX_HOME"
codex --version
PowerShell :
$CodexHome = if ($env:CODEX_HOME) { $env:CODEX_HOME } else { Join-Path $HOME ".codex" }
New-Item -ItemType Directory -Force -Path $CodexHome | Out-Null
$CodexHome
codex --version
Les fichiers de profil nommés comme bt.config.toml nécessitent Codex CLI 0.134.0 ou une version ultérieure. Mettez à jour le CLI si votre version est plus ancienne.
Étape 3 : créer un profil BetterToken isolé
Créez $CODEX_HOME/bt.config.toml avec le contenu suivant :
model = "gpt-6-astra"
model_provider = "bettertoken"
[model_providers.bettertoken]
name = "BetterToken"
base_url = "https://www.bettertoken.ai/v1"
env_key = "BETTERTOKEN_API_KEY"
wire_api = "responses"
requires_openai_auth = false
request_max_retries = 4
stream_max_retries = 8
stream_idle_timeout_ms = 300000
supports_websockets = false
Les réglages du fournisseur restent ainsi séparés du config.toml principal. N’inscrivez pas la clé API dans ce fichier et ne la validez jamais dans un dépôt.
La page de configuration actuelle de BetterToken peut aussi proposer un flux basé sur auth.json. Ne mélangez pas cette méthode avec le profil par variable d’environnement ci-dessus. Utilisez une seule méthode complète et considérez la page actuelle comme la référence si les exigences d’authentification changent.
Étape 4 : lancer un test minimal en lecture seule
macOS ou Linux :
export BETTERTOKEN_API_KEY="YOUR_API_KEY"
codex exec --profile bt "Lisez README.md et résumez son objectif. Ne modifiez aucun fichier."
PowerShell :
$env:BETTERTOKEN_API_KEY="YOUR_API_KEY"
codex exec --profile bt "Lisez README.md et résumez son objectif. Ne modifiez aucun fichier."
Remplacez YOUR_API_KEY uniquement en local. Ne publiez jamais une vraie clé dans un ticket, une capture, un chat ou un dépôt. Un test en lecture seule vérifie l’authentification, l’endpoint, l’accès au modèle et le streaming avec un coût et un risque limités.
Étape 5 : vérifier la facturation avant de reprendre
Confirmez que le test apparaît dans la page d’usage ou de solde du fournisseur. Lancez ensuite la vraie tâche avec la note de relais et une première action étroite. En cas d’échec, lisez l’erreur exacte avant de modifier plusieurs paramètres :
401ou403: clé, compte, mode d’authentification ou droit d’accès au modèle.404: Base URL, route ou model ID.429: limite du fournisseur ou politique de solde.- Timeout de streaming : chemin réseau ou timeout du fournisseur ; n’augmentez pas immédiatement toutes les valeurs de retry.
Réduire la consommation Codex à l’avenir
- Utilisez GPT-5.6 Terra ou Luna pour repérer des fichiers, formater, effectuer de petites modifications et des vérifications courantes ; réservez Astra ou Sol aux tâches exigeant un raisonnement approfondi.
- Demandez une modification vérifiable à la fois. « Analyse tout et corrige tout » consomme généralement plus de contexte et d’appels d’outils.
- Ouvrez une nouvelle session avec une note de relais lorsque l’ancien dialogue est devenu essentiellement historique.
- Utilisez
/compactavant que le contexte devienne le goulot d’étranglement, puis vérifiez que le résumé conserve les contraintes essentielles. - Désactivez les serveurs MCP inutilisés et évitez de joindre de gros journaux générés sans nécessité.
- Arrêtez-vous dès que la vérification minimale pertinente réussit ; ne lancez pas de suites complètes sans rapport.
- Prenez le Usage Dashboard comme source de vérité plutôt que de compter les messages envoyés.
Questions fréquentes
Quand la limite d’usage Codex se réinitialise-t-elle ?
Aucune heure universelle n’est publiée pour tous les comptes. Exécutez /status, ouvrez le Usage Dashboard et suivez l’horodatage affiché. Ne déduisez pas votre reset de minuit, de la capture d’un autre utilisateur ou de la date d’un article.
« August 14, 2026 » signifie-t-il un reset mondial de Codex ?
Non. Le 14 août 2026 peut être la date de mise à jour d’un article, un horaire propre à un compte ou la date d’un signalement. Ce n’est pas une date mondiale de réinitialisation. Le Dashboard de votre compte fait foi.
Pourquoi mes limites Codex diffèrent-elles de celles d’un autre utilisateur ?
Le forfait, le modèle, la complexité, le contexte, le niveau de reasoning, fast mode, le mélange local/cloud, l’usage d’autres produits agentiques, les crédits achetés et les changements temporaires influent sur la capacité. Une publication disant « we’ve investigated a few messages about Codex usage limits being different » peut ne décrire qu’un instant donné ; comparez-la à la tarification officielle actuelle et à votre Dashboard.
Puis-je vérifier la limite avec /usage ?
La référence officielle actuelle documente /status, pas /usage. Utilisez /status pour la session active et le Usage Dashboard pour le quota du compte, les crédits et la réinitialisation.
Une erreur de contexte est-elle identique à une limite d’usage ?
Non. La limite d’usage contrôle la quantité de travail agentique incluse ou autorisée sur une période ; le contexte contrôle la quantité de contenu dans une requête ou une session. Compactez, retirez des fichiers ou ouvrez un nouveau chat. Attendre cinq heures ne réduit pas l’historique.
Une clé API contourne-t-elle les limites Codex ?
Elle ne contourne ni ne réinitialise le forfait ChatGPT. Le travail local passe par une route API facturée séparément, avec son propre solde, ses modèles et ses limites. Cela peut maintenir une tâche urgente, mais ce n’est pas gratuit et certaines fonctions hébergées peuvent manquer.
Continuer sans perdre l’état de la tâche
La séquence la plus sûre est : vérifier /status → identifier la limite → enregistrer un relais → choisir le reset/les crédits officiels ou un budget API séparé → lancer un test en lecture seule → reprendre avec une étape étroite.
BetterToken est pertinent lorsque le quota inclus est épuisé et que le travail local doit continuer. Ce n’est pas la réponse à toutes les erreurs. Pour une security review GitHub, une API 429 ou un contexte trop volumineux, corrigez d’abord la cause précise.