Invitez et gagnez

Fonctionnement des récompenses

Partagez votre lien. Lorsqu’un ami s’inscrit avec ce lien et recharge son solde, vous recevez la récompense affichée sur ses recharges ultérieures.

Astra épuise votre quota Codex : comment continuer à travailler

Diagnostiquez la consommation rapide d’Astra, comparez les prix de l’API Standard et poursuivez votre projet Codex avec BetterToken, plugins officiels et Computer Use.

Sommaire
Astra épuise votre quota Codex : comment continuer à travailler

Codex a modifié le code, mais vous devez encore vérifier l’interface et votre quota Astra est presque épuisé. Commencez par identifier la fenêtre d’usage qui arrive à sa limite. Décidez ensuite comment terminer : faire durer le quota restant, utiliser une réinitialisation disponible ou transférer les requêtes de modèle vers une API facturée à l’usage.

Avec BetterToken, vous pouvez continuer à travailler dans Codex et utiliser Computer Use lorsque le plugin et l’accès à l’application sont configurés. Computer Use n’est disponible dans ChatGPT Work et Codex que dans les régions prises en charge ; connecter BetterToken ne modifie pas cette condition. Vous changez le fournisseur et la facturation des requêtes de modèle. La configuration ci-dessous préserve votre connexion officielle et vos plugins afin que vous puissiez vous concentrer sur la finalisation du projet.

Pourquoi Astra peut consommer votre quota plus vite

Des utilisateurs ont signalé ce problème directement. Dans un signalement adressé aux développeurs de Codex, un abonné Pro 20x a décrit une baisse rapide de son quota hebdomadaire lors de l’utilisation d’Astra, suivie d’un passage à Sol. Ses enregistrements locaux de requêtes comportaient une réserve importante : le travail simultané et les délais de mise à jour du compteur rendaient difficile l’attribution de toute la baisse à un seul modèle. Le signalement documente un vrai problème de planification, mais n’établit pas une facturation incorrecte.

Les conseils d’utilisation d’OpenAI expliquent que le modèle et la tâche influent tous deux sur la consommation. Des entrées et sorties plus importantes, un effort de raisonnement élevé, le mode Fast et un travail en plusieurs étapes peuvent utiliser davantage de quota. Un court message comme « termine ceci et vérifie-le » peut déclencher des lectures de fichiers, des modifications et plusieurs cycles de vérification.

Ouvrez Settings → Usage et notez le quota restant ainsi que l’heure de réinitialisation pour les fenêtres de cinq heures et hebdomadaire. Si votre formule applique les deux limites, vous devez avoir de la marge dans les deux. Le fait qu’il reste du temps dans la semaine ne signifie pas forcément que vous pouvez continuer à exécuter des tâches.

Examinez ce que fait la tâche actuelle :

Ce que vous constatezCe qu’il faut vérifier ou modifier
Astra effectue une petite modification courante avec un effort de raisonnement élevéEssayez Low ou Medium pour la prochaine étape bornée ; augmentez l’effort si le résultat le justifie
L’agent répète la même vérification qui échoueClarifiez l’erreur ou fournissez les fichiers ou accès manquants ; davantage de raisonnement ne peut pas apporter les informations absentes
Plusieurs tâches sont exécutées en même tempsVérifiez leur progression et arrêtez les répétitions inutiles avant d’évaluer la consommation d’une tâche
L’usage semble disproportionné par rapport au travail terminéConservez le modèle, les réglages, l’horodatage avec fuseau horaire et les relevés Usage pour le Support

Les relevés locaux de tokens peuvent aider à décrire un problème. Ils ne donnent pas, à eux seuls, une formule permettant de convertir des tokens en pourcentages d’abonnement. Une différence entre ces compteurs ne suffit pas à conclure qu’une facturation est erronée.

Choisissez comment terminer la tâche

S’il vous reste du quota, un modèle plus économique ou un effort de raisonnement moindre peut aider à finir une petite étape. Changer de modèle au sein d’un pool partagé ne rétablit pas le quota déjà utilisé.

Si le pool est épuisé, consultez les options affichées pour votre compte : attendre une réinitialisation, utiliser une réinitialisation enregistrée, acheter une réinitialisation éligible ou utiliser des crédits supplémentaires. La disponibilité et les conditions dépendent du compte et de la région. Une API facturée séparément est une autre option pour un travail qui doit continuer immédiatement.

BetterToken fournit ce type d’accès API à Astra. Vous utilisez votre propre API Key et payez selon l’usage, avec un relevé de coût distinct. Votre quota d’abonnement officiel n’est pas réinitialisé. Le guide BetterToken pour Codex explique la connexion.

Dans quelle mesure Astra est-il moins cher avec BetterToken ?

Selon la vérification effectuée le 9 septembre 2026, ces tarifs BetterToken pour gpt-6-astra dans le groupe GPT sont 32 % inférieurs aux tarifs de l’API Standard d’OpenAI. Les prix sont en dollars américains par million de tokens, pour des requêtes ne dépassant pas 272 000 tokens en entrée.

Type de tokenAPI Standard d’OpenAIBetterToken, groupe GPT
Entrée non mise en cache$10.00$6.80
Lectures de cache$1.00$0.68
Écritures de cache$12.50$8.50
Sortie$50.00$34.00

Sources : tarification du modèle OpenAI et catalogue actuel de BetterToken. L’API de tarification BetterToken répertorie les niveaux de prix d’Astra et un multiplicateur du groupe GPT de 0.68.

Les requêtes comportant plus de 272 000 tokens en entrée utilisent un niveau différent. Les tarifs Standard d’OpenAI pour l’entrée, la lecture de cache, l’écriture de cache et la sortie sont de $20, $2, $25 et $75 par million de tokens. Avec le multiplicateur actuel, les tarifs BetterToken correspondants sont $13.60, $1.36, $17 et $51. Le niveau de contexte long s’applique à la requête entière.

Par exemple, supposons que plusieurs requêtes restent chacune sous le seuil de 272 000 tokens et utilisent au total 1 million de tokens d’entrée non mis en cache et 100 000 tokens de sortie. Sans cache ni frais d’outils supplémentaires, cela représente $15 sur l’API Standard d’OpenAI et $10.20 chez BetterToken. Il s’agit d’un calcul pour un volume de tokens donné, et non d’une promesse de prix horaire pour une session.

La comparaison couvre les tarifs de tokens indiqués pour l’API Standard. Elle exclut Batch, Flex, le mode Fast, les éventuels frais d’outils distincts et les coûts d’abonnement. Si votre abonnement couvre déjà votre travail, son coût global peut être meilleur. Vérifiez les tarifs actuels avant d’ajouter des fonds, puis essayez une petite étape de votre propre tâche.

Gardez les outils Codex et Computer Use disponibles

Le travail sur un projet implique de lire et modifier des fichiers, d’exécuter des commandes et des vérifications, d’utiliser des outils MCP connectés et d’inspecter le résultat dans une interface. Passer à une API ne vous oblige pas à déplacer ce travail dans une discussion séparée. Continuez à utiliser Codex et vérifiez dans le client les outils dont vous avez besoin.

Si les plugins officiels fonctionnent déjà, utilisez la configuration qui préserve votre connexion officielle :

  1. Vérifiez que Codex conserve votre connexion officielle. Installez CC Switch 3.16.1 ou version ultérieure.
  2. Ajoutez BetterToken dans CC Switch avec votre propre clé de groupe GPT, la Base URL https://www.bettertoken.ai/v1 et le modèle gpt-6-astra. Codex nécessite la Responses API.
  3. Dans Settings → General → Codex App Enhancements, activez Keep official login when switching third-party providers. Activez Unified Codex session history si vous souhaitez aussi une liste d’historique unifiée.
  4. Quittez complètement Codex puis rouvrez-le. Vérifiez votre connexion officielle, le fournisseur sélectionné, la réponse à un court message et la requête correspondante dans l’historique d’utilisation BetterToken.

Si Codex utilise déjà une API et que les plugins requis fonctionnent, mettez à jour la Base URL, l’API Key et, si nécessaire, le Model ID existants. Vous n’avez pas besoin de réinstaller Computer Use uniquement parce que vous avez changé de fournisseur. Saisissez la clé localement dans les réglages, et non dans un message à l’agent.

Un historique unifié affiche les sessions ensemble ; il ne garantit pas qu’une session existante puisse se poursuivre via un autre fournisseur. Si elle ne peut pas reprendre, créez une nouvelle tâche dans le même projet et transmettez son état actuel comme décrit ci-dessous.

Vérifiez Computer Use après le changement

Dans une région prise en charge, ouvrez Work ou Codex dans l’application de bureau ChatGPT, puis Plugins → Computer Use. Installez ou activez le plugin et vérifiez les interrupteurs du serveur MCP et de la skill. Sur macOS, accordez les autorisations Screen Recording et Accessibility. Sous Windows, gardez l’application cible visible dans la session de bureau active. Consultez la documentation Computer Use pour les conditions de disponibilité et de configuration.

Une fois la courte requête texte réussie, donnez à l’agent une petite tâche d’interface : ouvrir une application locale, reproduire un problème connu et décrire le résultat visible. Confirmez qu’il a réellement accès à la fenêtre visée avant de passer à l’étape suivante.

Cette configuration conserve une combinaison utile : Astra modifie le code dans Codex, tandis que Computer Use aide à vérifier l’interface de bureau. Les plugins, les autorisations système et les restrictions de l’organisation continuent de s’appliquer. La prise en charge de l’API du modèle ne donne pas automatiquement accès à chaque fonctionnalité cloud ni à chaque service tiers.

Reprenez depuis l’état actuel du projet

Avant de changer, enregistrez les fichiers modifiés et examinez le diff. Si l’ancienne session répond encore, demandez-lui de consigner brièvement l’état actuel. Si la limite l’a déjà arrêtée, composez ce relevé à partir des fichiers, de l’historique de la tâche et des résultats des commandes.

Utilisez une transmission comme celle-ci pour la nouvelle tâche :

Continue the current project from its existing files and diff.
Goal: [the result still needed].
Completed: [changes already made].
Checks: [commands run and their actual results].
Remaining problem: [exact error or visible behavior].
Next step: [one bounded change or verification].
Preserve unrelated changes. Do not restart completed work.
Stop after this step and report the result.

Pour le travail d’interface, ajoutez le nom de l’application, la fenêtre cible et l’action dont le résultat doit être vérifié. Pour une page web locale, commencez par le navigateur intégré de Codex. Utilisez Computer Use pour une application de bureau ou une vérification qui exige son interface graphique.

Après la première étape, comparez le diff, le résultat de vérification et le relevé d’utilisation BetterToken. Vous obtenez ainsi le coût d’une étape réelle de votre projet et pouvez choisir la suite : continuer avec Astra, réduire l’effort de raisonnement ou confier une partie simple à un autre modèle disponible. En cas d’erreur API, identifiez d’abord son type à l’aide du guide sur les limites et la poursuite du travail afin de ne pas payer pour répéter le même essai en échec.

Créez une API Key BetterToken, suivez le guide pour préserver la connexion et les plugins, puis commencez par une étape inachevée de votre projet actuel.

Prêt à optimiser votre workflow LLM ?

Connectez vos modèles via une API unique, gérez les clés et maîtrisez vos dépenses d’IA.

Commencer gratuitement