Codex-Nutzungslimits: Warum ein Limit erreicht wird und wie es weitergeht

Erfahren Sie, wie Sie ein Codex-Tariflimit von einem API-Ratenlimit, einem Kontextüberlauf oder unzureichendem Guthaben unterscheiden und sicher weiterarbeiten.

Codex-Nutzungslimits: Warum ein Limit erreicht wird und wie es weitergeht

Wenn Codex meldet, dass Sie ein Limit erreicht haben, prüfen Sie zuerst die genaue Fehlermeldung und die Seite „Usage“. Ein in einem ChatGPT-Tarif enthaltenes Codex-Limit, ein API-Ratenlimit, ein überfülltes Kontextfenster und ein aufgebrauchtes API-Guthaben sind vier verschiedene Situationen. Der Kauf von API-Guthaben erhöht nicht das Kontingent Ihres Abonnements, und das Warten auf die Zurücksetzung eines Abonnementlimits behebt keinen API-Fehler.

Mit Stand vom 14. August 2026 heißt es in OpenAIs aktueller Codex-Preisübersicht, dass Codex, ChatGPT Work, ChatGPT for Excel und Workspace Agents auf denselben Pool für agentische Nutzung und Guthaben zugreifen, sofern diese Funktionen in Ihrem Tarif verfügbar sind. Bevor Sie einen Rückgang der verfügbaren Nutzung allein Codex zuschreiben, prüfen Sie unter „Usage“ die Aktivitäten der anderen agentischen Funktionen, die in Ihrem Workspace verfügbar sind.

Wenn die Aufgabe dringend ist, haben Sie zwei unabhängige Möglichkeiten: Nutzen Sie einen offiziellen Guthabenmechanismus, der in Ihrem Tarif verfügbar ist, oder verlagern Sie die Arbeit in einen separaten API-Workflow. Für die zweite Möglichkeit können Sie einen benutzerdefinierten Codex-Anbieter mit BetterToken konfigurieren und ihn zuerst mit einer kleinen Anfrage testen. BetterToken bietet nutzungsabhängig abgerechneten API-Zugriff; es erweitert kein ChatGPT-Abonnement und hebt kein offizielles Codex-Limit auf.

Das Limit in einer Minute bestimmen

Was Sie sehenWas es normalerweise bedeutetWo Sie nachsehen solltenNächster Schritt
Ein Codex-Banner meldet, dass Sie ein Nutzungslimit erreicht habenDie für das Konto verfügbare gemeinsame agentische Nutzung oder das Tarifguthaben ist aufgebrauchtUsage, das Limit-Banner und andere im Workspace verfügbare agentische FunktionenNutzen Sie eine verfügbare Zurücksetzung oder Guthaben, wechseln Sie den Tarif oder warten Sie auf die Zurücksetzung
429, rate_limit_exceeded, Retry-AfterEine anbieterspezifische API-Ablehnung, deren Ursache sich nicht allein aus dem HTTP-Status ableiten lässtGenauer Fehlercode, Antworttext, Antwort-Header und Dokumentation des AnbietersBefolgen Sie die Diagnose- und Wiederholungshinweise für diesen konkreten Fehler
context_length_exceeded oder eine Meldung, dass der Kontext zu lang istAnfrage und Gesprächsverlauf lassen keinen Platz für eine neue AntwortGröße der aktuellen Sitzung und AnhängeStarten Sie eine neue Sitzung, verkürzen Sie die Eingabe oder teilen Sie die Aufgabe auf
insufficient_quota oder eine Ablehnung wegen des GuthabensEs ist kein API-Budget oder zulässiges Ausgabevolumen verfügbarGuthaben, Workspace-Limit und SchlüsselstatusLaden Sie Guthaben auf oder korrigieren Sie das Limit und wiederholen Sie anschließend einen kleinen Test

Leiten Sie die Ursache nicht allein aus dem Status 429 ab. Lesen Sie den konkreten Fehlercode und den Antworttext und befolgen Sie anschließend die aktuelle Dokumentation des Anbieters zu diesem Fehler.

Warum eine feste Anzahl von Nachrichten nicht verlässlich ist

Laut dem am 14. August 2026 geprüften OpenAI Help Center hängt die Codex-Nutzung von Größe und Komplexität der Aufgabe, dem ausgewählten Modell und dem Ausführungsort ab. Eine kleine lokale Änderung und eine lange Aufgabe in einem großen Repository verbrauchen das Kontingent unterschiedlich. Eine Formel wie „N Nachrichten alle fünf Stunden“ kann daher schnell veralten und sagt die tatsächliche Nutzung nicht zuverlässig voraus.

Bei Aufgaben, die nach der aktuellen tokenbasierten Preisübersicht mit Guthaben bezahlt werden, sind das ausgewählte Modell sowie die Input-, Cached-Input- und Output-Tokens der Aufgabe die messbaren Variablen. Öffnen Sie die aktuelle Codex-Preisübersicht und ermitteln Sie anhand der für Ihren eigenen Workspace angezeigten Informationen, welche Tabelle und Einheit derzeit gelten, bevor Sie Kosten schätzen.

Was zu tun ist, wenn Sie ein Codex-Tariflimit erreichen

  1. Öffnen Sie „Usage“ oder das Limit-Banner und halten Sie genau fest, was Ihr Konto anbietet: Guthaben, eine verfügbare Zurücksetzung, ein Upgrade oder das Warten auf die Zurücksetzung des Limits. Prüfen Sie auch, ob andere im Workspace verfügbare agentische Funktionen den gemeinsamen Pool beansprucht haben. Wenn Sie mit Ihrer aktuellen Rolle keine Credits hinzufügen oder die Abrechnung verwalten können, wenden Sie sich an den Workspace-Owner oder -Admin; welche Aktionen verfügbar sind, hängt weiterhin vom Tarif, von Ihrer Workspace-Rolle und den Admin-Berechtigungen ab.
  2. Die aktuelle OpenAI Config Reference speichert das benannte Profil unter $CODEX_HOME/bt.config.toml. Standardmäßig entspricht CODEX_HOME unter macOS/Linux meist ~/.codex und unter Windows %USERPROFILE%\.codex. Ein benutzerdefinierter Wert hat jedoch Vorrang und ändert den tatsächlichen Pfad.

Prüfen Sie unter macOS/Linux das Verzeichnis, ohne die Variable zu ändern:

printf '%s\n' "${CODEX_HOME:-$HOME/.codex}"

In PowerShell:

if ($env:CODEX_HOME) { $env:CODEX_HOME } else { Join-Path $env:USERPROFILE ".codex" }

Erstellen Sie bt.config.toml genau im angezeigten Verzeichnis:

model = "YOUR_MODEL_ID" model_provider = "bettertoken" [model_providers.bettertoken] name = "BetterToken" base_url = "https://www.bettertoken.ai/v1?utm_source=blog&utm_medium=organic_content&utm_campaign=SEO-093&utm_content=codex-usage-limits-kak-prodolzhit" env_key = "BETTERTOKEN_API_KEY" wire_api = "responses" requires_openai_auth = false request_max_retries = 4 stream_max_retries = 8 stream_idle_timeout_ms = 300000 supports_websockets = false

Die Datei $CODEX_HOME/bt.config.toml entspricht dem Befehl --profile bt. Dieses Profil ersetzt nicht die Hauptdatei $CODEX_HOME/config.toml, sodass der offizielle Provider weiter verfügbar bleibt. Ersetzen Sie YOUR_MODEL_ID durch die aktuelle vollständige API ID aus Setup, model plaza oder der aktuellen Anleitung. Verwenden Sie nicht den Anzeigenamen des Modells, wenn er von der API ID abweicht.

Auch die Provider-Namen müssen exakt übereinstimmen: Das auf der Stammebene gesetzte model_provider = "bettertoken" verweist auf [model_providers.bettertoken].

Codex hängt /responses selbst an. Deshalb endet die Base URL mit /v1 und nicht mit /v1/responses; andernfalls würde der Pfad doppelt angefügt.

Die vier Schritte mit --profile in diesem Abschnitt gelten ausschließlich für Codex CLI. Prüfen Sie für Codex Desktop in der aktuellen BetterToken-Anleitung, wie die Konfiguration ausgewählt und der Client gestartet wird. Folgen Sie für die VS Code Extension der separaten Anleitung; übernehmen Sie das CLI-Profil und dessen Authentifizierung nicht ungeprüft.

  1. Exportieren Sie den Schlüssel in Ihrer Shell und prüfen Sie lediglich, ob die Variable nicht leer ist, ohne ihren Wert auszugeben:
export BETTERTOKEN_API_KEY="YOUR_API_KEY" test -n "$BETTERTOKEN_API_KEY" && echo "BETTERTOKEN_API_KEY is set"
  1. Starten Sie Codex mit dem neuen Profil:
codex --profile bt

Senden Sie anschließend eine kleine schreibgeschützte Anfrage, zum Beispiel:

Lies README.md und fasse den Zweck der Datei zusammen. Ändere keine Dateien.
  1. Prüfen Sie die Anfrage und ihren Verbrauch im Workspace, bevor Sie mit einer größeren Aufgabe fortfahren. Das vollständige aktuelle Beispiel finden Sie in der Einrichtungsanleitung für Codex.

Speichern Sie einen echten Schlüssel weder in einem Repository, einem Artikel, einem Screenshot noch in $CODEX_HOME/bt.config.toml, falls die Konfiguration in Git committet werden könnte. Der Wert sollte aus einer Umgebungsvariable stammen.

Arbeitsverlust beim Wechsel vermeiden

Erstellen Sie eine kurze Übergabedatei ohne Geheimnisse:

Ziel: fehlschlagenden Test X beheben. Bereits geprüft: A und B. Geänderte Dateien: path/to/file. Nächster sicherer Schritt: einen gezielten Test ausführen. Verboten: Commit, Deployment, Löschen von Daten.

Bevor Sie eine weitere Arbeitskopie öffnen, prüfen Sie den aktuellen Stand, sichern Sie verfolgte Änderungen als binärsicheren Patch und listen Sie nicht verfolgte Dateien separat auf:

git status --short git diff --binary HEAD > ../codex-handoff.patch git ls-files --others --exclude-standard -z > ../codex-handoff-untracked.zlist

Der Patch enthält keine nicht verfolgten Dateien. Prüfen Sie vor dem Kopieren ../codex-handoff-untracked.zlist und schließen Sie .env-Dateien, private Schlüssel, Zugangsdaten und alle anderen Geheimnisse aus. Behalten Sie nur ausdrücklich geprüfte und freigegebene Pfade; gehen Sie nicht davon aus, dass eine nicht verfolgte Datei entbehrlich ist oder sicher übertragen werden kann.

Erstellen Sie vom aktuellen HEAD einen neuen Worktree, prüfen Sie den Patch vor dem Anwenden und kontrollieren Sie anschließend den resultierenden Stand:

git worktree list git branch --list codex/api-handoff git worktree add -b codex/api-handoff ../project-api-handoff HEAD if test -s ../codex-handoff.patch; then git -C ../project-api-handoff apply --check ../codex-handoff.patch git -C ../project-api-handoff apply ../codex-handoff.patch fi while IFS= read -r -d '' path; do mkdir -p -- "../project-api-handoff/$(dirname -- "$path")" cp -p -- "$path" "../project-api-handoff/$path" done < ../codex-handoff-untracked.zlist git -C ../project-api-handoff status --short

Der if-Block überspringt git apply, wenn der Patch für verfolgte Dateien leer ist. Die Kopierschleife steht außerhalb dieses Blocks, sodass geprüfte und freigegebene nicht verfolgte Dateien trotzdem übertragen werden. Falls ../project-api-handoff oder codex/api-handoff bereits vorhanden ist, wählen Sie einen neuen, noch nicht verwendeten Pfad oder Branch-Namen. Löschen Sie nicht einfach einen bestehenden Worktree, Branch, Patch oder eine nicht verfolgte Datei, nur um einen kollidierenden Namen wiederzuverwenden.

Beginnen Sie die neue API-Sitzung mit der Übergabenotiz und dem überprüften Arbeitsstand statt mit dem vollständigen Gesprächsverlauf. Das reduziert den Verbrauch, senkt das Risiko eines Kontextüberlaufs und verringert die Wahrscheinlichkeit, dass bereits erledigte Aktionen wiederholt werden.

Wenn Sie stattdessen 429 erhalten

Prüfen Sie der Reihe nach Folgendes:

  1. Den konkreten Fehlercode, den Antworttext, die Antwort-Header und die Dokumentation des Anbieters zu diesem Fehler.
  2. Ob mehrere Agenten oder CI-Jobs denselben Schlüssel verwenden.
  3. Ob das Guthaben aufgebraucht oder das Ausgabenbudget des Workspace erreicht ist.
  4. Ob der Fehler bei einer einzelnen kleinen Anfrage nach einer für diesen konkreten Fehler empfohlenen Wartezeit weiterhin auftritt.

Wenn der konkrete Fehler und die Dokumentation des Anbieters auf eine vorübergehende Ratenbegrenzung hinweisen, verwenden Sie begrenztes exponentielles Backoff mit Jitter. Wiederholen Sie Anfragen nicht unbegrenzt: Wiederholte Anfragen verlängern die Warteschlange und können Budget verbrauchen, nachdem sich der Dienst erholt hat.

Die endgültige Entscheidung treffen

  • Wenn das Codex-Banner Guthaben oder eine Zurücksetzung anbietet und Sie denselben tarifbasierten Workflow beibehalten möchten, nutzen Sie die verfügbare offizielle Option.
  • Wenn Sie ein separates Budget für Automatisierung, CI oder eine dringende Aufgabe benötigen, konfigurieren Sie einen API-Workflow und erfassen Sie dessen Verbrauch getrennt.
  • Wenn das Kontextfenster das Problem ist, verkürzen Sie den Kontext oder starten Sie eine neue Sitzung. Mehr Geld auszugeben oder auf die Zurücksetzung eines Limits zu warten, löst das Problem nicht.
  • Wenn das Problem ein API-Fehler 429 ist, richten Sie sich nach dem konkreten Fehlercode, dem Antworttext und der Dokumentation des Anbieters; wenn das Guthaben aufgebraucht ist, korrigieren Sie das Budget, bevor Sie die Anfrage wiederholen.

Öffnen Sie vor dem Verschieben dringender Arbeiten die aktuelle BetterToken-Einrichtungsanleitung für Codex, konfigurieren Sie einen benutzerdefinierten Anbieter mit einem separaten Schlüssel und überprüfen Sie ihn mit einer kleinen Anfrage. Wenn die Überprüfung erfolgreich war, legen Sie ein Ausgabenlimit fest und setzen Sie erst dann die längere Aufgabe fort.

Bereit, Ihren LLM-Workflow zu optimieren?

Verbinden Sie Modelle über eine API, verwalten Sie Schlüssel und behalten Sie KI-Kosten im Blick.