Convide e ganhe

Como funcionam as recompensas

Compartilhe seu link. Quando um amigo se cadastrar por ele e adicionar saldo, você receberá a recompensa exibida nas recargas posteriores.

Limite do Codex atingido? Veja a redefinição e continue (2026)

Guia prático para diferenciar limites de plano, API, security review e contexto no Codex; consultar /status e o Usage Dashboard; entender períodos de cinco horas e limites semanais; comparar modelos atuais e continuar um trabalho local urgente por um provedor API com cobrança separada.

Conteúdo
Limite do Codex atingido? Veja a redefinição e continue (2026)

Última verificação: 18 de setembro de 2026. Limites do Codex, disponibilidade de modelos, taxas de créditos e comandos podem mudar; confira as páginas oficiais no fim do artigo antes de publicar.

Quando o Codex para com “You’ve hit your usage limit”, “You are out of Codex and Work usage” ou “You have reached your Codex usage limits for security reviews. Please try again later.”, insistir no mesmo pedido raramente resolve. Primeiro identifique qual limite foi atingido e só então escolha a forma correta de continuar.

Este guia explica como verificar o horário de redefinição, como funcionam o período de cinco horas e possíveis limites semanais, por que o Codex pode compartilhar o mesmo pool com outros recursos agênticos, como diferenciar limite de contexto de limite de uso e como continuar uma tarefa local urgente do Codex CLI por meio de um provedor de API com cobrança separada.

Resumo rápido

  • Em uma sessão ativa do Codex CLI, digite /status. Para ver uso da conta, créditos e redefinição, abra o Codex Usage Dashboard.
  • Nem todo erro significa que “acabaram as mensagens do Codex”. Limite do plano ChatGPT, erro 429 de API, falha de security review e context_length_exceeded têm causas e soluções diferentes.
  • A OpenAI publica atualmente estimativas de mensagens locais por período de cinco horas, e não uma quantidade fixa garantida. Tarefas locais e na nuvem compartilham capacidade, e limites semanais também podem se aplicar.
  • As opções oficiais são aguardar o horário exibido, reduzir o consumo, comprar créditos quando disponível, mudar de plano ou executar trabalho local adicional com uma API key. Um provedor de API não redefine a franquia da assinatura; ele usa outro orçamento.

Como verificar o limite do Codex em 5 segundos

Na sessão em execução do Codex CLI, digite:

/status

/status mostra o ID do chat atual, o uso de contexto e informações de rate limit. Depois, abra Settings → Usage ou o Codex Usage Dashboard para consultar a franquia, os créditos e o horário de redefinição informado para sua conta.

Alguns artigos de terceiros sugerem /usage. Em 18 de setembro de 2026, a referência oficial de comandos slash do Codex lista /status, mas não /usage. Se o CLI não reconhecer /usage, isso é esperado: use /status junto com o painel web.

Decodificador de erros do Codex

Mensagem exibidaO que geralmente significaPróxima ação
You've hit your usage limit ou 5-hour limit reachedO uso agêntico incluído no ChatGPT/Codex para o período atual acabou.Confira /status e o Dashboard. Aguarde a redefinição exibida, use créditos se houver, escolha um modelo mais econômico ou mova o trabalho local urgente para cobrança por API.
You are out of Codex and Work usageO Codex e produtos agênticos compatíveis estão consumindo o mesmo pool de uso incluído ou de créditos.Veja em Settings qual produto consumiu o pool e siga as opções de redefinição ou compra de créditos mostradas.
You have reached your Codex usage limits for security reviews. Please try again later.A falha ocorreu no fluxo de security review do Codex hospedado no GitHub, não necessariamente na sessão local do CLI. Pode ser uma cota específica de revisão ou um problema do produto.Registre repositório, PR, horário e revisão que falhou. Consulte o Issue oficial do Codex e fale com o suporte se o Dashboard não explicar. Durante o diagnóstico, pause revisões automáticas disparadas repetidamente, mas não presuma que isso restaura a cota.
429 Too Many Requests ou rate_limit_exceededUm limite da organização, projeto, modelo, TPM/RPM, concorrência ou do provedor de API foi atingido.Verifique uso e limites no provedor real, reduza concorrência, aplique backoff ou solicite aumento. Esperar a redefinição da assinatura ChatGPT pode não ajudar.
insufficient_quotaO projeto de API não tem saldo, permissão de gasto ou capacidade de cobrança disponível.Confira faturamento da API, orçamento do projeto, escopo da key e saldo no provedor.
context_length_exceededHistórico, arquivos ou saída de ferramentas ultrapassaram o contexto aceito pelo modelo ou provedor escolhido.Use /compact, inicie um novo chat com uma nota de passagem, remova anexos grandes ou escolha um modelo com contexto maior. Isso não é o limite de cinco horas.

Qual limite você realmente atingiu?

1. Limite do plano ChatGPT ou de uso agêntico

Esse é o caso mais comum por trás de buscas como codex hit usage limit, codex usage limit e you've hit your usage limit codex. A capacidade depende do plano e do uso recente. Modelo, complexidade da tarefa, nível de reasoning, tamanho do contexto, execução local ou na nuvem e o uso de outros produtos agênticos alteram a velocidade de consumo.

2. Limite de taxa ou cobrança da API

A API é cobrada e limitada separadamente da franquia incluída no ChatGPT. Créditos de API não aumentam o limite da assinatura ChatGPT/Codex, e créditos do ChatGPT não viram saldo de API. Portanto, diante de 429 ou insufficient_quota, verifique a conta ou o provedor que atendeu a solicitação.

3. Limite da janela de contexto

O contexto determina quanto conteúdo cabe em uma solicitação ou conversa, e não quanto trabalho pode ser feito em cinco horas. Não existe um valor universal de 272k aplicável a todos os modelos Codex, clientes e provedores personalizados. Use /status para acompanhar o contexto e faça compactação ou passagem de estado antes de a sessão ficar pesada demais.

4. Limite de security review no GitHub

A mensagem exata de security review já apareceu no rastreador oficial openai/codex. A evidência pública confirma o erro, mas não prova uma única causa nem uma solução garantida. Trate-o como um incidente separado de revisão no GitHub: reúna evidências, confira serviço e conta, evite disparos automáticos repetidos e encaminhe os dados do PR ao suporte.

Como funcionam o período de cinco horas, o limite semanal e o pool compartilhado

Muitas páginas chamam isso de “janela móvel de cinco horas”. A página oficial atual é mais cuidadosa: publica estimativas de mensagens locais por período de cinco horas e direciona o usuário ao Dashboard para o limite e o horário de redefinição reais. Não suponha que haverá redefinição à meia-noite, em hora cheia ou numa data global; siga o horário mostrado na sua conta.

Três pontos causam a maior parte da confusão:

  1. A contagem de mensagens é uma estimativa, não uma promessa. Uma pequena alteração de arquivo e uma execução longa com ferramentas, contexto grande e reasoning alto não consomem a mesma quantidade.
  2. Tarefas locais e na nuvem compartilham capacidade. Mudar do CLI para uma tarefa cloud não cria necessariamente um novo pool.
  3. Pode haver limite semanal. O período de cinco horas pode ter sido redefinido enquanto um teto semanal ainda bloqueia o uso incluído.

A frase de busca “Codex, ChatGPT Work, ChatGPT for Excel, and Workspace Agents draw from the same agentic usage and credit pool” resume a ideia principal, embora a lista de produtos dependa do plano e da disponibilidade. A documentação atual também menciona experiências agênticas no Word e no PowerPoint quando disponíveis. Para sua conta, vale a lista mostrada em Settings.

Estimativas atuais por modelo em cinco horas

A tabela abaixo mostra as estimativas oficiais de mensagens locais por período de cinco horas, verificadas em 18 de setembro de 2026. Não são cotas garantidas.

ModeloPlusPro 5×Pro 20×Standard Business
GPT-6 Astra5–4525–225100–9005–45
GPT-5.6 Sol10–10050–500200–2.00010–100
GPT-5.6 Terra25–200125–1.000500–4.00025–200
GPT-5.6 Luna250–2.0001.250–10.0005.000–40.000250–2.000

A variação ampla é normal: tamanho do repositório, extensão do prompt, chamadas de ferramentas, contexto em cache, nível de reasoning e fast mode afetam o consumo. Use a tabela para planejamento, não para prever um número exato de mensagens.

Taxas de créditos comprados por modelo

Quando o plano permite comprar créditos, a OpenAI calcula atualmente o consumo agêntico em créditos por um milhão de tokens:

ModeloEntradaEntrada em cacheSaída
GPT-6 Astra250251.250
GPT-5.6 Sol10010500
GPT-5.6 Terra505300
GPT-5.6 Luna50,530

Uma tarefa típica do Codex com GPT-5.6 Sol é estimada atualmente em cerca de 5–30 créditos, mas o valor real depende da tarefa. Confira o Rate Card ao vivo antes de definir orçamento.

Opção A: permanecer no uso incluído oficial

Use este caminho quando a tarefa não for urgente ou quando você precisar de funções exclusivas da nuvem:

  1. Execute /status e abra o Usage Dashboard.
  2. Identifique se o bloqueio vem do período de cinco horas, de um limite semanal ou de créditos esgotados.
  3. Aguarde o horário exibido, compre créditos se o plano permitir ou faça upgrade quando fizer sentido econômico.
  4. Use Terra ou Luna em tarefas rotineiras, reduza o reasoning, diminua o escopo e abra uma nova sessão quando o contexto antigo já não ajudar.
  5. Se o uso parecer incorreto, salve a mensagem exata, horário, conta, versão do cliente e tipo de tarefa antes de acionar o suporte.

Não reenvie repetidamente a mesma tarefa grande. As tentativas podem gastar mais capacidade sem alterar o limite que causou o bloqueio.

Opção B: continuar uma tarefa local urgente com orçamento de API separado

Se uma tarefa local do CLI não puder esperar, o Codex aceita provedores de modelo personalizados. Um provedor como BetterToken pode conectar o Codex CLI local a um endpoint compatível com OpenAI e cobrar por token.

Esse é um orçamento separado, não uma redefinição nem um atalho para direitos do plano. Ele não aumenta a franquia da assinatura, não remove rate limits da API, não libera recursos do plano e não oferece funções cloud ou GitHub que dependam do ambiente oficial hospedado.

Etapa 1: preserve uma passagem de estado limpa

Antes de mudar de provedor ou abrir uma nova sessão, salve fora do chat uma nota curta:

Objetivo:
Estado atual:
Arquivos já alterados:
Comandos já executados:
Falhas conhecidas:
Próximo menor passo:
Não alterar:

Se houver uma edição inacabada, preserve a árvore de trabalho ou um patch com seu processo habitual. O objetivo é permitir que a nova sessão reconstrua a tarefa sem carregar todo o histórico.

Etapa 2: localize CODEX_HOME e confira a versão do CLI

Por padrão, o Codex usa ~/.codex, a menos que CODEX_HOME esteja definido.

macOS ou Linux:

export CODEX_HOME="${CODEX_HOME:-$HOME/.codex}"
mkdir -p "$CODEX_HOME"
echo "$CODEX_HOME"
codex --version

PowerShell:

$CodexHome = if ($env:CODEX_HOME) { $env:CODEX_HOME } else { Join-Path $HOME ".codex" }
New-Item -ItemType Directory -Force -Path $CodexHome | Out-Null
$CodexHome
codex --version

Arquivos de perfil nomeados, como bt.config.toml, exigem Codex CLI 0.134.0 ou posterior. Atualize o CLI se a versão for mais antiga.

Etapa 3: crie um perfil isolado do BetterToken

Crie $CODEX_HOME/bt.config.toml com o conteúdo abaixo:

model = "gpt-6-astra"
model_provider = "bettertoken"

[model_providers.bettertoken]
name = "BetterToken"
base_url = "https://www.bettertoken.ai/v1"
env_key = "BETTERTOKEN_API_KEY"
wire_api = "responses"
requires_openai_auth = false
request_max_retries = 4
stream_max_retries = 8
stream_idle_timeout_ms = 300000
supports_websockets = false

Isso mantém as configurações do provedor fora do config.toml principal. Não grave a API key nesse arquivo nem a envie para um repositório.

A página atual de configuração do BetterToken também pode apresentar um fluxo baseado em auth.json. Não misture esse método com o perfil por variável de ambiente acima. Use um único método completo e trate a página atual como fonte de verdade se os requisitos de autenticação mudarem.

Etapa 4: execute um teste mínimo somente leitura

macOS ou Linux:

export BETTERTOKEN_API_KEY="YOUR_API_KEY"
codex exec --profile bt "Leia o README.md e resuma a finalidade do projeto. Não altere nenhum arquivo."

PowerShell:

$env:BETTERTOKEN_API_KEY="YOUR_API_KEY"
codex exec --profile bt "Leia o README.md e resuma a finalidade do projeto. Não altere nenhum arquivo."

Substitua YOUR_API_KEY apenas localmente. Nunca cole uma key real em chamado, captura de tela, chat ou repositório. Um teste somente leitura verifica autenticação, endpoint, acesso ao modelo e streaming com baixo custo e risco.

Etapa 5: verifique a cobrança antes de retomar

Confirme que o teste aparece na página de uso ou saldo do provedor. Em seguida, inicie a tarefa real com a nota de passagem e uma primeira ação pequena. Se o teste falhar, leia o erro exato antes de alterar várias configurações:

  • 401 ou 403: key, conta, modo de autenticação ou permissão do modelo.
  • 404: Base URL, rota ou model ID.
  • 429: limite do provedor ou política de saldo.
  • Timeout de streaming: rota de rede ou timeout do provedor; não aumente todos os retries de uma vez.

Como consumir menos franquia do Codex

  • Use GPT-5.6 Terra ou Luna para localizar arquivos, formatar, fazer pequenas alterações e verificações rotineiras; reserve Astra ou Sol para raciocínio realmente mais profundo.
  • Peça uma alteração verificável por vez. “Analise tudo e corrija tudo” costuma consumir mais contexto e chamadas de ferramentas.
  • Abra uma nova sessão com nota de passagem quando a conversa antiga for principalmente histórico.
  • Execute /compact antes que o contexto vire gargalo e confirme que o resumo preservou as restrições críticas.
  • Desative servidores MCP que não estejam em uso e evite anexar logs enormes sem necessidade.
  • Pare quando a menor verificação relevante passar; não execute suítes completas sem relação com a mudança.
  • Use o Usage Dashboard como fonte de verdade, em vez de estimar pela quantidade de mensagens enviadas.

Perguntas frequentes

Quando o limite de uso do Codex é redefinido?

Não há um relógio universal publicado para todas as contas. Execute /status, abra o Usage Dashboard e siga o horário mostrado. Não deduza o seu reinício pela meia-noite, pela captura de outra pessoa ou pela data de um artigo.

“August 14, 2026” significa que o Codex é redefinido globalmente nessa data?

Não. 14 de agosto de 2026 pode ser a atualização de um artigo, um horário específico de uma conta ou a data de um relato. Não é uma data global de redefinição. Para sua conta, o Dashboard é a referência.

Por que meus limites do Codex são diferentes dos de outra pessoa?

Plano, modelo, complexidade, contexto, nível de reasoning, fast mode, mistura de tarefas locais e cloud, uso de outros produtos agênticos, créditos comprados e mudanças temporárias afetam a capacidade. Uma publicação com “we’ve investigated a few messages about Codex usage limits being different” pode refletir apenas um momento; compare-a com a página oficial atual e seu Dashboard.

Posso verificar o limite com /usage?

A referência oficial atual documenta /status, não /usage. Use /status na sessão ativa e o Usage Dashboard para franquia da conta, créditos e horário de redefinição.

Erro de contexto é o mesmo que limite de uso?

Não. O limite de uso controla quanto trabalho agêntico está incluído ou permitido em um período; o contexto controla quanto material cabe numa solicitação ou sessão. Compacte, remova arquivos ou abra um novo chat. Esperar cinco horas não reduz o histórico.

Uma API key contorna os limites do Codex?

Ela não contorna nem redefine o limite do plano ChatGPT. O trabalho local segue por uma rota API cobrada separadamente, com saldo, acesso a modelos e limites próprios. Isso pode manter uma tarefa urgente em andamento, mas não é gratuito e pode não oferecer recursos hospedados.

Continue sem perder o estado da tarefa

A sequência mais segura é: verificar /status → identificar o limite → salvar uma passagem de estado → escolher redefinição/créditos oficiais ou um orçamento API separado → executar um teste somente leitura → retomar com um passo pequeno.

BetterToken é útil quando a franquia incluída acabou e o trabalho local precisa continuar. Não é a resposta para todo erro. Em caso de security review no GitHub, 429 de API ou contexto excessivo, corrija primeiro a causa específica.

Referências oficiais

Quer otimizar seu fluxo de trabalho com LLMs?

Conecte modelos por uma única API, gerencie chaves e controle os gastos com IA.

Começar grátis