Invita y gana

Cómo funcionan las recompensas

Comparte tu enlace. Cuando un amigo se registre con él y recargue saldo, recibirás la recompensa indicada por sus recargas posteriores.

¿Alcanzaste el límite de Codex? Comprueba el reinicio y continúa (2026)

Guía práctica para distinguir límites de plan, API, security review y contexto en Codex; consultar /status y el Usage Dashboard; entender periodos de cinco horas y topes semanales; comparar modelos actuales y continuar un trabajo local urgente mediante un proveedor API con facturación separada.

Índice
¿Alcanzaste el límite de Codex? Comprueba el reinicio y continúa (2026)

Última verificación: 18 de septiembre de 2026. Los límites de Codex, la disponibilidad de modelos, las tarifas de créditos y los comandos pueden cambiar; revisa las páginas oficiales enlazadas al final antes de publicar.

Cuando Codex se detiene con “You’ve hit your usage limit”, “You are out of Codex and Work usage” o “You have reached your Codex usage limits for security reviews. Please try again later.”, lo menos útil es repetir la misma solicitud una y otra vez. Primero identifica qué límite se activó y después aplica la solución adecuada.

Esta guía explica cómo comprobar la hora de reinicio, cómo funcionan el periodo de cinco horas y los posibles límites semanales, por qué Codex puede compartir un mismo fondo de uso con otras funciones agénticas, en qué se diferencia un límite de contexto y cómo continuar una tarea local urgente de Codex CLI mediante un proveedor API con facturación independiente.

Resumen rápido

  • En una sesión activa de Codex CLI, escribe /status. Para consultar el uso de la cuenta, los créditos y el reinicio, abre el Codex Usage Dashboard.
  • No todas las incidencias significan que “se acabaron los mensajes de Codex”. Un límite del plan de ChatGPT, un 429 de API, un fallo de security review y context_length_exceeded tienen causas distintas.
  • OpenAI publica actualmente estimaciones de mensajes locales por periodo de cinco horas, no un número fijo garantizado. Las tareas locales y en la nube comparten capacidad y también pueden existir límites semanales.
  • Las opciones oficiales son esperar al reinicio mostrado, reducir el consumo, comprar créditos cuando estén disponibles, cambiar de plan o ejecutar trabajo local adicional con una API key. Un proveedor API no reinicia el límite de la suscripción: utiliza otro presupuesto.

Cómo comprobar el límite de Codex en 5 segundos

En la sesión activa de Codex CLI, escribe:

/status

/status muestra el identificador del chat actual, el uso de contexto y la información de rate limit. Después abre Settings → Usage o el Codex Usage Dashboard para consultar la capacidad, los créditos y la hora de reinicio indicada para tu cuenta.

Algunas publicaciones de terceros recomiendan /usage. A fecha del 18 de septiembre de 2026, la referencia oficial de comandos slash de Codex incluye /status, pero no /usage. Si el CLI no reconoce /usage, es normal: utiliza /status junto con el panel web.

Tabla rápida de errores de Codex

Mensaje que apareceQué suele significarQué hacer
You've hit your usage limit o 5-hour limit reachedSe agotó el uso agéntico incluido en ChatGPT/Codex para el periodo actual.Revisa /status y el Dashboard. Espera al reinicio mostrado, utiliza créditos si están disponibles, elige un modelo más ligero o pasa el trabajo local urgente a facturación API.
You are out of Codex and Work usageCodex y los productos agénticos compatibles consumen el mismo fondo de uso incluido o de créditos.Comprueba en Settings qué producto consumió el fondo y sigue las opciones de reinicio o compra de créditos que aparezcan.
You have reached your Codex usage limits for security reviews. Please try again later.El fallo pertenece al flujo de security review de Codex alojado en GitHub, no necesariamente a tu sesión local de CLI. Puede tratarse de una cuota específica de revisiones o de un problema del producto.Guarda repositorio, PR, hora y revisión fallida. Consulta el Issue oficial de Codex y contacta con soporte si el Dashboard no lo explica. Puedes pausar revisiones automáticas que se disparen repetidamente mientras investigas, pero no des por hecho que eso restablece la cuota.
429 Too Many Requests o rate_limit_exceededSe alcanzó un límite de organización, proyecto, modelo, TPM/RPM, concurrencia o proveedor API.Revisa el uso y los límites del proveedor real, reduce la concurrencia, aplica backoff o solicita un límite mayor. Esperar al reinicio de ChatGPT puede no servir.
insufficient_quotaEl proyecto API no tiene saldo, permiso de gasto o capacidad de facturación utilizable.Comprueba la facturación API, el presupuesto del proyecto, el alcance de la key y el saldo del proveedor.
context_length_exceededEl historial, los archivos o la salida de herramientas superan el contexto admitido por el modelo o proveedor seleccionado.Usa /compact, inicia un chat nuevo con una nota de traspaso, elimina adjuntos grandes o elige un modelo con más contexto. No es un límite de cinco horas.

¿Qué límite has alcanzado realmente?

1. Límite del plan de ChatGPT o de uso agéntico

Es el caso habitual detrás de búsquedas como codex hit usage limit, codex usage limit o you've hit your usage limit codex. La capacidad depende del plan y del consumo reciente. El modelo, la complejidad de la tarea, el nivel de reasoning, el tamaño del contexto, la ejecución local o en la nube y el uso de otros productos agénticos cambian la velocidad de consumo.

2. Límite de velocidad o facturación de API

La API se factura y limita por separado del uso incluido en el plan de ChatGPT. Los créditos API no aumentan la capacidad de ChatGPT/Codex y los créditos de ChatGPT no se convierten en saldo API. Por eso, ante un 429 o insufficient_quota, debes revisar la cuenta o el proveedor que atendió la solicitud.

3. Límite de ventana de contexto

El contexto determina cuánto material cabe en una petición o conversación, no cuánto trabajo puedes realizar durante cinco horas. No existe un valor universal de 272k aplicable a todos los modelos Codex, clientes y proveedores personalizados. Usa /status para vigilar el contexto y compacta o traspasa la tarea antes de que la sesión sea demasiado pesada.

4. Límite de security review en GitHub

El mensaje exacto de security review ya aparece en el issue tracker oficial de openai/codex. La evidencia pública confirma el error, pero no demuestra una causa universal ni una solución garantizada. Trátalo como un incidente independiente de revisión en GitHub: recopila pruebas, revisa el estado del servicio y la cuenta, evita disparos automáticos repetidos y escala el PR concreto a soporte.

Cómo funcionan el periodo de cinco horas, el límite semanal y el fondo compartido

Muchas páginas lo llaman “ventana móvil de cinco horas”. La página oficial actual es más precisa: publica estimaciones de mensajes locales por periodo de cinco horas y dirige al Dashboard para conocer el límite y el reinicio reales. No presupongas que se restablece a medianoche, a una hora redonda o en una fecha global; sigue la marca de tiempo de tu cuenta.

Tres detalles explican la mayoría de las diferencias:

  1. La cantidad de mensajes es una estimación, no una promesa. Un cambio pequeño y una ejecución larga con herramientas, contexto amplio y razonamiento alto no consumen lo mismo.
  2. Las tareas locales y en la nube comparten capacidad. Cambiar del CLI a una tarea cloud no crea necesariamente otro fondo.
  3. Puede existir un límite semanal. El periodo de cinco horas puede haberse reiniciado mientras un tope semanal sigue bloqueando el uso incluido.

La frase de búsqueda “Codex, ChatGPT Work, ChatGPT for Excel, and Workspace Agents draw from the same agentic usage and credit pool” resume la idea central, aunque la lista de productos varía según el plan y la disponibilidad. La documentación actual también menciona experiencias agénticas en Word y PowerPoint cuando están disponibles. La lista válida para ti es la que aparece en tus propios Settings.

Estimaciones actuales por modelo para cinco horas

Estos son los rangos oficiales de mensajes locales por periodo de cinco horas, verificados el 18 de septiembre de 2026. No son cuotas garantizadas.

ModeloPlusPro 5×Pro 20×Standard Business
GPT-6 Astra5–4525–225100–9005–45
GPT-5.6 Sol10–10050–500200–2.00010–100
GPT-5.6 Terra25–200125–1.000500–4.00025–200
GPT-5.6 Luna250–2.0001.250–10.0005.000–40.000250–2.000

La amplitud del rango es normal: influyen el tamaño del repositorio, la longitud del prompt, las llamadas a herramientas, el contexto en caché, el nivel de razonamiento y fast mode. Utiliza la tabla para planificar, no para predecir un número exacto de mensajes.

Tarifas de créditos comprados por modelo

Cuando tu plan permite comprar créditos, OpenAI calcula actualmente el consumo agéntico en créditos por un millón de tokens:

ModeloEntradaEntrada en cachéSalida
GPT-6 Astra250251.250
GPT-5.6 Sol10010500
GPT-5.6 Terra505300
GPT-5.6 Luna50,530

Una tarea típica de Codex con GPT-5.6 Sol se estima actualmente en unos 5–30 créditos, aunque el consumo real depende de la tarea. Consulta el Rate Card vigente antes de decidir un presupuesto.

Opción A: seguir con el uso incluido oficial

Elige esta vía cuando la tarea no sea urgente o necesites funciones exclusivas de la nube:

  1. Ejecuta /status y abre el Usage Dashboard.
  2. Comprueba si el bloqueo procede del periodo de cinco horas, de un límite semanal o de créditos agotados.
  3. Espera al reinicio mostrado, compra créditos si tu plan lo permite o cambia de plan cuando tenga sentido económico.
  4. Usa Terra o Luna para tareas rutinarias, reduce el reasoning, limita el alcance y abre una sesión nueva cuando el contexto antiguo ya no aporte valor.
  5. Si el consumo parece incorrecto, guarda el error exacto, la hora, la cuenta, la versión del cliente y el tipo de tarea antes de contactar con soporte.

No vuelvas a enviar sin parar la misma tarea grande. Los reintentos pueden gastar más capacidad sin resolver el límite subyacente.

Opción B: continuar una tarea local urgente con un presupuesto API separado

Si una tarea local de CLI no puede esperar al reinicio, Codex admite proveedores de modelos personalizados. Un proveedor como BetterToken puede conectar el Codex CLI local a un endpoint compatible con OpenAI y cobrar por token.

Se trata de un presupuesto separado, no de un reinicio ni de una forma de eludir derechos. No aumenta la capacidad de la suscripción, no elimina los rate limits de API, no desbloquea funciones del plan y no aporta las capacidades cloud o GitHub que dependan del entorno alojado oficial.

Paso 1: guarda un traspaso limpio

Antes de cambiar de proveedor o abrir una sesión nueva, guarda fuera del chat una nota breve:

Objetivo:
Estado actual:
Archivos ya modificados:
Comandos ya ejecutados:
Errores conocidos:
Siguiente paso mínimo:
No modificar:

Si hay cambios de código sin terminar, conserva el árbol de trabajo o un parche con tu proceso habitual. La idea es reconstruir la tarea sin arrastrar toda la conversación.

Paso 2: localiza CODEX_HOME y comprueba la versión

Codex utiliza ~/.codex por defecto, salvo que hayas definido CODEX_HOME.

macOS o Linux:

export CODEX_HOME="${CODEX_HOME:-$HOME/.codex}"
mkdir -p "$CODEX_HOME"
echo "$CODEX_HOME"
codex --version

PowerShell:

$CodexHome = if ($env:CODEX_HOME) { $env:CODEX_HOME } else { Join-Path $HOME ".codex" }
New-Item -ItemType Directory -Force -Path $CodexHome | Out-Null
$CodexHome
codex --version

Los archivos de perfil con nombre, como bt.config.toml, requieren Codex CLI 0.134.0 o posterior. Actualiza el CLI si utilizas una versión más antigua.

Paso 3: crea un perfil aislado de BetterToken

Crea $CODEX_HOME/bt.config.toml con este contenido:

model = "gpt-6-astra"
model_provider = "bettertoken"

[model_providers.bettertoken]
name = "BetterToken"
base_url = "https://www.bettertoken.ai/v1"
env_key = "BETTERTOKEN_API_KEY"
wire_api = "responses"
requires_openai_auth = false
request_max_retries = 4
stream_max_retries = 8
stream_idle_timeout_ms = 300000
supports_websockets = false

Así mantienes la configuración del proveedor fuera del config.toml principal. No escribas la API key en este archivo ni la subas a un repositorio.

La página de configuración actual de BetterToken también puede mostrar un flujo basado en auth.json. No mezcles ese método con el perfil mediante variable de entorno anterior. Utiliza un método completo y considera la página actual como fuente de verdad si cambian los requisitos de autenticación.

Paso 4: ejecuta una prueba mínima de solo lectura

macOS o Linux:

export BETTERTOKEN_API_KEY="YOUR_API_KEY"
codex exec --profile bt "Lee README.md y resume cuál es su propósito. No modifiques ningún archivo."

PowerShell:

$env:BETTERTOKEN_API_KEY="YOUR_API_KEY"
codex exec --profile bt "Lee README.md y resume cuál es su propósito. No modifiques ningún archivo."

Sustituye YOUR_API_KEY únicamente en tu equipo. Nunca publiques una key real en un ticket, una captura, un chat o un repositorio. Una prueba de solo lectura verifica autenticación, endpoint, acceso al modelo y streaming con poco coste y riesgo.

Paso 5: verifica la facturación antes de reanudar

Confirma que la prueba aparece en la página de uso o saldo del proveedor. Después inicia la tarea real con la nota de traspaso y un primer paso pequeño. Si falla, lee el error exacto antes de cambiar varios ajustes:

  • 401 o 403: key, cuenta, modo de autenticación o permiso del modelo.
  • 404: Base URL, ruta o model ID.
  • 429: límite del proveedor o política de saldo.
  • Timeout de streaming: ruta de red o timeout del proveedor; no aumentes todos los reintentos de golpe.

Cómo consumir menos capacidad de Codex

  • Utiliza GPT-5.6 Terra o Luna para localizar archivos, dar formato, hacer cambios pequeños y ejecutar comprobaciones rutinarias; reserva Astra o Sol para razonamiento más exigente.
  • Pide un cambio verificable cada vez. “Revisa todo y corrige todo” suele consumir más contexto y llamadas a herramientas.
  • Empieza una sesión nueva con una nota de traspaso cuando el diálogo anterior sea principalmente historial.
  • Ejecuta /compact antes de que el contexto sea el cuello de botella y comprueba que el resumen conserve las restricciones importantes.
  • Desactiva servidores MCP que no se utilicen y evita adjuntar registros enormes si no son necesarios.
  • Detente cuando pase la verificación mínima relevante; no ejecutes suites completas no relacionadas.
  • Usa el Usage Dashboard como fuente de verdad en lugar de contar mensajes.

Preguntas frecuentes

¿Cuándo se reinicia el límite de uso de Codex?

No existe una hora universal publicada para todas las cuentas. Ejecuta /status, abre el Usage Dashboard y sigue la marca de tiempo que aparezca. No la deduzcas a partir de medianoche, una captura de otra persona o la fecha de un artículo.

¿“August 14, 2026” significa que Codex se reinicia globalmente ese día?

No. El 14 de agosto de 2026 puede ser la fecha de actualización de un artículo, una hora mostrada en una cuenta o la fecha de un informe. No es una fecha global de reinicio. El Dashboard de tu cuenta es la referencia.

¿Por qué mis límites de Codex son distintos de los de otra persona?

Influyen el plan, el modelo, la complejidad, el contexto, el nivel de razonamiento, fast mode, la combinación local/cloud, el consumo de otros productos agénticos, los créditos comprados y cambios temporales del producto. Una publicación que diga “we’ve investigated a few messages about Codex usage limits being different” puede describir un momento concreto; compárala con los precios oficiales actuales y tu Dashboard.

¿Puedo consultar el límite con /usage?

La referencia oficial actual documenta /status, no /usage. Usa /status para la sesión activa y el Usage Dashboard para la capacidad de cuenta, los créditos y el reinicio.

¿Un error de contexto equivale al límite de uso?

No. El límite de uso controla cuánto trabajo agéntico está incluido o permitido durante un periodo; el contexto controla cuánto material cabe en una solicitud o sesión. Compacta, elimina archivos o abre un chat nuevo. Esperar cinco horas no reduce el historial.

¿Una API key evita los límites de Codex?

No evita ni restablece el límite del plan de ChatGPT. Envía el trabajo local por una ruta API facturada aparte, con su propio saldo, acceso a modelos y límites. Puede mantener en marcha una tarea urgente, pero no es gratuita y puede no admitir funciones alojadas.

Continúa sin perder el estado de la tarea

La secuencia más segura es: comprobar /status → identificar el límite → guardar un traspaso → elegir reinicio/créditos oficiales o un presupuesto API separado → ejecutar una prueba de solo lectura → reanudar con un paso pequeño.

BetterToken resulta útil cuando se agotó la capacidad incluida y el trabajo debe continuar localmente. No es la respuesta a todos los errores. Ante un security review de GitHub, un 429 de API o un contexto excesivo, corrige primero la causa concreta.

Referencias oficiales

¿Quieres optimizar tu flujo de trabajo con LLM?

Conecta modelos mediante una API, gestiona claves y controla el gasto en IA.

Empezar gratis