La comprobación más rápida está en el panel de uso de Codex. Si ya estás trabajando en la CLI, ejecuta /status para ver la configuración de la sesión, el contexto y la información de rate limits disponible en ese cliente. Esos dos pasos son más fiables que calcular mensajes de memoria.
El orden de consumo es: uso incluido del plan → créditos disponibles después del límite aplicable → facturación independiente si usas API key. Comprar créditos no pone a cero el contador semanal ni cambia su fecha de restablecimiento.
Un aviso de límite puede referirse al periodo compartido de cinco horas, a una asignación semanal adicional, a los créditos disponibles, a la velocidad permitida por la API, al gasto de la organización o al contexto de la conversación. No son nombres distintos para una misma cuota: tienen propietarios y soluciones diferentes.
La respuesta corta: identifica primero el medidor
Antes de cambiar de plan, copia el mensaje exacto que aparece en Codex y localiza su evidencia.
| Medidor | Evidencia que debes buscar | No lo confundas con |
|---|---|---|
| Periodo de cinco horas | Porcentaje restante y hora de restablecimiento en el panel | Contexto restante de la sesión |
| Límite semanal | Indicador semanal y su propia fecha de restablecimiento | Una segunda fase que empiece al agotar las cinco horas |
| Créditos | Saldo y opción ofrecida a tu cuenta o espacio de trabajo | Saldo de OpenAI Platform |
| API rate limit | RPM, TPM u otro límite del proyecto/organización | Asignación incluida en ChatGPT |
| Gasto de API | Uso y facturación de OpenAI Platform | Créditos comprados para Codex |
| Contexto | Tokens, historial, archivos y resultados de herramientas de la sesión | Mensajes que aún incluye el plan |
Una frase como «me quedan pocos tokens» no permite decidir nada. «Tengo libre el periodo corto, pero el semanal está agotado» o «la API rechaza por TPM» sí conduce a una acción concreta.
Una comprobación práctica en 90 segundos
- Abre el panel con la misma cuenta y el mismo espacio de trabajo que usa Codex.
- Anota el periodo mostrado, el porcentaje restante y la hora de restablecimiento.
- En la sesión activa, ejecuta
/statusy mira modelo, contexto y vista de límites. - Si tu versión ofrece
/usage, úsalo para actividad de cuenta o acciones de restablecimiento disponibles; no lo trates como sinónimo exacto de/status. - Si has iniciado Codex con API key, sal del panel de suscripción y comprueba límites y facturación en OpenAI Platform.
La interfaz puede cambiar. Si un enlace antiguo de analytics ya no funciona, vuelve a la documentación oficial de precios y uso, que enlaza la superficie vigente. Si una tabla pública y el panel autenticado no coinciden, manda el panel: conoce tu contrato, región, espacio de trabajo y posibles promociones.
El periodo local y cloud no son dos bolsas
Según la documentación oficial comprobada el 4 de agosto de 2026, los mensajes locales y los chats o tareas cloud de Codex comparten el mismo periodo de cinco horas. Abrir una tarea en la nube después de trabajar en la CLI no crea una segunda asignación corta.
Eso no significa que ambas tareas consuman igual. Una corrección local de un archivo conocido puede necesitar pocas lecturas y una prueba. Una tarea cloud delegada puede explorar el repositorio, utilizar herramientas, ejecutar varios comandos y producir una salida larga. Comparten el medidor, pero cada trabajo ejerce una presión distinta.
También pueden aplicarse límites semanales. Las cinco horas y la semana se evalúan como periodos distintos; al restablecerse el periodo corto no se recupera necesariamente la semana. Por eso es posible tener margen en uno y seguir bloqueado por el otro.
Para una decisión específica de Plus, la guía sobre límite semanal y créditos de Codex Plus entra en más detalle. Los usuarios Pro tienen una página separada para comprobar el límite de Codex Pro.
Un rango de mensajes no es una factura de créditos
La tabla del plan muestra rangos como local messages / 5h; la tabla de créditos mide tokens de entrada, entrada en caché y salida. La primera describe el margen incluido y la segunda el coste de continuar después del límite. No existe una conversión fija de «un mensaje» a créditos: una tarea puede tocar un archivo conocido y otra explorar un monorepo, invocar herramientas y devolver una salida extensa.
Usa el panel autenticado para saber si puedes continuar y la tabla de tarifas vigente para entender el descuento de créditos. Los modelos y los rangos cambian, por eso este artículo no congela la tabla completa.

Por qué dos mensajes consumen cantidades distintas
Codex procesa más que el texto visible del prompt. El uso puede incluir instrucciones, historial, archivos, resultados de herramientas, retrieval, razonamiento, caché y respuesta. Cinco variables explican buena parte de las diferencias.
Alcance de la tarea
Corrige el enlace roto en este componente y ejecuta su prueba tiene un límite observable. Revisa toda la aplicación, encuentra problemas y mejórala obliga al agente a descubrir el alcance mientras trabaja. Cuanta más incertidumbre, más lecturas, herramientas y ciclos de corrección.
Modelo y configuración
Los modelos no consumen la misma cantidad. Una variante mini puede ampliar el uso para tareas rutinarias, pero no conviene reducir capacidad si el cambio afecta seguridad, datos o una migración difícil de revertir. Las configuraciones de mayor velocidad también pueden gastar créditos más deprisa.
Contexto acumulado
AGENTS.md, conversaciones largas, logs completos y archivos no relacionados viajan con los turnos posteriores. El porcentaje de contexto describe la capacidad de esa sesión; no es el porcentaje semanal ni una factura.
Herramientas y MCP
Cada servidor añade definiciones y puede devolver resultados voluminosos. Desactiva MCP que no necesites para la tarea, pero conserva los que proporcionan la evidencia o el control imprescindible.
Local frente a cloud
La superficie cambia el patrón de trabajo, no el propietario del periodo corto. Una tarea cloud larga suele completar más pasos que una edición local dirigida. Elegir local solo para «ahorrar» no tiene sentido si el trabajo necesita un entorno alojado; la decisión debe seguir la necesidad real.
Si el problema real es medir tokens, historial o context remaining, continúa por la guía de uso de tokens en Codex. No utilices esa medición para adivinar la asignación del plan.
Plan, créditos y API: tres contratos
El uso incluido es la capa que acompaña al plan de ChatGPT. Cuando llega al límite, algunas cuentas Plus y Pro pueden comprar créditos; los espacios Business, Edu o Enterprise con precios flexibles pueden añadir créditos del área de trabajo. La opción exacta aparece en el panel o en el aviso de tu cuenta.
Cómo se calculan los créditos
En la tabla basada en tokens, la fórmula es:
créditos = entrada / 1.000.000 × tarifa de entrada + entrada en caché / 1.000.000 × tarifa de caché + salida / 1.000.000 × tarifa de salida.
El 4 de agosto de 2026, GPT-5.4 mini figuraba con 18,75 créditos por millón de tokens de entrada, 1,875 por entrada en caché y 113 por salida. Un trabajo con 100.000 de entrada, 400.000 en caché y 20.000 de salida da 1,875 + 0,75 + 2,26 = 4,885 créditos, unos 4,89. Es un ejemplo de lectura; mandan la tarifa y el panel actuales.

Dónde comprar y qué revisar antes
Las cuentas Plus/Pro elegibles pueden comprar en la web o en la aplicación: Codex Settings > Usage > Credits. Algunas pueden activar auto top-up. Cuando el saldo baja del mínimo elegido, el método de pago predeterminado compra solo lo necesario para volver al objetivo; si ya está por debajo al activarlo, puede producirse una compra inmediata.
Antes de pagar, confirma que el bloqueo es del uso incluido y no del contexto o de un 429 de API, que el control pertenece a la cuenta o workspace correcto y que otras funciones agentic compatibles no vayan a consumir el mismo saldo. Los créditos comprados duran 12 meses, no se acumulan tras caducar y, salvo obligación legal, no son reembolsables ni transferibles.
Los créditos de Codex extienden usos compatibles, pero no son dinero de OpenAI Platform. Tampoco cambian automáticamente RPM o TPM. En el lado API hay dos controles independientes:
- API rate limits: velocidad permitida al proyecto u organización, como solicitudes o tokens por minuto.
- Gasto de API: consumo monetario calculado según tokens y modelos, visible en la facturación de Platform.
Una suscripción a ChatGPT no concede por sí sola pertenencia, API keys, presupuesto ni acceso a modelos de una organización de Platform. La comparación correcta está en Codex con API key frente a suscripción; los errores RPM/TPM pertenecen a la guía de límites de la API de OpenAI.
La ruta API Key permite trabajo local en CLI, SDK e IDE y factura a tarifas API. No incluye las funciones cloud de Codex como GitHub review o Slack. No es un truco para reiniciar la suscripción, sino un contrato deliberadamente distinto.
Qué ocurre si el límite llega durante un turno
OpenAI indica que el agente puede terminar el turno activo, sujeto a límites de uso justo. Puede no significa que cualquier ejecución larga tenga garantizado el final. Cuando termine o se detenga, vuelve al panel antes de reintentar: una repetición idéntica puede consumir otra vez contexto y herramientas sin resolver el medidor que bloquea.
La revisión de código tiene otra frontera fácil de pasar por alto. Las reviews automáticas o iniciadas desde GitHub utilizan el medidor Code Review. Una revisión ejecutada localmente o fuera de GitHub cuenta contra el uso general. Llamar review a un prompt local no lo mueve a la cuota de GitHub.
Un caso trabajado: aislar una sola causa
Imagina que un refactor de front-end consume mucho más de lo esperado. Antes de repetirlo, registra:
- modelo y configuración de velocidad;
- local o cloud;
- porcentaje de cinco horas y de semana;
- contexto ocupado;
- MCP activos;
- archivos y comprobación solicitados.
Primera prueba: pide cambiar un único componente y ejecutar una prueba concreta. Mide antes y después. En la segunda prueba modifica solo una variable: utiliza un modelo más pequeño, inicia una sesión limpia o desactiva un MCP que no intervenga. Mantén el mismo alcance y criterio de aceptación.
Si cambias modelo, contexto, herramientas y superficie a la vez, cualquier ahorro carece de atribución. La observación de una variable no proporciona una fórmula universal, pero sí un baseline útil para tu repositorio y tu forma de trabajar.
Repite la medición tras actualizaciones importantes. El caching, las herramientas y los modelos evolucionan; un resultado del mes pasado no es una promesa de consumo futuro.
Orden seguro después de alcanzar el límite
- Confirma qué periodo o contrato bloquea. No compres capacidad con un diagnóstico incompleto.
- Espera al restablecimiento cuando el trabajo no sea urgente y el panel muestre una hora cercana.
- Reduce el alcance del siguiente turno: rutas exactas, criterio de salida y una prueba suficiente.
- Limpia contexto no relacionado: sesión nueva para otra tarea, instrucciones más acotadas y menos logs.
- Desactiva MCP innecesarios y selecciona una variante menor cuando el riesgo lo permita.
- Usa créditos solo si la cuenta los ofrece y entiendes qué función los consume.
- Cambia de plan si un workflow repetible y medido supera la asignación de forma sostenida.
- Usa API key únicamente cuando aceptes facturación, rate limits, permisos y ausencia de funciones cloud como un contrato separado.
No compartas cuentas para mezclar asignaciones, no compres credenciales revendidas y no intentes eludir controles con endpoints internos. Además de incumplir políticas y poner la cuenta en riesgo, esas prácticas eliminan la atribución: ya no puedes saber qué persona o tarea movió el contador.
La regla que evita casi todos los diagnósticos falsos
El panel autenticado decide cuánto uso de cuenta queda. /status explica la sesión activa y su contexto. Los créditos pertenecen a usos Codex compatibles. Los límites y la facturación de Platform gobiernan la API. El medidor de Code Review solo cubre el flujo de GitHub correspondiente.
Separar esas superficies evita tres compras equivocadas: subir de plan para resolver un contexto saturado, comprar créditos cuando el problema es TPM o usar API key pensando que conserva las funciones cloud. Primero nombra el medidor, después cambia una sola variable y solo al final modifica el contrato.



