La cantidad de mensajes rara vez mide con precisión el consumo de tokens. Una petición como “corrige este error” puede resolverse cambiando una línea o desencadenar una exploración extensa del repositorio, varias rondas de depuración y una salida voluminosa. La guía de precios y uso de OpenAI señala que los modelos, el tamaño del contexto, los tokens de razonamiento, las llamadas a herramientas, la búsqueda de código y la caché contribuyen al consumo. El texto que escribes es solo el punto de partida.
Revisa el historial para detectar trabajo evitable
Revisa una tarea reciente en la que alcanzaste un límite de Codex. ¿El agente volvió a leer los mismos archivos grandes? ¿Los comandos de shell volcaron registros completos en el contexto? ¿Se amplió el alcance durante el trabajo? Revisar estos patrones ayuda a identificar trabajo evitable.
Una instrucción amplia como “arregla los errores de inicio de sesión y moderniza el código” no tiene límites definidos. En su lugar, concreta los objetivos:
- Reproducir el fallo al enviar un formulario de inicio de sesión vacío y aislar la condición.
- Corregir el controlador afectado y ejecutar las pruebas unitarias.
- Informar de otros problemas encontrados sin hacer cambios no solicitados.
Los objetivos y criterios de finalización claros ayudan a evitar tareas ajenas, pero no garantizan una reducción fija de consumo.
Esfuerzo de razonamiento, subagentes en paralelo y modo Fast
La documentación de subagentes describe llamadas independientes a modelos y herramientas; un mayor esfuerzo de razonamiento también aumenta el uso de tokens. El trabajo en paralelo puede reducir la espera, pero el número de agentes no determina un multiplicador fijo de cuota ni un porcentaje de ahorro.
Las tareas habituales, como pequeños cambios de documentación, rara vez necesitan razonamiento máximo o varios subagentes. Reserva el razonamiento intensivo para diagnósticos difíciles de causas raíz y asigna a los subagentes directorios claramente delimitados.
Comprueba también el modo Fast. La documentación de velocidad de OpenAI indica que reduce la latencia a cambio de más créditos; puedes consultarlo en la CLI con /fast status. Úsalo para plazos críticos y desactívalo cuando la velocidad normal sea suficiente.
Al alcanzar el límite: esperar el reinicio de Codex o añadir créditos
Si solo faltan pequeños retoques, guarda los cambios, documenta las tareas pendientes y espera al reinicio programado. Si tienes un plazo inaplazable, define el siguiente paso mínimo viable antes de considerar créditos adicionales en el panel. La guía oficial de precios explica qué créditos permiten ampliar el uso más allá de los límites habituales.
Cambiar a una clave de API es una vía de facturación alternativa, no un botón para reiniciar la cuota de suscripción. La documentación de autenticación confirma que la API se factura por consumo. Ni abrir un hilo ni cambiar los checkpoints del modelo reinicia una cuota agotada de Codex.
Ten a mano tu hora de reinicio.
Introduce la hora que muestra tu cuenta. Todo permanece en este navegador.
Tu reloj de reinicio →