Resets de Codex: puro marketing para un problema real
OpenAI reinició el uso de Codex cinco veces en diez días mientras Sol agotaba los límites. Creo que las recargas gratis ocultaron el problema real.
En esta página
- ¿Eliminó OpenAI los banked resets? No encontré pruebas
- ¿Por qué reinició OpenAI los límites de Codex? Por el crecimiento de usuarios
- ¿Por qué consumía Sol tan rápido los límites de Codex?
- Cuatro cambios de Codex hicieron más difícil ver el problema
- ¿Puede una cuota de Codex sin cambios comprar menos trabajo? Sí
- ¿Ocultaron los resets el problema de uso de Sol? En la práctica, sí
- ¿Iba dirigida a Claude la campaña de resets? Al principio no
- ¿Qué prueba resolvería el debate sobre el uso de Codex?
GPT-5.6 Sol agotaba los límites de Codex más rápido de lo que OpenAI esperaba [1]. Mientras ocurría, OpenAI reinició los límites de los usuarios de pago cinco veces en diez días. Mi lectura es que aquellos resets fueron puro marketing convertido en cortina de humo, porque interrumpieron las comparaciones semanales necesarias para medir el problema real.
¿Eliminó OpenAI los banked resets? No encontré pruebas
No encontré pruebas de que OpenAI eliminara los banked resets. La afirmación nació de varios mensajes de Reddit sobre resets desaparecidos [2], pero el centro de ayuda de OpenAI sigue explicando cómo canjearlos [3], las condiciones del programa de referidos todavía los contemplan [4] y varios usuarios los recuperaron en pocas horas.
El testimonio que dio pie a este artículo procede de un usuario con dos banked resets que vencían el 12 y el 13 de agosto de 2026. La opción para usarlos había desaparecido de la interfaz, y ni actualizar la aplicación ni cerrar sesión y volver a entrar la recuperó. Una respuesta describía una pérdida mayor, respaldada por una conversación con soporte: «Me quitaron 3. Tenía 2 guardados que caducaban el 11 de agosto y 1 el 12. Incluso contacté a soporte y el agente verificó que no me quedaba ninguno en la cuenta» [5].
Sin embargo, al seguir leyendo el hilo, el patrón se deshace. Otros usuarios todavía conservaban sus resets [6], mientras que algunos podían ver uno, pero recibían un error al intentar aplicarlo [7]. Este último caso es distinto de que se haya retirado la ventaja.
Un usuario aportó la comparación más clara. Perdió el reset en una cuenta, lo recuperó al cerrar sesión y volver a entrar, y después revisó una segunda cuenta. La primera también había recibido un reset global al 100 % ese mismo día, con una nueva fecha semanal, mientras que la cuenta que no había recibido el reset global todavía conservaba su banked reset [8].
Otros usuarios contaron que sus resets volvieron sin hacer nada [9]. Un hilo distinto, publicado cuatro minutos antes que el principal, describe un panel incapaz de cargar los créditos en lugar de un saldo de cero [10].
Todo ocurrió en unas tres horas. La retirada deliberada de una ventaja de pago no suele revertirse sola en algunas cuentas mientras un agente de soporte le dice a otro cliente, según la frase citada por un usuario, «no podemos revelar por qué añadimos o retiramos resets» [11].
La otra explicación popular tampoco encaja con los horarios. La página de estado de OpenAI registra una incidencia de ChatGPT esa mañana, titulada «Increased errors for some ChatGPT users», que comenzó a las 07:21 UTC y se resolvió a las 08:09 UTC [12]. El primer aviso sobre los resets apareció a las 08:44 UTC [10], unos 35 minutos después de que la incidencia constara como resuelta, y siguieron llegando testimonios después de las 11:00. El aviso se cerró antes de que empezaran los mensajes y nunca menciona resets ni límites de uso.
Una entrada en el changelog, un cambio en el centro de ayuda o el aviso de 30 días prometido en las condiciones del programa de referidos cambiarían esta conclusión [4]. Hasta que aparezca alguno, la descripción más precisa es un fallo del producto, no una retirada confirmada.
¿Por qué reinició OpenAI los límites de Codex? Por el crecimiento de usuarios
OpenAI vinculó los resets de Codex directamente a los hitos de crecimiento de usuarios. Por eso los considero una maniobra de marketing.
El 7 de abril de 2026, Sam Altman escribió: «Para celebrar los 3 millones de usuarios semanales de Codex, estamos reiniciando los límites de uso. Lo haremos con cada millón de usuarios hasta llegar a 10 millones» [13]. Dos días después, Tibo ya trataba aquella promesa como un gasto recurrente: «Al ritmo actual de crecimiento de Codex, en menos de dos semanas les vamos a deber otro reset a todos» [14]. El reset por alcanzar los cuatro millones llegó el 21 de abril de 2026 [15].
La posibilidad de guardar resets llegó el 11 de junio de 2026, y el changelog de OpenAI la describe como captación de usuarios sin muchos adornos: «Se añade la acumulación de reinicios de límite de uso para usuarios Plus y Pro, con un reset gratuito en el lanzamiento e invitaciones de referidos para conseguir más durante la promoción actual» [16]. La oferta estuvo activa del 11 al 24 de junio y premiaba a las dos partes. La página de precios de OpenAI explica que, cuando la persona invitada envía su primer mensaje en Codex, ambas cuentas reciben un banked reset [17]. OpenAI compraba nuevos usuarios con capacidad de cómputo en lugar de descuentos, una fórmula más barata para una empresa que controla esa capacidad y que parece más generosa que un cupón.
Después llegó julio de 2026. OpenAI lanzó GPT-5.6 el 9 de julio, con Sol como modelo principal [18], y ChatGPT Work apareció al mismo tiempo. El contador avanzó lo bastante rápido para activar cinco resets en diez días: seis millones el 12 de julio [19], siete millones el 13 [20], ocho millones el 14 [21], nueve millones el 16 [22] y diez millones el 21 [23].
Hay un detalle importante en esa secuencia. A partir de los seis millones, la cifra cuenta Codex y ChatGPT Work juntos. ChatGPT Work solo llevaba tres días disponible cuando se publicó el mensaje de los seis millones, así que el recuento usado para justificar cada reset ya incluía algo distinto.
El orden importa: primero OpenAI prometió recompensas por crecer, después lanzó un modelo que consumía más y solo admitió el problema de uso cuando ya había entregado el reset de los diez millones.
-
La promesa
Altman: un reset de uso por cada millón de usuarios de Codex, hasta diez millones.
-
Resets acumulables
Los banked resets llegan como recompensa por referidos para Plus y Pro.
-
GPT-5.6 Sol
Sol pasa a ser el modelo principal dentro de Codex.
-
Cinco resets en diez días
Cae el límite de cinco horas y llegan los hitos de seis a diez millones.
-
La admisión
Sol gastaba los límites más rápido de lo esperado; el uso durará un 18 % más.
-
Fallan los banked resets
Muchos usuarios se quedan sin resets y algunos los recuperan en pocas horas.
¿Por qué consumía Sol tan rápido los límites de Codex?
Sol consumía los límites más rápido porque una tarea cuesta más cuando el modelo hace más trabajo, aunque el precio por token no cambie.
Sol y GPT-5.5 cobran exactamente los mismos créditos por token [17], así que pasar a Sol parece gratis en la tarifa. Sin embargo, Sol puede trabajar durante más tiempo, llamar a más herramientas y leer una parte mayor del repositorio, y cada uno de esos turnos se cobra.
Thibault Sottiaux confirmó el efecto el 29 de julio de 2026: «En las últimas semanas, muchos de ustedes nos han dicho que Sol estaba gastando sus límites de Codex más rápido de lo esperado». También reconoció que «algunos problemas solo se ven cuando la gente usa el modelo a escala real. Deberíamos haberlo detectado antes y haber sido más claros al respecto» [1].
La tarifa explica por qué los usuarios no podían preverlo a partir de la lista de precios. Sol y GPT-5.5 cuestan 125 créditos por millón de tokens de entrada, 12,5 por la entrada en caché y 750 por la salida [17]. Esa misma página indica que el modelo, el contexto, el razonamiento, las herramientas, la recuperación de información y la caché afectan al consumo, así que la longitud del prompt no permite calcularlo con fiabilidad. También advierte que tareas parecidas pueden gastar cantidades distintas de la cuota [17]. El promedio que ofrece OpenAI para un solo mensaje con GPT-5.6 abarca casi un orden de magnitud, entre 5 y 40 créditos [17].
El comportamiento de Sol cae en el extremo caro de ese intervalo, algo que yo ya había observado. En un artículo anterior sobre la sobreingeniería de Sol describí un modelo que sigue trabajando después de resolver la tarea y que además delega en subagentes. La propia documentación de OpenAI advierte del coste: «Los flujos con subagentes consumen más tokens que las ejecuciones equivalentes con un solo agente» [24]. Si un modelo hace más trabajo por instrucción, cada instrucción cuesta más, aunque el precio por token no cambie.
Cuatro cambios de Codex hicieron más difícil ver el problema
Alrededor del lanzamiento de Sol llegaron cuatro cambios que, combinados, hicieron más difícil reconocer el problema: desapareció el límite de cinco horas, se redujo la ventana de contexto, la tarifa no cambió y el recuento de usuarios pasó a incluir otro producto.
Desapareció el límite de cinco horas
Tres días después del lanzamiento de Sol, Tibo anunció junto al hito de los seis millones: «Retiramos temporalmente la restricción del límite de uso de 5 horas para todos los planes Plus, Business y Pro» [19]. Esa ventana impide que una cuota semanal se agote en una tarde. Quitarla durante la semana del lanzamiento hizo que el producto pareciera no tener restricciones, pero también permitió que un modelo con mayor consumo por tarea vaciara mucho antes el saldo semanal. El 14 de julio de 2026, Tibo todavía lo presentaba como una ventaja y decía a los usuarios que podían «explorar los límites de GPT-5.6 Sol y descubrir lo ambiciosos que pueden ser» [21].
Sottiaux anunció el 29 de julio de 2026 que el límite volvería, pero después aplazó el cambio. Finalmente regresó para Plus el 26 de agosto, mientras que los planes Pro de 100 y 200 dólares siguieron exentos [1] [37]. El 27 de agosto de 2026, la página de precios de OpenAI documentaba la ventana de cinco horas con una reserva sobre la semanal: «Los límites de uso de los mensajes locales y de los chats en la nube comparten una ventana de cinco horas. Pueden aplicarse límites semanales adicionales» [17].
La ventana de contexto de Sol en Codex perdió 100.000 tokens
El anuncio de OpenAI hizo que la reducción fuera especialmente fácil de pasar por alto. El 13 de julio de 2026, Tibo abrió una actualización dirigida a los usuarios de Codex y ChatGPT Work con «Nada de nerfeos, solo cosas buenas». Después explicó que OpenAI había revertido el límite de contexto de Sol de 372.000 a 272.000 tokens porque la ventana mayor cobraba más uso de lo previsto [25].
Una incidencia de GitHub abierta el 21 de julio de 2026 compara las cifras efectivas: 353.400 tokens utilizables en el lanzamiento y 258.400 después del cambio en el perfil del servidor [26]. Son 95.000 tokens utilizables menos, alrededor de un 27 %. El changelog de OpenAI registró los 272.000 como corrección el 18 de julio de 2026 [16], la vuelta prometida no se había producido el 1 de septiembre de 2026 y el mismo modelo todavía aceptaba 1.050.000 tokens por la API [27].
Menos contexto no es solo una cifra menor en una ficha técnica. Una ventana más corta hace que un hilo largo de Codex se compacte antes, de modo que el modelo vuelve a leer archivos y a reconstruir decisiones, y cada turno se cobra. En la práctica, una ventana menor puede reducir el consumo de una conversación mientras aumenta el número de conversaciones necesarias para completar un trabajo grande.
La tarifa y el recuento de usuarios no mostraban el cambio
La tarifa no se movió, mientras que la cifra de crecimiento empezó a sumar dos productos justo cuando se aceleraron los resets. Ninguno de los dos cambios resulta sospechoso por sí solo. Sin embargo, junto con la desaparición del límite de cinco horas y la ventana de contexto más pequeña, dejaron a los usuarios ante un panel de uso, una lista de precios y unas publicaciones por hitos que no mostraban cuánto trabajo consumía cada tarea.
- más de duración típica con Sol
- 18 %
- previsión de OpenAI tras las correcciones de julio
- tokens de contexto en Codex
- 272.000
- bajó desde 372.000 el 13 de julio
- tokens de contexto por la API
- 1.050.000
- mismo modelo, producto distinto
- créditos por mensaje
- 5-40
- intervalo medio publicado por OpenAI para GPT-5.6
La diferencia importante está entre el modelo de la API y el producto por suscripción. Codex ofrece al mismo modelo alrededor de una cuarta parte del contexto disponible por API y descuenta su consumo de una cuota cuyo coste medio OpenAI solo puede expresar como un intervalo de 5 a 40 créditos por mensaje.
¿Puede una cuota de Codex sin cambios comprar menos trabajo? Sí
Sí. OpenAI mantuvo el tamaño de la cuota, pero Sol consumía más por tarea, así que esa misma cuota podía comprar menos trabajo terminado.
El 30 de julio de 2026, la empresa escribió que «los precios de suscripción y los presupuestos de cuota de ChatGPT y Codex no cambian» [28]. Tibo había sido aún más directo el día anterior: «no hemos reducido el uso en ningún plan de suscripción» [1]. Ambas frases describen el tamaño de la cuota, no lo que permite hacer.
La estimación del 18 % de OpenAI resuelve esa cuestión más concreta. En la misma publicación del 29 de julio, Tibo escribió: «esperamos que su uso dure alrededor de un 18 % más en el trabajo normal con Sol» [1]. Si unas correcciones hacen que un presupuesto sin cambios dure un 18 % más, ese mismo presupuesto permitía completar menos trabajo antes. OpenAI no redujo la cuota, pero los usuarios podían hacer menos trabajo con ella.
Un ejemplo sencillo muestra el efecto. Supón que una cuota semanal cubre 100 tareas con GPT-5.5 y que la misma tarea consume un 50 % más de créditos con Sol. La cuota pasa a cubrir unas 67 tareas, y una mejora del 18 % eleva la cifra a unas 79. Los números son inventados, pero la proporción explica por qué «no hemos reducido tu cuota» y «termino menos trabajo por semana» pueden ser ciertas al mismo tiempo.
OpenAI publicó otros dos porcentajes que responden a una pregunta distinta. La empresa dijo que el trabajo del propio Sol sobre los kernels redujo un 20 % el coste total de servir el modelo, mientras que sus experimentos aumentaron más de un 15 % la eficiencia de generación de tokens [28]. Esas cifras describen los costes de OpenAI, no la cuota del usuario.
El mismo anuncio sí trasladó ahorros a los clientes al reducir un 80 % el precio de la API de Luna y un 20 % el de Terra, además de hacer que ambos modelos consumieran menos créditos en Codex. El precio de Sol no cambió [28]. Solo la estimación del 18 % describe cuánto más debía durar la cuota de quien usaba Sol.
¿Ocultaron los resets el problema de uso de Sol? En la práctica, sí
En la práctica, sí. Un reset repone la cuota, pero también borra el registro semanal necesario para comparar Sol con GPT-5.5. La comparación requiere un inicio conocido, una sola versión del modelo, un nivel de esfuerzo estable y ninguna recarga intermedia. Entre el 12 y el 21 de julio de 2026, cinco resets hicieron casi imposible obtener ese registro.
Por eso resulta tan insatisfactorio leer los testimonios de Reddit de aquellas semanas. Los hilos mezclan «quemé el 40 % en tres horas» con «gasté el 2 % en todo el día», sin nada que permita comparar los casos: distintas versiones del modelo, distintos niveles de esfuerzo, repositorios y estados de caché diferentes, además de resets en medio de muchas mediciones. Los testimonios coincidieron lo suficiente para que OpenAI actuara [1], pero nunca permitieron calcular con precisión qué había cambiado. Los resets explican buena parte de esa falta de datos comparables.
Los resets también crearon un motivo para acelerar el consumo. Si se anuncia un reset global para más tarde ese mismo día, gastar el saldo restante se convierte en la decisión racional, y la campaña convirtió esa situación en algo habitual. Ese aumento repentino de actividad sirve a una campaña de crecimiento, pero produce malos datos para quien intenta observar su consumo normal.
Los dos tipos de reset tampoco tienen el mismo valor, y ahí nace la preocupación del 10 de agosto de 2026. OpenAI aplica un reset global a todas las cuentas que cumplen los requisitos en el momento que la empresa elige, así que su valor depende de cuánto haya gastado ya cada usuario. En cambio, el usuario decide cuándo canjear un banked reset. Por eso es más valioso y también puede desperdiciarse. Un usuario describió exactamente ese caso: estaba al 10 %, con el reset semanal previsto para el 11 de agosto, canjeó su último banked reset, OpenAI reinició a todo el mundo ese mismo día y su siguiente reset semanal pasó al 15 de agosto [29].
| Propiedad | Reset global | Banked reset |
|---|---|---|
| Quién lo activa | OpenAI | Tú |
| Cuándo ocurre | Se anuncia con minutos u horas de antelación | Cuando tú decidas |
| Caduca si no se usa | No corresponde | 30 días desde su concesión |
| Mueve la fecha del reset semanal unos siete días | No documentado | Sí |
| El otro tipo puede dejarlo sin valor | No | Sí |
Un banked reset resulta más útil porque tú controlas cuándo se aplica. Un reset global puede eliminar esa ventaja unas horas después, cuando el banked reset ya ha desplazado la fecha del siguiente reinicio semanal.
¿Iba dirigida a Claude la campaña de resets? Al principio no
Al principio no. El calendario siguió los hitos de OpenAI y comenzó dos meses antes de Claude Fable 5, así que la campaña no nació como respuesta a Anthropic. La competencia apareció más tarde en el lanzamiento de Sol y en un reset anunciado durante una discusión pública con el equipo de Claude.
La coincidencia más tentadora no se sostiene. Anthropic lanzó Fable 5 el 9 de junio de 2026 [30] y OpenAI publicó la función para guardar resets el 11 de junio, dos días después [16]. Nadie diseña y construye un programa de referidos en 48 horas. Al día siguiente, Anthropic suspendió el acceso a Fable 5 por una directiva estadounidense de control de exportaciones. El modelo volvió a estar disponible en todo el mundo el 1 de julio, y hasta el 7 de julio su uso podía consumir hasta la mitad de los límites semanales de los planes Pro, Max, Team y algunos Enterprise [31]. La campaña de resets funcionó antes, durante y después de esos acontecimientos.
OpenAI dejó clara la competencia en la página de lanzamiento de Sol. Claude Fable 5 aparece por su nombre en varias tablas, y el texto destaca un resultado: «GPT-5.6 Sol con razonamiento máximo marca un nuevo récord con 80, 2,8 puntos por encima de Fable 5, usando menos de la mitad de tokens de salida, tardando menos de la mitad de tiempo y costando alrededor de un tercio menos» [18]. La misma página incluye un resultado que no comenta en el texto: SWE-Bench Pro sitúa a Fable 5 en el 80,0 % y a Sol en el 64,6 % [18]. Elegir qué benchmark encabeza un lanzamiento es normal. El lector solo necesita saber qué resultado produjo el titular.
El reset del 8 de agosto de 2026 es el ejemplo más claro de un gesto competitivo. Un usuario afirmó que Anthropic había suspendido su cuenta por ejecutar Sol dentro de Claude Code. Boris Cherny, de Anthropic, respondió que no bloquean cuentas por usar su harness con otros modelos y aprovechó para lanzarle a Tibo una oferta de trabajo [32].
Tibo respondió citando aquel mensaje y reiniciando el uso de todo el mundo: «Efectivamente, GPT-5.6 Sol es magnífico y se puede usar prácticamente en cualquier parte, incluido el harness de CC. Para celebrarlo, junto con el hecho de que no me voy a ninguna parte… he reiniciado los límites de uso de todos los usuarios de pago de ChatGPT Work y Codex» [33]. Minutos después, un usuario le dijo que el gesto estaba vacío porque su reset semanal ya había ocurrido el día anterior: «A estas alturas esto es puro teatro» [34]. Tibo adoptó la palabra y prometió: «El lunes haré otro reset teatral» [35]. Cuando quien dirige la campaña adopta el término de su crítico, la cuestión del marketing queda resuelta.
Anthropic nunca respondió públicamente a la comparación. Sí aumentó un 50 % los límites semanales de Claude Code desde el 18 de julio hasta el 19 de agosto de 2026, sin mencionar a OpenAI [36].
¿Qué prueba resolvería el debate sobre el uso de Codex?
Lo resolvería una comparación limpia: un plan, una versión del modelo, un nivel de esfuerzo, un repositorio y las mismas tareas durante dos semanas completas, sin resets en ninguna. Nadie ha publicado esa prueba. Hasta que alguien lo haga, las cuotas de OpenAI y los testimonios de los usuarios pueden ser ciertos a la vez, porque miden cantidades distintas.
Mi lectura sigue siendo que la maniobra terminó funcionando como una cortina de humo, fuera cual fuera la intención de OpenAI. Codex pasó de tres a diez millones de usuarios en 15 semanas, las quejas más fuertes sobre el consumo recibieron recargas gratuitas en lugar de cifras comparables y nunca existió la semana limpia de datos que habría resuelto el debate.
La medida práctica es sencilla. Haz una captura del panel de uso que incluya el número de resets y su fecha de caducidad, porque ese panel controlado por el servidor es el único registro que tienes. No canjees un banked reset el mismo día que OpenAI anuncie uno global. El centro de ayuda explica que usar un banked reset completo desplaza la fecha del reset semanal hasta unos siete días después del canje [3], así que gastarlo poco antes de una recarga gratuita te hace perder el control sobre cuándo usarlo, que era precisamente lo que le daba valor.
Fuentes
- On Sol using Codex limits faster than expected
- Open AI removes banked usage resets from Codex
- Using Codex with your ChatGPT plan
- ChatGPT Desktop Referral Promotions
- Comment reporting three removed banked resets and a support check
- Comment reporting an intact banked reset
- Confirmed reset bug
- Comment comparing a globally reset account with a second account
- Comment reporting both banked resets returning unprompted
- Banked usage limit reset credits not showing on ChatGPT web or desktop
- Comment quoting an OpenAI support reply
- Increased errors for some ChatGPT users
- On resetting usage limits at three million weekly Codex users
- On owing users another reset at the current growth pace
- On four million Codex users and another rate limit reset
- ChatGPT & Codex changelog
- Pricing
- GPT-5.6: Frontier intelligence that scales with your ambition
- On six million users and temporarily removing the five hour limit
- On seven million users and a banked reset for everyone
- On eight million users and another reset
- On nine million users and another reset
- On ten million users and another reset
- Subagents
- On reverting the Sol context size limit to 272k
- Restore GPT-5.6 Sol's 372k Codex context window, or provide an opt-in setting
- GPT-5.6 Sol
- Advancing the price-performance frontier with GPT-5.6
- OpenAI Screwed me on my resets
- Claude Fable 5 and Claude Mythos 5
- Redeploying Claude Fable 5
- On bans, harnesses and hiring
- On Sol in the Claude Code harness and a reset for all paid users
- On the reset being performative
- On doing another performative reset on Monday
- On keeping Claude Code weekly limits 50% higher
- On restoring the five-hour limit for Plus accounts