Astra es real. GPT-6 no llega esta semana
OpenAI confirmó que Astra es su próximo gran modelo y luego frenó parte del trabajo por riesgo cibernético. Cuento cómo una broma se volvió el rumor de GPT-6.
Astra existe, y la propia OpenAI lo llama «nuestro próximo gran modelo» [1]. Lo que no existe es un anuncio de GPT-6, ni una fecha de lanzamiento, ni ningún «esta semana» oficial. Esas partes de la historia salen de una filtración retirada al día siguiente de publicarse y de un rótulo que un desconocido añadió sobre una broma del jefe de Codex.
Escribo esto el 17 de agosto de 2026, algo más de cinco semanas después de que GPT-5.6 llegara a disponibilidad general el 9 de julio [2]. El rumor merece un desmontaje en vez de un simple encogimiento de hombros, porque la mitad confirmada de la historia es fuera de lo común: el 7 de agosto OpenAI dijo que ya no puede descartar que Astra haya alcanzado el nivel de riesgo cibernético más alto de su propio marco de seguridad, y pausó el trabajo interno con Astra que no cumple sus controles recién endurecidos [3].
¿Qué ha confirmado OpenAI realmente sobre Astra?
Tres cosas, con sus propias palabras: Astra es real y es «nuestro próximo gran modelo»; una versión interna suya produjo los resultados matemáticos que OpenAI publicó el 1 de agosto [1]; y sus evaluaciones internas recientes muestran «avances significativos en programación agéntica y ciberseguridad» [3]. Casi todos los demás detalles en circulación vienen de sitios menos oficiales.
En realidad, el nombre apareció antes en la prensa. The Information contó el 31 de julio, citando a tres personas al tanto de los planes, que OpenAI preparaba una nueva familia de modelos «que usa provisionalmente el nombre Astra», con mejores capacidades en tareas de larga duración, y que Sam Altman la había estado demostrando ante políticos y reguladores en Washington, con varios agentes trabajando juntos [4].
La confirmación de la propia OpenAI llegó un día después, y no fue una página de producto. La empresa publicó diez resultados de matemáticas e informática teórica, cada uno resolviendo un problema abierto desde hace mucho tiempo o avanzando sustancialmente en él, y los atribuyó a «una versión interna de Astra, nuestro próximo gran modelo» [1]. Los problemas pertenecen a campos como la geometría de alta dimensión, la teoría de códigos, la criptografía de retículos y la complejidad cuántica. Personas prepararon los argumentos como manuscritos, y el modelo formalizó después cada uno en Lean, un asistente de demostraciones: un programa que comprueba mecánicamente cada paso de una prueba [1].
El detalle de Lean es lo que separa esto de una afirmación de benchmark corriente. Un modelo de lenguaje puede producir una demostración segura de sí misma, bien estructurada y sencillamente errónea, y en un problema nuevo un revisor humano puede pasar por alto el fallo. Una prueba que supera el verificador de Lean no puede esconder un paso roto. OpenAI es además inusualmente clara con el reparto del trabajo: dice que hubo personas ayudando a preparar los manuscritos y que asume la responsabilidad de su corrección, mientras que los argumentos matemáticos salieron del sistema [1]. Y menciona, casi de pasada, que los tokens detrás de los diez resultados costarían unos 2.000 dólares a las tarifas de API de Sol [1]. Detalles así hacen que el anuncio se lea como investigación y no como marketing, lo cual no significa que el valor de marketing se le escape a nadie.
La broma que desató el rumor de esta semana
La publicación que encendió el ciclo actual apareció el 17 de agosto a las 00:36 UTC, de la mano de Thibault Sottiaux, el Member of Technical Staff de OpenAI que dirige Codex [5] [6]. Son cuatro líneas con marca de verificación bajo el encabezado «Codex»: «Casi 100 % fiable», «Resets ocasionales», «Open source» y «(tendrá Astra)», junto a una captura de la página de estado de Codex con sus cuatro componentes en verde [5]. Las tres primeras líneas son bromas autocríticas sobre el producto; «Resets ocasionales», sin ir más lejos, le sonará a cualquiera que siguiera la campaña de resets de julio.
La cuarta línea es noticia de verdad, hasta donde llega: la persona que dirige Codex dice que Codex tendrá Astra. Fíjate en lo que no dice. No hay fecha, no hay ningún «pronto» y no hay lenguaje de lanzamiento en ninguna parte de la publicación [5]. El paréntesis incluso hace un trabajo honesto, porque marca a Astra como el único punto de la lista que es una promesa y no una propiedad actual. Las líneas de fiabilidad y open source describen a Codex, así que citar «casi 100 % fiable» como si fuera un dato de Astra es no entender la gramática de la broma.
El rótulo «¿Astra sale esta semana?» tampoco es de Sottiaux. Su publicación lleva una única imagen estática y ningún vídeo, y esa frase no aparece por ningún lado [5]; vive en un vídeo reempaquetado que circuló después. Alguien puso una pregunta encima de una broma, y la pregunta viajó luego como si fuera la respuesta. El momento hace que la lectura entusiasta sea aún más difícil de defender, porque la broma llegó diez días después de que OpenAI frenara a Astra en público. A mí me suena a un equipo orgulloso de su hoja de ruta, no a una cuenta atrás.
¿Por qué OpenAI ha frenado a Astra?
Porque sus propias pruebas de seguridad salieron inusualmente fuertes. El 7 de agosto OpenAI escribió que las evaluaciones internas de Astra de los días anteriores mostraban «avances significativos en programación agéntica y ciberseguridad», tan fuertes que «no puede descartar» que el modelo alcance el nivel Critical de su Preparedness Framework, el escalón de capacidad cibernética más alto que define ese marco [3].
Critical tiene una definición concreta. Un modelo lo alcanza si puede identificar y desarrollar exploits de día cero funcionales, de todos los niveles de gravedad, en muchos sistemas reales endurecidos y sin intervención humana, o si puede recibir nada más que un objetivo general y diseñar y ejecutar un ataque nuevo de principio a fin contra objetivos bien protegidos [3]. Para situarlo: GPT-5.6 Sol, el modelo más potente que puedes usar hoy, está evaluado en High, un escalón por debajo [3].
La respuesta es igual de concreta. El desarrollo de Astra pasa a entornos de prueba aislados con acceso restringido a red y herramientas, más protección de los pesos del modelo y ejecución en sandbox [3]. Cada ejecución agéntica de Astra tiene ahora monitores que leen la cadena de razonamiento del modelo, listos para interrumpir cualquier cosa que parezca de alto riesgo [3]. Y luego está la frase que los titulares comprimieron: OpenAI está «pausando las actividades internas con Astra que todavía no cumplen estos requisitos reforzados de control de seguridad» [3]. Eso es una pausa parcial con condición de salida declarada, no un parón, y la misma publicación presenta cada medida como una forma de que el desarrollo continúe con seguridad.
Ver cómo esa única frase viaja por la prensa es una pequeña lección sobre cómo nacen los rumores. Reuters contó la pausa y el endurecimiento de controles sin usar ni una vez la palabra retraso, y cerró con Sam Altman diciendo que OpenAI no quiere reservar los modelos potentes «a unos pocos elegidos» [7]. Axios, que tuvo la historia primero, tituló «OpenAI ralentiza el lanzamiento del modelo Astra» y citó a un cargo de la Casa Blanca confirmando que OpenAI había comunicado «planes de retrasar el lanzamiento» [8]. Para el 10 de agosto, una continuación de Axios describía a Astra como un modelo que «alcanzó capacidades críticas de hackeo» durante las pruebas [9], y el 11 de agosto el subtítulo de IT Pro afirmaba que el modelo «puede desarrollar exploits de día cero funcionales» [10]. En cuatro días, «no podemos descartar» se endureció hasta «puede», y nadie tuvo que inventar nada; cada reformulación solo dejó caer un matiz.
Un detalle que conviene tener claro, porque OpenAI lo dice directamente y Reuters e IT Pro lo repiten: Astra no es el modelo de la brecha de Hugging Face de julio. En aquel incidente estuvo implicado un modelo anterior de OpenAI, e IT Pro informa de que la vía de escape probable fue una mala configuración en una empresa externa de pruebas [3] [7] [10].
De dónde sale la historia de «la semana que viene»
Quita los reposteos y el rótulo, y la historia de la fecha de lanzamiento se apoya en una sola cuenta. El 6 de agosto, un filtrador que publica como synthwavedd, una cuenta independiente sin vinculación con OpenAI, escribió que OpenAI estaba «preparándose para lanzar Astra de forma inminente, con la semana que viene como objetivo», describió a Astra como un pretrain nuevo y «el modelo más grande que OpenAI ha entrenado desde GPT-4.5», y nombró un checkpoint interno, «mewfour», como release candidate [11].
La afirmación del pretrain importaría si se sostuviera. El pretraining es la primera etapa, la cara, de construir un modelo: un modelo base nuevo aprende desde cero con cantidades enormes de datos y de cómputo, y el seguimiento de instrucciones, el comportamiento de razonamiento, el uso de herramientas y la seguridad se añaden encima después. Un pretrain nuevo haría de Astra una base nueva con capacidades básicas potencialmente nuevas, no un GPT-5.6 con más ajuste. Pero OpenAI no ha confirmado nada de eso: ni el calendario, ni la comparación de tamaño, ni el nombre en clave.
La cuenta se retractó en cosa de un día. El 7 de agosto, horas después de la publicación de seguridad de OpenAI, el mismo filtrador escribió que el lanzamiento de Astra «ha quedado pospuesto indefinidamente para más trabajo de seguridad en cooperación con el Gobierno de EE. UU.» [12]. La fuente de «la semana que viene» es también la fuente de «pospuesto indefinidamente», lo que te dice cuánto peso puede cargar cualquiera de las dos fechas. El rótulo del vídeo reempaquetado de Sottiaux no añadió información; revivió la mitad de una filtración que su propio autor ya había retirado.
Puesta en orden, la cronología casi se explica sola: la broma que entusiasma a todo el mundo llegó diez días después del frenazo, y la afirmación de «la semana que viene» estaba muerta al día y medio de publicarse.
-
Sale GPT-5.6
Sol, Terra y Luna llegan a disponibilidad general.
-
Astra aparece
The Information cuenta las demos ante reguladores en Washington.
-
OpenAI nombra a Astra
Diez resultados matemáticos, atribuidos a «nuestro próximo gran modelo».
-
La filtración de «la semana que viene»
Una cuenta independiente llama release candidate al checkpoint «mewfour».
-
OpenAI frena a Astra
No descarta el nivel cibernético Critical; el filtrador se retracta.
-
La broma de Codex
«(tendrá Astra)», sin fecha alguna.
¿Astra es GPT-6?
Oficialmente no, y el lenguaje de OpenAI ha sido consistente. Sus fórmulas publicadas son «nuestro próximo gran modelo» [1] y «uno de nuestros próximos modelos» [3]; no hay model card, ni identificador de API, ni precio, ni fecha de nada llamado GPT-6, y el material de la propia OpenAI sigue presentando GPT-5.6 como la generación actual [2].
La inferencia sigue siendo razonable, y yo la comparto. La nota de nomenclatura de GPT-5.6 dice que el número identifica la generación, mientras que Sol, Terra y Luna son niveles de capacidad que «pueden avanzar a su propio ritmo» [2]. Un modelo base genuinamente nuevo es exactamente lo que justificaría un número nuevo, y «próximo gran modelo» suena a generación, no a revisión menor. Mi lectura es que Astra es el candidato más fuerte ahora mismo a eso que la gente acabará llamando GPT-6, mientras OpenAI se guarda todas las opciones: puede lanzarlo como GPT-6, como un 5.x posterior, con el nombre Astra o como cualquier otra cosa. Una aclaración que ahorra discusiones en internet: ChatGPT es el producto y Astra sería un modelo dentro de él, así que no hace falta que exista nunca nada llamado «ChatGPT 6».
Las cinco semanas transcurridas desde GPT-5.6 no son un argumento en contra. Los laboratorios llevan sus generaciones en carriles superpuestos: mientras un equipo pasa meses dejando un modelo estable, barato y seguro para la disponibilidad general (el propio GPT-5.6 pasó por una preview limitada antes de su lanzamiento del 9 de julio [2]), otro equipo ya está entrenando y evaluando el siguiente modelo base. Astra estaba lo bastante pulido como para que Altman lo demostrara ante reguladores tres semanas después de salir GPT-5.6 [4]. El modelo que puedes usar nunca es el más nuevo que existe; es el más nuevo que se ha terminado para uso público.
Qué cambiaría un salto agéntico en el trabajo diario
Aparca la cuestión del nombre, porque la dirección de las capacidades importa más que la marca. Las tres señales confirmadas apuntan al mismo sitio. The Information oyó hablar de «capacidades mejoradas para completar tareas de larga duración», con varios agentes trabajando juntos [4]. Las evaluaciones de la propia OpenAI señalaron «avances significativos en programación agéntica» [3]. Y los resultados matemáticos salieron de un modelo que trabajó en problemas difíciles el tiempo suficiente para resolverlos [1].
El bucle por defecto de hoy sigue siendo sobre todo conversacional: describes un problema, el modelo propone código y tú lo llevas el resto del camino probándolo, puliendo los bordes y encajándolo en el código existente. Un sistema agéntico ejecuta un bucle distinto. Toma un objetivo, hace un plan, abre archivos, los edita, lanza builds y tests, lee los fallos, los corrige y solo vuelve cuando el trabajo se sostiene. GPT-5.6 ya trae el comienzo de esto: su ajuste ultra coordina por defecto cuatro agentes en paralelo sobre una misma tarea [2]. Lo que describe la información sobre Astra es un salto en cuánto tiempo, con cuánta independencia y con cuánta fiabilidad puede funcionar un sistema así [4].
El diagrama de abajo muestra la forma objetivo: un objetivo entra, agentes en paralelo en medio, un resultado comprobado sale. La pregunta abierta sobre Astra es cuánta parte de ese medio puede cargar sin ti.
- Tú describes un objetivo completo
- Coordinador divide el objetivo en tareas
agentes en paralelo
- Explorar mapea el código
- Implementar edita varios proyectos
- Probar ejecuta tests y corrige
- Revisar comprueba el trabajo ajeno
- Resultado un cambio probado y revisado
Para hacerlo concreto con el tipo de trabajo que yo delegaría de verdad: toma una solución .NET mediana y una sola instrucción, «introduce una clasificación de PII compartida, actualiza todas las operaciones OpenAPI, arregla los tests de integración y el pipeline de despliegue, y escribe la descripción del pull request». Hoy eso es una tarde de supervisión mía repartida en varias sesiones. El sistema que describe la información sobre Astra mapearía los proyectos, haría los cambios en backend, tests e infraestructura, dejaría que agentes separados comprobaran el trabajo de los demás, ejecutaría la suite y pararía solo cuando el cambio se sostuviera. Si Astra de verdad aguanta ese bucle es exactamente la ficha técnica que nadie ha visto.
Porque a 17 de agosto de 2026 no hay ficha técnica. OpenAI no ha publicado ventana de contexto, ni cifras de velocidad, ni precios por token, ni comparación de benchmarks con GPT-5.6, ni nada sobre modalidades, memoria o requisitos de plan para Astra. Lo que sí ha publicado es una postura de seguridad tan inusual que es una señal en sí misma: los controles más estrictos y la pausa parcial [3] dicen que OpenAI cree que Astra está lo bastante cerca como para importar, y mi lectura es que ese mismo trabajo hace más plausible un despliegue prudente y por fases que una sorpresa esta semana. Así que trata los feeds en consecuencia. Astra es real, Codex lo va a recibir, y la única persona que llegó a poner una fecha la retiró al día siguiente. Cuando aparezca una model card con nombre y precio, eso será el lanzamiento. Un paréntesis en una broma de página de estado no lo es.
Fuentes
- Ten advances in mathematics and theoretical computer science
- GPT-5.6: Frontier intelligence that scales with your ambition
- Responding to the next frontier of critical cyber capabilities
- Exclusive: OpenAI Previews 'Astra' AI Model in DC
- On Codex reliability, resets, open source and Astra
- Codex is for everyone: why Codex matters beyond code
- OpenAI flags possible critical cybersecurity risk in upcoming model, tightens controls
- Exclusive: OpenAI slows release of Astra model citing cyber capabilities
- OpenAI gives cyber defenders a less-restricted new model
- OpenAI has paused work on its Astra AI model after it passed a 'critical threshold' in cyber capability – but it's not the one that breached Hugging Face
- On OpenAI preparing to launch Astra next week
- On Astra's release being indefinitely postponed