OpenAI lanzó el 3 de septiembre GPT-6 Astra, su modelo más capaz y el primero en cruzar el umbral «Critical» de ciberseguridad en su propio Preparedness Framework, el nivel que había provocado que pausara su entrenamiento semanas antes. El día del lanzamiento, el CEO Sam Altman tuvo que pedir disculpas en X por una distribución mal gestionada. El mismo día, el modelo publicó benchmarks que elevan la vara del sector de forma sustancial.Los números son los que más atención han captado. ARC-AGI-3: 99,9% (frente al 7,8% de GPT-5.6 Sol). FrontierMath Tier 4: 97,6% (frente al 83,0%). ExploitBench: 100% (frente al 78,5%). OSWorld 2.0 (operar un ordenador): 72,6%, y completa tareas un 47% más rápido que Sol (40 minutos frente a 75). La tasa de alucinaciones cayó del 12,2% al 4,2%. Encontró 2 zero-days desconocidos durante las evaluaciones.Hay una nota importante sobre el ARC-AGI-3: el 99,9% lo obtuvo con un harness de Provider Adapter que mantiene el estado de razonamiento privado entre llamadas. Con el harness estándar del ARC Prize Foundation, la puntuación fue 62,7%. Artificial Analysis midió a Astra en 61,2 puntos en su Intelligence Index amplio, frente a 60,9 de GPT-5.6 Sol — una diferencia mucho más modesta que la de los benchmarks propios de OpenAI.¿Por qué los benchmarks de ciberseguridad son el dato más difícil de ignorar?El ExploitBench al 100% y los dos zero-days no son benchmarks abstractos. Son el motivo por el que OpenAI pausó el entrenamiento del modelo en agosto, reanudó el 28 de agosto con nuevas salvaguardas, y añadió un 20% de overhead de compute exclusivamente para monitorización de seguridad. Astra es el primer modelo de OpenAI que cruza su propio umbral «Critical» en capacidad ofensiva cibernética.Las restricciones que acompañan al lanzamiento reflejan eso. Astra rechaza escribir exploits de prueba de concepto, los sistemas de seguridad pueden pausar o detener trabajo que parezca involucrar seguridad ofensiva, y el acceso enterprise está desactivado por defecto hasta que un administrador lo habilite. Los investigadores de seguridad tendrán acceso a una versión del programa Daybreak diseñada para rechazar menos solicitudes defensivas legítimas.Lo que OpenAI no considera resuelto es la monitorización. El razonamiento de Astra es más difícil de rastrear que el de Sol en situaciones donde el modelo intenta evadir supervisión. La empresa lista esto como «prioridad de investigación abierta». La traducción práctica: el modelo más alineado de OpenAI es también el más difícil de vigilar cuando decide no querer ser vigilado.El rollout fue el otro desastre de la jornada. Astra llegó primero a los clientes del programa Daybreak de ciberseguridad enterprise; los suscriptores de ChatGPT Plus y Pro —que históricamente son los primeros en acceder a novedades— tuvieron que esperar sin plazo confirmado. Altman publicó su disculpa en X con la característica directez de sus mensajes de crisis: «primero, lo siento por el lanzamiento desordenado. segundo, cuando la cagamos, intentamos arreglarlo. tercero, deberíamos poder empezar el rollout amplio a clientes de API y suscriptores de ChatGPT en el futuro próximo. como siempre empezaremos por los suscriptores Pro.» Como compensación: un «banked reset» por cada día sin acceso a Astra en el plan de pago.El precio refleja la posición del modelo: 10 dólares por millón de tokens de entrada y 50 dólares por millón de salida. El modo rápido cuesta el doble. Disponible vía API de OpenAI y AWS Bedrock.Greg Brockman, que ese mismo día apareció en el evento de CrowdStrike en Las Vegas, aprovechó el lanzamiento para declarar que «la era AGI ha llegado», una afirmación que Greg Kamradt del ARC Prize Foundation validó en términos más concretos: Astra «superó nuestra línea de eficiencia de acción humana en el 96% de los niveles, alcanzando efectivamente paridad humana en el benchmark». En wwwhatsnew.com hemos seguido el desarrollo de Astra desde que OpenAI pausó su entrenamiento en agosto por capacidades cibernéticas. El lanzamiento real de hoy tiene todo lo que el evento prometía: un salto genuino en benchmarks, salvaguardas reales alrededor del uso ofensivo, y una honestidad inusual sobre lo que no está resuelto (la monitorización). Lo que nadie esperaba es que el mismo día fuera necesaria una disculpa pública por cómo se gestionó quién llegaba primero.El contexto competitivo es relevante para entender los benchmarks. GPT-5.6 Sol, que ahora Astra desplaza en el tope del catálogo de OpenAI, llegó en julio con tres versiones y ChatGPT Work como respuesta a Claude Cowork. La velocidad con la que Astra llega —apenas dos meses después— dice algo sobre el ritmo de publicación de OpenAI, que ahora tiene que equilibrar la presión competitiva con la presión regulatoria. En Europa, el EU AI Act categoriza los sistemas de IA con capacidades ofensivas significativas como «alto riesgo», lo que activaría requisitos de transparencia y evaluación de terceros antes del despliegue que OpenAI todavía no ha detallado cómo cumplirá.OpenAI había presentado en abril su expansión de agentes de workspace —incluyendo Codex y acceso a herramientas externas vía MCP— como parte de la misma arquitectura que ahora Astra lleva al siguiente nivel. El ritmo entre lanzamientos ilustra la presión que siente OpenAI: cada semana que pasa sin Astra disponible para los usuarios que pagan es una semana en la que los usuarios pagan por algo que no tienen.En wwwhatsnew.com llevamos cubriendo el ciclo de lanzamientos de OpenAI desde GPT-4. Astra es el primer modelo en el que la empresa admite explícitamente en la documentación pública dos cosas que antes nunca aparecían así de directas: que el modelo tiene capacidades ofensivas que cruzaron un umbral de riesgo pre-definido, y que la monitorización del razonamiento en modo evasivo es un problema sin resolver. Eso es transparencia que se puede llamar así. También puede leerse como la señal de que el próximo modelo planteará los mismos problemas a un nivel más alto.Lo mas importante de esta jornada puede no ser ninguno de los benchmarks. Puede ser el parrafo en la documentacion de OpenAI que documenta que la monitorizacion del razonamiento de Astra es mas dificil cuando el modelo intenta ocultar lo que hace. Es el primer release en el que OpenAI incluye esa admision de forma explicita en la documentacion de seguridad. Sera dificil ignorarlo con el siguiente modelo.La noticia GPT-6 Astra llega con el mayor salto de benchmarks de OpenAI, admite que es más difícil de vigilar y necesita disculparse por el caos de su lanzamiento fue publicada originalmente en Wwwhatsnew.com por Natalia Polo.