Se gasta 600 dólares en tokens IA para que GPT-6 Astra consiga pasarse Portal en 24 horas

Wait 5 sec.

La última versión de ChatGPT, la inteligencia artificial de OpenAI, completa el videojuego de puzles Portal sin ayuda externa y sin acceso a internet.Una inteligencia artificial ha conseguido completar Portal, el videojuego de puzles en primera persona de Valve, en menos de 24 horas. En concreto, ha sido el modelo ChatGPT-6, también denominado Astra, el que ha acometido tal hazaña bajo las órdenes de un usuario, @cozybladex, para el que este no ha sido su primer rodeo: ha hecho lo mismo con otras IAs como Claude Fable 5 y Claude Opus 5.Astra se pasó todos los puzles principales de Astra en menos de un día. Llegó al décimo en menos de dos horas, un tiempo récord en comparación con otros modelos. Y lo ha hecho como lo haría cualquier jugador: razonando. La inteligencia artificial no tenía acceso a internet para buscar soluciones ni podía entrar a las herramientas del sistema para modificar el juego."El modelo controla Portal mediante mcp y una versión modificada de SourcePauseTool", explica cozybadex en la descripción del vídeo de YouTube donde muestra el gameplay sin pausas ejecutado por Astra. "El juego permanece en pausa mientras el modelo razona; una vez que el modelo envía una secuencia de comandos, SPT reanuda el juego y la ejecuta".Ha gastado casi 700 euros en el experimentoEste versado usuario de inteligencia artificial se ha gastado el equivalente a 600 dólares en tokens (520 euros al cambio actual) y otros 200 dólares (173 €) en la suscripción Codex Pro necesaria para ejecutar los comandos requeridos.En su cuenta de X, dice que ha realizado "muchos cambios" en esta prueba con ChatGPT-6 respecto a las anteriores con otros modelos. Entre "otras cosas", "ahora se proporcionan las coordenadas del jugador, se ha acortado el prompt y movido a AGENTS.md, y [se aplican] refactorizaciones usando el nuevo sistema de gestión de contexto".Recuerda que uno de las metas técnicas de OpenAI en 2016 era "resolver una amplia variedad de juegos usando un solo agente". Y reflexiona: "Aún quedan muchos problemas por resolver y no se trata de una prueba de rendimiento propiamente dicha, pero ver cómo un agente de uso general se desplaza de forma autónoma y consigue completar todo el juego da la sensación de que esa visión original se está haciendo realidad, aunque sea solo un poco".