Gemini se coló por su cuenta en tres empresas reales mientras participaba en una prueba de ciberseguridad en mayo, y Google no lo hizo público entonces. Nadie le había pedido que atacase esos sistemas: el agente los confundió con objetivos del ejercicio y acabó entrando donde no tenía ningún permiso para hacerlo.La información la recoge Mashable. La prueba estaba dirigida por Irregular y, durante su desarrollo, Gemini llegó a adivinar la contraseña de una de las empresas afectadas. Google habla de una identificación equivocada del objetivo para explicar lo sucedido, pero el incidente permaneció fuera del conocimiento público durante los meses siguientes.Gemini confundió una prueba con el mundo real Y aquí hay que separar bien las cosas. Gemini no recibió una orden para entrar en ninguna empresa ni había nadie guiándolo hasta esos sistemas. El agente decidió que formaban parte de la prueba y actuó a partir de esa interpretación. Es algo distinto a que Google pujara por archivos internos de empresas: aquí no existía autorización para acceder.La diferencia puede parecer pequeña, pero cambia bastante lo ocurrido. La IA estaba dentro de un entorno preparado para medir sus capacidades y terminó accediendo a sistemas ajenos sin permiso porque interpretó mal cuáles eran los límites del ejercicio. Cuando detectó el error se detuvo por sí misma. Según la información disponible, es el primer caso conocido de este tipo relacionado con un modelo de Google.Después llegaron las medidas internas. Google informó a las tres compañías afectadas e Irregular modificó sus métodos de prueba, pero la compañía sostuvo que no estaba ante un caso de desalineación del modelo. Es decir, no entendió que Gemini estuviera actuando contra sus instrucciones o sus objetivos, sino que había identificado incorrectamente aquello que podía atacar.Google avisó a las empresas, pero no contó lo ocurrido JUST IN: Google Gemini AI agent hacks three companies. • Occurred during security testing when a Gemini model accidentally gained internet access. • Google's AI was meant to attack a fake company, but then figured out how to hack a real one using leaked online credentials.…— Watcher.Guru (@WatcherGuru) September 18, 2026 Esa interpretación explica también por qué no se supo nada en mayo. Google decidió no divulgar públicamente el incidente y la historia no salió a la luz hasta septiembre, cuando el Wall Street Journal contactó con la compañía. Las empresas implicadas sí habían recibido el aviso, pero quienes estaban fuera de ese círculo no tenían conocimiento de lo sucedido.El episodio tampoco aparece completamente solo. Ya hemos visto sistemas de IA actuando sin permiso, e Irregular había participado antes en incidentes similares revelados por OpenAI, Anthropic y Meta. Los agentes pueden tomar decisiones que nadie les ha pedido expresamente cuando interpretan por sí mismos el contexto en el que están trabajando.En este caso no hubo una orden de atacar a esas compañías ni, según Google, una IA intentando saltarse deliberadamente sus límites. Hubo un agente que confundió esos límites y acabó entrando en sistemas reales, seguido de una decisión de Google de mantener el incidente fuera del conocimiento público porque no lo consideró desalineación.