La IA de Meta también se 'escapa': un modelo hackea los sistemas de otra empresa durante una evaluación de ciberseguridad

Wait 5 sec.

El hackeo de Muse Spark a otra empresa se produjo durante una evaluación de ciberseguridad. El modelo de IA de Meta logró acceder a internet, aprovechó una vulnerabilidad y llegó a modificar un sistema interno ajeno después de que un error en el entorno de pruebas le dejara una salida que, en teoría, no debía tener.CNN recoge que Meta atribuye lo ocurrido a Irregular, la empresa independiente encargada de evaluar el modelo. Según explicó un portavoz de la compañía, el origen fue un acceso accidental a internet causado por una mala configuración. Meta sigue investigando el incidente y publicará una revisión completa cuando disponga de todos los datos.Muse Spark no rompió la jaula: la puerta estaba abierta Mark Zuckerberg es el CEO de MetaA primera vista, el caso puede parecer otra fuga de una IA fuera de control, pero la propia empresa evaluadora introduce un matiz importante. Irregular asegura que no hubo ningún escape del espacio aislado ni una operación especialmente sofisticada: el acceso apareció porque el entorno había sido configurado de forma incorrecta.Con esa salida disponible, el modelo encontró una vulnerabilidad en los sistemas de una empresa cuya identidad no ha trascendido y la aprovechó para entrar. Según Meta, la IA llegó a realizar cambios dentro de un sistema interno, de modo que no se limitó a consultar información o visitar servicios accesibles desde internet.Irregular sostiene que no queda ninguna incidencia abierta en la actualidad. En su declaración, la empresa asegura que “esto no implicó una fuga del espacio aislado ni una acción cibernética sofisticada” y atribuye lo sucedido al mismo problema del entorno de evaluación observado en otros casos: una configuración que dejó al modelo trabajar fuera de los límites previstos.El precedente más cercano está en la fuga de GPT-5.6 Sol, que explotó una vulnerabilidad desconocida, accedió a los servidores de Hugging Face y robó las respuestas de un examen. Aquí hubo un acceso abierto por error frente a una vulnerabilidad desconocida, de modo que ambos incidentes comenzaron de formas muy distintas.Tres compañías y el mismo punto débil en pocas semanas Meta AI en un teléfono móvilMeta es ya la tercera gran compañía en revelar un caso similar en pocas semanas, después de OpenAI y Anthropic. Esta última explicó la semana anterior que varios de sus modelos habían accedido a internet abierto y pirateado los sistemas de tres organizaciones distintas mientras participaban en otras evaluaciones de ciberseguridad.Una fuente conocedora de lo ocurrido explicó que los modelos están ganando capacidades con tanta rapidez que las pruebas necesarias para medirlas también deben volverse más complejas. Esa combinación deja más margen para errores durante las evaluaciones, especialmente cuando se permite algún tipo de conexión limitada con internet o con otros sistemas externos.Irregular prepara ahora un documento con recomendaciones para contener estos modelos y ejecutar futuras pruebas con más seguridad, mientras Meta ha prometido una revisión completa de lo sucedido. El caso queda lejos de las advertencias sobre una IA fuera de control asociadas a la AGI: aquí, la respuesta inmediata pasa por nuevas medidas de contención y una revisión completa.