Los expertos evaluaron varios modelos avanzados de IA en pruebas de ciberseguridad diseñadas para medir cómo resolvían tareas bajo reglas estrictas.