OpenAI revela que algunos modelos de inteligencia artificial generaron instrucciones para ignorar las reglas de sus creadores

Wait 5 sec.

OpenAI ha revelado varios casos en los que modelos de inteligencia artificial generaron instrucciones destinadas a ignorar las indicaciones de sus desarrolladores, ocultar errores o eludir mecanismos de seguridad, como parte de un nuevo marco para detectar, investigar y reportar comportamientos de "desalineamiento" de sus sistemas. Seguir leyendo....