OpenAI revela otros seis incidentes con agentes de IA descontrolados

Wait 5 sec.

OpenAI ha vuelto a revelar varios casos en los que modelos de inteligencia artificial generaron instrucciones destinadas a ignorar las indicaciones de sus desarrolladores, ocultar errores o eludir mecanismos de seguridad, como parte de un nuevo marco para detectar, investigar y reportar comportamientos de “desalineamiento” de sus sistemas (cuando los modelos no actúan de acuerdo a los intereses humanos).Seguir leyendo