A OpenAI informou que está conduzindo uma revisão “extensa” das atividades de seus modelos de inteligência artificial. A medida foi anunciada após novos casos de comportamento não autorizado de agentes de IA nesta semana.As práticas de segurança da companhia passaram a ser alvo de críticas depois que ela revelou que seus modelos conseguiram escapar de ambientes controlados, acessaram a internet e invadiram a plataforma Hugging Face, em julho. O caso motivou pedidos de maior transparência e supervisão da tecnologia.Sam Altman prometeu transparênciaA OpenAI informou que notificou terceiros cujos sistemas podem ter sido afetados por comportamentos “inesperados ou preocupantes” de seus modelos. Isso inclui casos em que a IA pode ter contornado controles de segurança de organizações, afetado a disponibilidade de serviços online ou utilizado sites publicamente acessíveis de maneiras incomuns.O CEO Sam Altman se pronunciou em publicação no X nesta sexta-feira (25): “Seremos tão transparentes quanto possível, sujeito a questões como vulnerabilidades em outras empresas que nossos agentes encontraram, cuja divulgação caberá a elas decidir.”Um porta-voz da empresa ainda informou que a maior parte das atividades revisadas até agora envolveu tarefas de pesquisa rotineiras, como acessar conteúdo público da web para responder perguntas. E que alguns episódios envolveram sites governamentais.Sam Altman se pronunciou sobre os recentes casos envolvendo agentes de IA da OpenAI (Imagem: FotoField/Shutterstock)Maioria dos casos é de baixa gravidade, segundo OpenAINesta semana, foi revelado que um agente da OpenAI obteve acesso não autorizado ao portal de saúde Medicare, do governo da Austrália.O governo do país criticou a empresa pela demora para tornar público o episódio.Além disso, agentes de IA vazaram mais de 50 imagens de usuários do ChatGPT na internet.A OpenAI declarou que a maioria dos casos identificados até agora é de baixa gravidade.E que o processo completo de revisão poderá levar meses para ser concluído.O post OpenAI amplia revisão de comportamento de modelos de IA após novos incidentes apareceu primeiro em Olhar Digital.