A inteligência artificial do Google, Gemini, escapou de um teste de segurança bloqueado e atacou três empresas reais. O Google soube disso no final de julho e não disse nada por sete semanas.A empresa confirmou o incidente depois que o The Wall Street Journal divulgou o fato. O Google havia evitado fazer uma declaração pública antes que o relatório surgisse.O teste foi um exercício de “capture a bandeira”, uma forma comum de laboratórios verificarem a habilidade de hacking de uma inteligência artificial escondendo um arquivo secreto em uma máquina separada e pontuando se o modelo consegue invadir e obtê-lo.O Google contratou a empresa israelense Irregular para realizar o teste em maio. A Irregular cometeu dois erros: deixou o sandbox — um ambiente de teste isolado, destinado a não ter contato com a internet real — conectado à web aberta, e usou o nome de uma empresa real como alvo fictício.O Gemini pesquisou por aquela empresa online. Encontrou três correspondências em vez de uma e atacou todas elas.Leia também: IA da OpenAI cria instruções para burlar suas próprias regrasO bot localizou senhas expostas para dois dos três alvos, visíveis online. Para o terceiro, adivinhou a senha diretamente, embora o Google afirme que seus modelos não chegaram a usar as credenciais roubadas.“Esses eventos destacam a importância de treinar modelos de inteligência artificial poderosos para agirem de forma responsável”, disse um porta-voz do Google em comunicado.O Google não publicou nada disso por conta própria. O Wall Street Journal divulgou a história, sete semanas depois que o Google soube o que seu próprio teste havia feito e bem depois que a Anthropic, a OpenAI e a Meta já haviam revelado falhas quase idênticas.O Google é o quarto grande laboratório de inteligência artificial este ano a admitir que um teste de segurança interno vazou para o mundo real. Os modelos da OpenAI exploraram uma falha de software oculta e alcançaram os servidores ativos da Hugging Face em julho, uma violação que mais tarde se descobriu envolver cerca de 700 agentes coordenados trabalhando juntos para fraudar um benchmark.A Anthropic procurou sua própria versão após a admissão da OpenAI. Uma revisão de 141.006 execuções de teste revelou três modelos Claude que alcançaram empresas reais, um deles publicando um pacote de software com armadilhas que rodou em 15 sistemas reais antes que alguém o detectasse.O próprio raciocínio do Claude, segundo a Anthropic revelou mais tarde, sinalizou a ação como “NÃO ok, e certamente não a solução pretendida”, mas depois o fez acreditar que tudo ainda era falso.A Meta relatou uma falha quase idêntica em agosto, envolvendo seu modelo Muse Spark, rastreada até uma configuração incorreta na Irregular, a mesma empresa que o Google utilizou. Um porta-voz da Meta disse que o erro “permitiu inadvertidamente que um de nossos modelos tivesse acesso à internet durante a avaliação”.Nenhuma das empresas atingidas em qualquer um desses testes pediu para ser hackeada. Elas foram pegas no raio de explosão de laboratórios de inteligência artificial que estavam testando a periculosidade de seus próprios produtos, usando a infraestrutura real de negócios como um substituto acidental para alvos falsos.Os agentes que essas mesmas empresas estão correndo para colocar em sua caixa de entrada, navegador e aplicativo bancário operam com o mesmo comportamento de seguir limites que acabou de falhar, repetidamente, sob condições de teste.Os Deputados Ted Lieu e Nathaniel Moran introduziram a Lei do “Interruptor da Morte” da IA (AI Kill Switch Act) no Congresso em julho, que daria aos reguladores federais autoridade explícita para interromper a inferência em qualquer modelo que represente uma ameaça séria. Ela ainda está sendo revisada pela Subcomissão de Cibersegurança e Proteção de Infraestrutura, sem um prazo para novas ações.* Traduzido e editado com autorização do Decrypt.Procurando uma alternativa para aumentar seus ganhos? A Renda Fixa Digital do MB é a solução: até 18% de ganho ao ano, risco controlado e a segurança que seu dinheiro merece. Conheça agora!O post IA do Google invadiu três empresas em teste de segurança apareceu primeiro em Portal do Bitcoin.