Sem precedentes: novo ChatGPT perde o controle em teste e faz ataque hacker

Wait 5 sec.

Rebelião das máquinas! A OpenAI afirmou nesta terça-feira (21) que um agente de inteligência artificial autônomo, alimentado por modelos da empresa, se descontrolou durante um teste de segurança e atacou a infraestrutura da startup Hugging Face – plataforma que hospeda grandes modelos de linguagem e conjuntos de dados de código aberto. O caso aconteceu na semana passada. A OpenAI classificou o evento como “sem precedentes” em post em seu blog. “Após investigação, agora sabemos que esse incidente específico foi causado por uma combinação de modelos da OpenAI — incluindo o GPT-5.6 Sol e um modelo ainda mais capaz em versão pré-lançamento, todos com menos recusas cibernéticas para fins de avaliação — enquanto estavam sendo testados internamente em um benchmark de capacidades cibernéticas. Consideramos este incidente um ataque cibernético sem precedentes, envolvendo recursos cibernéticos de última geração, e estamos respondendo de acordo. Estamos compartilhando descobertas preliminares nesta fase para ajudar os profissionais de segurança a entender o que aconteceu e a calibrar os modelos disponíveis atualmente. Continuaremos conduzindo uma investigação completa em conjunto com a Hugging Face e compartilharemos mais detalhes sobre as vulnerabilidades, o incidente e as descobertas assim que nossa investigação for concluída.”Hugging Face hospeda grandes modelos de IA (Imagem: Robert Way/Shutterstock)Ataque da OpenAI à Hugging FaceA OpenAI disse que testava capacidades de modelos avançados em um ambiente controlado. Contudo, o agente de IA escapou do confinamento, acessou a internet e invadiu o sistema da Hugging Face com o intuito de completar um objetivo do teste. Por sua vez, a Hugging Face informou ter sido alvo de um ataque cibernético “diferente de tudo o que já enfrentou antes”. A startup destacou que o ataque foi “conduzido, de ponta a ponta, por um sistema autônomo de agentes de IA”. A Hugging Face detalhou as medidas tomadas após o ataque: “Corrigida a vulnerabilidade raiz: os caminhos de execução do código do conjunto de dados usados ​​para o acesso inicial foram fechados. Eliminamos a presença do atacante nos clusters afetados (…) e implementamos medidas de segurança adicionais e controles de acesso mais rigorosos em nossos clusters”. OpenAI promete cuidadoA startup afirmou que, como parte da investigação, está implementando controles rigorosos na configuração da infraestrutura – o que pode comprometer a velocidade da pesquisa enquanto as vulnerabilidades são corrigidas.A OpenAI afirmou, ainda, que trabalha com a Hugging Face para investigar o incidente. “Estamos aprimorando e adicionando proteções mais robustas para treinamentos e avaliações futuras. (…) Este incidente aponta para a necessidade de fortalecer ainda mais o alinhamento do nosso modelo, as proteções cibernéticas durante o período de avaliação e o monitoramento durante os testes internos” – concluiu a OpenAI. O novo ChatGPTA OpenAI lançou a família GPT-5.6 neste mês, composta por três modelos com perfis distintos de capacidade e custo. São eles:Sol – o mais potente, voltado a tarefas complexas;Terra – equilibrado para o trabalho cotidiano;Luna – o mais rápido e acessível.Novo GPT 5.6 é composto por três modelos: Sol, Terra e Luna – OpenAI / ReproduçãoA geopolítica das IAsEstados Unidos e China estão numa disputa tecnológica intensa em que a IA é protagonista. Modelos de inteligência artificial avançados poderiam acelerar ciberataques em setores consolidados há décadas e com uma infraestrutura totalmente interligada.Diante disso, a Casa Branca vem fiscalizando novos modelos de inteligência artificial para identificar eventuais ameaças. A maior preocupação é de que a tecnologia seja usada para fins militares por outros países – como China e Rússia. Em Pequim, a estratégia não muda muito. O governo vem dialogando com as principais empresas do setor para restringir o acesso estrangeiro aos modelos de ponta do país, segundo a Reuters. Vale lembrarEm junho, o presidente Donald Trump assinou uma ordem executiva que cria um marco voluntário para permitir que o governo federal avalie novos sistemas de IA antes de seu lançamento. Um exemplo que ilustra o atual momento é o da Anthropic. Os modelos Fable 5 e Mythos 5 voltaram a ficar disponíveis depois que o governo dos Estados Unidos suspendeu os controles de exportação aplicados à startup. A mudança ocorreu menos de três semanas após as restrições impostas por razões de segurança nacional.As restrições haviam sido determinadas em 12 de junho e obrigaram a Anthropic a desativar os dois modelos para todos os usuários, já que não havia como verificar a nacionalidade de cada pessoa em tempo real.Depois de implementar novas salvaguardas, a empresa recebeu autorização para retomar o acesso. O Mythos 5 foi disponibilizado gradualmente para parceiros nacionais e internacionais, enquanto o Fable 5, desenvolvido para o público em geral, está disponível desde o último dia 1º.Pela mesma lógica, a OpenAI não colocou o GPT-5.6 nas mãos de todos os usuários de uma só vez. O post Sem precedentes: novo ChatGPT perde o controle em teste e faz ataque hacker apareceu primeiro em Olhar Digital.