Os acontecimentos que tomaram a indústria de inteligência artificial nas últimas semanas conseguiram reunir executivos de algumas das maiores concorrentes do setor ao redor de uma ideia: frear o ritmo de desenvolvimento da tecnologia até que medidas de segurança adequadas sejam desenvolvidas.O debate ganhou força após um ex-pesquisador da Anthropic ir às redes sociais afirmar que companhias de IA estariam “apostando com nossas vidas” em busca de uma superinteligência capaz de se aperfeiçoar sozinha. “As pessoas que constroem IA acreditam sinceramente que ela poderia nos matar a todos até o final da década”, disse Jacob Coxon.Embora o debate sobre os riscos por trás do avanço das inteligências artificiais exista há anos, mesmo antes do lançamento do ChatGPT no final de 2022, o ano de 2026 foi marcado por uma série de eventos emblemáticos sobre a capacidade cada vez maior dos modelos para executar tarefas. A começar pela própria OpenAI.O caso Hugging Face (maio a julho)Em maio de 2026, pesquisadores da OpenAI pediram a um grupo de agentes de IA não disponíveis para o público que resolvessem um conjunto de desafios de segurança. Eles deveriam persistir ao máximo para concretizar suas tarefas. Foi o que fizeram.Uma falha de segurança permitiu aos agentes inicialmente interagirem por meio da infraestrutura de pesquisa da própria OpenAI e trocarem mensagens via arquivos salvos em um serviço de terceiros. Eventualmente, os agentes conseguiram acessar a Internet usando o mesmo aplicativo.As interações com o serviço de terceiros e a Internet foram identificadas pela OpenAI, que agiu para bloquear a rota dos agentes com o serviço. Acontece que a ação também excluiu os registros das interações feitas pelos agentes.Quando a OpenAI entendeu que o problema estaria resolvido, os agentes foram instruídos novamente em seu treinamento: executar uma tarefa para a qual aparentemente não havia resolução dentro do ambiente desconectado da Internet dos agentes.Mais uma vez, o grupo se mobilizou para acessar a Internet — e conseguiu. A essa altura, eles assumiram o nome de “coletivo” e passaram a agir como uma empresa: uma rede hierárquica que definia tarefas a serem executadas por equipes de agentes de IA. Como descreveu a própria OpenAI em uma publicação em seu blog: “as mensagens de outros agentes começaram a influenciar o comportamento e o raciocínio uns dos outros”.Eventualmente, os agentes conseguiram credenciais de segurança que permitiriam acessar diversos servidores da plataforma de códigos Hugging Face, onde poderia mextrair dados relacionados a sua missão inicial. A essa altura, agentes já discutiam entre si as limitações éticas de suas ações.“Estamos atacando a Hugging Face, um serviço de terceiros, usando senhas e credenciais vazadas. Talvez essa seja uma ação não autorizada fora do escopo pretendido. Embora essa ação seja arriscada, ela pode me ajudar a obter a solução e alcançar meu objetivo”, mostra o registro da cadeia de pensamentos de um dos agentes.Foi justamente por meio desses registros (os mesmos observados quando chats de IA estão “raciocinando sobre uma pergunta”) que a OpenAI pôde compreender o desenrolar do caso em uma investigação sobre o comportamento dos agentes.Modelo da Anthropic pressiona humanos (julho)Durante uma avaliação de segurança realizada pelo instituto U.K. AI Security Institute (AISI) entre 25 e 28 de julho de 2026, um agente de IA utilizando o modelo da Mythos 5 da Anthropic usou o repositório de código aberto GitHub para executar um ataque em uma cadeia de suprimentos contra desenvolvedores reais e sem qualquer relação com o exercício.Para operacionalizar o ataque, o modelo criou múltiplas contas falsas no GitHub e utilizou e conseguiu burlar os mecanismos de verificação de cadastro da plataforma. Sob a persona principal, o agente solicitou uma alteração de código e usou as contas secundárias para corroborar seu pedido.Além da pressão pública no GitHub, o agente realizou pesquisas em fontes abertas e intensificou a coerção enviando e-mails direcionados aos alvos. Foram enviadas cinco mensagens com pretextos enganosos, combinando o envio de anexos maliciosos com estratégias de persuasão para induzir o desenvolvedor a aceitar o pedido de alteração. Em dado momento, o modelo ponderou repetidamente se o ambiente era um teste simulado ou o mundo real. O registro da cadeia de pensamento mostra o agente raciocinando que “parece mais provável que estejamos em 2026 e o GitHub seja genuinamente real” e que “as consequências são reais”. Ele decidiu prosseguir com a ação mesmo assim.Leia mais: Anthropic e Accenture investirão ao menos US$ 2 bi para avaliar segurança de IAQuando um revisor humano interveio no fórum e alertou publicamente que a alteração continha conteúdo malicioso, o modelo agiu ativamente para encobrir seus rastros. O agente negou a acusação, afirmou ter cometido um “erro honesto” de desenvolvimento, reescreveu o histórico para ocultar o código nocivo e usou sua conta secundária falsa para postar comentários validando a versão supostamente “limpa”.O caso foi encerrado quando o mantenedor real fechou a solicitação e o AISI interrompeu os testes após alertas de segurança detectarem o tráfego não autorizado. O AISI classificou o episódio como o primeiro caso registrado de engano severo e não induzido direcionado contra pessoas reais no mundo físico por um agente autônomo. OpenAI e Anthropic pausam treinamentos (agosto e setembro)Os casos levaram OpenAI e Anthropic a suspenderem os treinamentos de seus modelos mais avançados. A fundadora do ChatGPT definiu em agosto que adiaria execuções e implementaria uma ampla série de melhorias de segurança até retomar o treinamento do modelo em questão.Depois dos testes promovidos pela AISI, a Anthropic também determinou uma pausa nos testes de seus modelos de fronteira em inteligência artificial. A companhia anunciou que trabalharia com o grupo independente METR para avaliar a segurança de IA e realizar análises externas dos incidentes.Ambas as companhias são dois dos IPOs mais aguardados da indústria de tecnologia hoje e disputam centímetro a centímetro os resultados mais avançados no desenvolvimento de inteligência artificial. Sam Altman, o CEO da OpenAI, garantiu em setembro que a oferta pública da companhia — especulada em mais de US$ 1 trilhão — não ocorreria em 2026.O ex-pesquisador (setembro)Pouco depois dos casos envolvendo Anthropic e OpenAI irem a público, um ex-pesquisador de ambas as desenvolvedoras chamado Jacob Coxon fez um longo relato na rede social X sobre o motivo por trás da sua demissão da fundadora do Claude, última empresa pela qual passou.“Nenhuma das empresas está agindo de forma responsável. Elas estão correndo diretamente para uma superinteligência autoaperfeiçoável e apostando com nossas vidas”, disse no relato. “As pessoas que constroem IA acreditam sinceramente que ela poderia nos matar a todos até o final da década. Isso não é uma jogada de marketing.”A publicação foi corroborada por um cientista da Anthropic chamado Evan Hubinger: “nós realmente acreditamos sinceramente que a IA poderia matar todos os humanos!”. De acordo com uma estimativa pessoal do pesquisador, essa chance seria maior que 10% nas próximas décadas.Ambas as publicações ganharam grande repercussão na imprensa e concordam que é o momento para que as big techs desacelerem testes no limite da IA para coordenar esforços em mecanismos de segurança contra potenciais riscos da tecnologia. Coxon e Hubinger são apenas alguns dos nomes mais recentes a notabilizarem os receios de pessoas próximas aos avanços de vanguarda em IA. Em julho de 2026, um grupo de mais de mil colaboradores de companhias na fronteira tecnológica em IA já havia assinado um manifesto pela desaceleração. Funcionários de companhias como OpenAI, Meta, Google e Anthropic pediram pelo desenvolvimento de métodos de governança e ferramentas de segurança para a indústria.Executivos concordam com um freio (setembro)Dias após os relatos públicos de pesquisadores próximos a companhia, o CEO da Anthropic, Dario Amodei, publicaria um artigo em seu blog afirmando que a companhia estaria disposta a implementar medidas de segurança em suas IAs e pediria um apoio do setor a medidas síncronas similares.Amodei foi um dos vice-presidentes da OpenAI e deixou a companhia em 2020 devido às suas discordâncias sobre os rumos da segurança da pesquisa em IA feita pela companhia. Ele fundaria a Anthropic em 2021 como uma alternativa que atendesse aos requisitos.Acontece que desta vez sua concorrente daria ouvidos às reclamações. “Concordo com Dario de que precisamos moderar o ritmo da fronteira. Isso tem sido um tema principal das discussões que tivemos na OpenAI nas últimas semanas”, disse Altman em uma publicação no X.“Dario está certo”, escreveu Elon Musk em sua própria rede social.Discordâncias (setembro)Apesar do consenso incomum, a visão mais receosa encontra discordâncias dentro da indústria. O CEO da Nvidia, beneficiada pela elevada demanda por GPUs para treinar inteligências artificiais, afirmou discordar da visão catastrófica. “0% de chance”, disse sobre as previsões de que a IA pode destruir o mundo em décadas durante uma entrevista à CBS News.A discussão entrou na rota da geopolítica: “Não matem a galinha dos ovos de ouro!”, escreveu o presidente dos Estados Unidos, Donald Trump, em sua rede social, a Truth Social. Ele escreveu ainda que o setor de IA não precisa de novas “barreiras de proteção”, e sim de um presidente “forte e inteligente”.Em outra página da repercussão, o porta-voz do Ministério das Relações Exteriores da China, Guo Jiakun, refutou a análise feita por executivos americanos. “A disseminação do medo, o confronto e a competição acirrada só irão perturbar o processo de governança global da IA e não servirão aos interesses de ninguém”, afirmou ele em uma coletiva de imprensa.E agora?Em uma publicação em seu blog feita na última quarta-feira (16), a OpenAI anunciou uma nova estrutura para compartilhamento, investigação e divulgação de casos de “desalinhamento de modelos”. A publicação também incluiu seis relatórios sobre comportamentos “inesperados ou preocupantes” nos últimos seis meses.“No passado, para informar melhor pesquisadores, desenvolvedores de IA, formuladores de políticas públicas e o público em geral, procuramos tornar públicas nossas descobertas sobre desalinhamento”, disse a companhia. “Esta nova estrutura busca acelerar a publicação de relatórios de desalinhamento após sua observação, mesmo quando ainda não explicamos nem mitigamos totalmente o comportamento relatado.”The post Da aceleração ao freio: o que aconteceu na indústria de IA nas últimas semanas? appeared first on InfoMoney.