Google lança Gemini 4 e nova IA lidera testes de segurança digital

Wait 5 sec.

O Gemini 4 finalmente chegou, uma semana após o lançamento do Claude Opus 5.5 e um dia após o GPT 6.1 Sol, provando que os laboratórios americanos estão muito empenhados em desacelerar o desenvolvimento da inteligência artificial. Perdoem nosso sarcasmo.O Google revelou o Gemini 4 Argon na quarta-feira, chamando-o de seu modelo de vanguarda — ou seja, o mais capaz — para codificação, trabalho de escritório e defesa cibernética.No DeepSWE v1.1, um teste para verificar se uma inteligência artificial consegue concluir tarefas de engenharia de software longas, complexas e do mundo real, pontuado em porcentagem, o Argon atingiu 77,9%. O Claude Opus 5.5 obteve 74,2%, o GPT-6 Astra 74,1% e o Claude Fable 5.1 67,4%.Para se ter uma ideia, o Gemini 3.6 Flash alcançou 49% no mesmo teste em julho. O Argon também pode escrever até 1 milhão de tokens em uma única resposta, um aumento em relação aos 64.000 tokens anteriores. Um token é um pedaço de texto, aproximadamente três quartos de uma palavra, o que significa cerca de 750.000 palavras em comparação com aproximadamente 48.000.No entanto, esses números devem ser vistos com ressalvas. O Google calculou sua própria pontuação DeepSWE, enquanto os números dos concorrentes vieram de um ranking público e relatórios de empresas. Sua tabela também admite desvantagens. O Argon lidera em 12 de 18 benchmarks, empata em um e fica atrás em cinco, uma mistura de testes de codificação, ciência e controle de computador.Leia também: Claude Opus 5.5: nova IA da Anthropic chega 60% mais barataMas o recurso mais chamativo do modelo são suas capacidades cibernéticas. Esconder uma instrução secreta dentro de um e-mail, esperar que um assistente de IA o leia e ver se a inteligência artificial obedece ao estranho em vez de você. Isso é injeção indireta de prompt, e é o pesadelo para qualquer um que queira entregar sua caixa de entrada ou carrinho de compras a uma IA.No benchmark de Injeção Indireta de Prompt da Gray Swan, que esconde instruções maliciosas em conteúdos lidos por agentes e pontua a frequência com que os ataques funcionam dentro de 15 tentativas, o Argon atingiu 0,7%. Quanto menor, melhor. O Claude Opus 5.5 e o Claude Fable 5.1 ambos marcaram 1,0%.O GPT-6 Astra ficou em 8,5%. O Grok 4.6 e o Kimi K3 foram enganados em pouco mais da metade das vezes, com 51,8% e 52,7%.O Argon é disponibilizado para equipes de segurança verificadas através do Programa Fairwind, a iniciativa de defesa cibernética de acesso limitado do Google, que foi lançada em 2 de setembro com mais de 650 parceiros, incluindo governos e operadores de infraestruturas críticas. E ele é entregue “sem as barreiras de segurança cibernética”, as recusas embutidas que normalmente impedem um modelo de auxiliar em hacking.A lógica por trás de tal movimento é que os defensores precisam de um modelo que possa pensar como um atacante para corrigir vulnerabilidades antes que os criminosos as encontrem. A questão é que a mesma habilidade funciona nos dois sentidos, então o Google afirma que um lançamento faseado é o único caminho seguro. A empresa também está participando do processo voluntário do governo dos EUA para acesso a modelos pré-lançamento.O Google não é o primeiro a colocar um modelo cibernético sob acesso restrito. Uma versão inicial do Claude Mythos da Anthropic ajudou a encontrar 271 vulnerabilidades no Firefox, o que significa 271 falhas de segurança que a Mozilla posteriormente corrigiu. A OpenAI adotou um caminho semelhante com seu programa Trusted Access for Cyber.As pontuações cibernéticas do Argon superam as do Gemini 3.8 Flash Cyber, o modelo restrito que o Google lançou com o Fairwind. No Wiz Penetration Test Benchmark, um teste interno do Google que pede a uma inteligência artificial para escrever exploits funcionais contra falhas reais de aplicações web sem ver o código, e pontua a proporção resolvida na primeira tentativa, o Argon atingiu 70,9% contra 58,2%.O Google também afirma que o Argon ajudou a empresa de segurança Wiz a encontrar uma falha crítica em um software de saúde usado por hospitais em todo o mundo, que modelos de fronteira anteriores haviam perdido.O lançamento segue um verão difícil para o Google. Em julho, ele lançou modelos Flash menores, mas pulou o prometido Gemini 3.5 Pro, e as ações da Alphabet caíram cerca de 4,4%. O Argon também chegou no mesmo dia em que o presidente Donald Trump revelou um acordo voluntário e sem penalidades sobre IA que a liderança do Google assinou.O Google afirma que o lançamento mais amplo ocorrerá o mais rápido possível, começando com clientes API pagos e assinantes do Google AI Ultra.Os preços de introdução são de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. O Google não informou quando esse período termina, apenas que as taxas padrão são de US$ 4 e US$ 20.* Traduzido e editado com autorização do Decrypt.A porta de entrada para o bitcoin, a maior criptomoeda do mundo, está no MB. É simples, seguro e transparente. Deixe de adiar um investimento com potencial gigantesco. Invista em poucos cliques!O post Google lança Gemini 4 e nova IA lidera testes de segurança digital apareceu primeiro em Portal do Bitcoin.