A Anthropic lançou o Claude Opus 5.5 na terça-feira, o primeiro modelo do que a empresa está chamando de sua família Claude 5.5. A Anthropic afirma que o novo modelo tem o desempenho do Claude Fable 5.1, seu carro-chefe mais caro, na maioria das tarefas.A reviravolta é que o modelo custa 20% menos para operar do que o Opus 5, o modelo que ele substitui, e é 60% mais barato que o Fable 5.1, a oferta de ponta da empresa.O modelo, ao que parece, é muito capaz. É o modelo mais avançado tanto em versão (5.5 versus Fable 5.1) quanto em família (Opus é o maior modelo disponível publicamente, seguido pelo Sonnet e Haiku sendo o menor).A Anthropic admite que a lacuna entre o Fable e o Opus é mais estreita do que seus resultados de benchmark sugerem, mas o fato de estar publicamente disponível por plano e ser mais barato por token, o torna a escolha óbvia para a maioria dos usuários do Claude.O Opus 5 foi lançado em julho, com preço e pontuação inferiores ao Fable 5 na maioria dos benchmarks, e o Fable 5.1 chegou no início de setembro e inverteu a situação, superando o Opus 5 em todos os benchmarks publicados pela Anthropic.O Opus 5.5 fecha a lacuna novamente, desta vez no preço, em vez de nas pontuações brutas. A Lovable, uma plataforma de desenvolvedores que testou o Opus 5 em seus próprios testes de codificação em julho, disse em um comunicado compartilhado pela Anthropic que o modelo anterior era “mais estável, com muito menos variação de execução para execução” do que o que o precedeu — o mesmo argumento de eficiência que a Anthropic está fazendo novamente agora.O Opus 5.5 também é o primeiro modelo que a Anthropic lançou desde que o CEO Dario Amodei publicou um ensaio pedindo para a indústria desacelerar, argumentando que os ganhos de capacidade da inteligência artificial estão superando os testes de segurança destinados a mantê-los sob controle. “Devemos desacelerar o ritmo no qual melhoramos as capacidades dos modelos de inteligência artificial”, escreveu Amodei no início deste mês.A Anthropic mede a maior parte desse progresso por meio da codificação agêntica — trabalho realizado por um agente de IA, um modelo que executa ações em várias etapas por conta própria, em vez de apenas responder a um único prompt.No Terminal-Bench 4.0, que testa se um agente pode concluir tarefas profissionais complexas dentro de uma interface de linha de comando e pontua o resultado como uma porcentagem de tarefas concluídas, o Opus 5.5 atingiu 66,4%, à frente dos 55,8% do Fable 5.1 e dos 57,9% do GPT-6 Astra. O FrontierCode, que verifica se as alterações de código de um agente seriam realmente mescladas em um pipeline de engenharia real usando o mesmo sistema de pontuação de aprovação, colocou o Opus 5.5 em 54,4% contra os 50,3% do Fable 5.1.No GDPval-AA v2.1, que classifica o trabalho profissional do mundo real em 44 ocupações usando Elo — o mesmo sistema de classificação estilo xadrez usado para medir a habilidade relativa em vez de uma porcentagem fixa — o Opus 5.5 obteve 1846 pontos contra 1735 do Fable 5.1 e 1708 do Opus 5.O Opus 5.5 não lidera em todos os lugares, no entanto. No AutomationBench, um benchmark construído pela Zapier que pontua se um agente pode realizar um fluxo de trabalho de negócios completo do início ao fim sem ajuda humana, os 41,4% do GPT-6 Astra superam os 40,0% do Opus 5.5.No Terminal-Bench-Science 0.1, que testa a pesquisa científica agêntica realizada em um ambiente de linha de comando usando o mesmo método de aprovação, os 64,6% do Astra superam os 58,7% do Opus 5.5 por uma margem maior.O maior diferencial é o custo. Os tokens de entrada — os blocos de texto que um modelo lê e escreve, precificados por milhão — custam agora US$ 4 para o Opus 5.5, contra US$ 5 para o Opus 5, e os tokens de saída caem para US$ 20, de US$ 25. As leituras de cache, que significam reutilizar o contexto que um modelo já processou em vez de reprocessá-lo do zero e que impulsionam a maior parte do custo em longas sessões de codificação agêntica, caem 60% para US$ 0,20 por milhão de tokens.Como o Opus 5.5 se iguala aos modelos da classe Mythos da Anthropic — a camada mais restrita da empresa, reservada para pesquisadores de segurança cibernética e biologia verificados — nessas duas capacidades, ele é lançado com as mesmas salvaguardas do Fable 5.1.A maioria das tarefas de segurança cibernética é automaticamente redirecionada para o Opus 4.8 mais antigo, o que é algo sobre o qual muitos desenvolvedores e usuários reclamaram anteriormente.O Opus 5.5 já está disponível nas plataformas da Anthropic, incluindo Amazon Web Services, Google Cloud e Microsoft Azure. O Sonnet 5.5 e o Haiku 5.5 seguirão nas próximas semanas, segundo a Anthropic, com os mesmos cortes de preço em toda a linha.* Traduzido e editado com autorização do Decrypt.Procurando uma alternativa para aumentar seus ganhos? A Renda Fixa Digital do MB é a solução: até 18% de ganho ao ano, risco controlado e a segurança que seu dinheiro merece. Conheça agora!O post Claude Opus 5.5: nova IA da Anthropic chega 60% mais barata apareceu primeiro em Portal do Bitcoin.