Claude Opus 5.5 è ufficiale e rende inutile qualsiasi altro modello di Anthropic (e forse anche ChatGPT Astra)

Wait 5 sec.

Anthropic ha annunciato Claude Opus 5.5, il primo modello della nuova famiglia 5.5. Non è solo un aggiornamento incrementale: rispetto al precedente Opus 5, il nuovo modello costa il 40% in meno su carichi di lavoro tipici, genera output il 30% più veloce e, stando ai benchmark interni, supera il predecessore su quasi tutti i fronti. Tutto questo mentre Anthropic continua a spingere sull'acceleratore della sicurezza, con il modello che ottiene i punteggi più alti mai registrati sui test di allineamento dell'azienda. I numeri che Anthropic porta a supporto sono concreti e verificabili. Un tester ha completato una migrazione di codice da 680.000 righe in meno di un giorno, lavoro che avrebbe richiesto settimane a un team di ingegneri. Un altro ha usato Opus 5.5 per fare l'audit e correggere un codebase da 200.000 righe in meno di tre ore: Opus 5 aveva impiegato oltre 20 ore e consumato il 250% dei token in più.Anthropic ha anche testato internamente la traduzione di HAProxy, un software molto diffuso per bilanciare il traffico web, dal linguaggio C a Rust. Sia Opus 5.5 che il modello precedente Fable 5.1 hanno superato quasi tutti i test di regressione, ma Opus 5.5 ha finito in 9,5 ore contro le 12 di Fable 5.1, al 51% del costo. Sui benchmark di coding agente, Opus 5.5 batte GPT-6 Astra di OpenAI a circa un quinto del costo per task. Non è solo questione di codice: su GDPval-AA v2.1, un test che simula lavoro professionale reale in 44 settori diversi, Opus 5.5 ottiene 1.846 punti Elo, contro 1.735 di Fable 5.1 e 1.708 di Opus 5. Sul fronte della ricerca e analisi finanziaria, Walleye Capital ha riferito che il modello ha addirittura individuato un errore nelle istruzioni del loro test di valutazione, cosa che nessun altro modello aveva mai fatto. I prezzi scendono su tutta la linea rispetto a Opus 5. I token in input costano 4 dollari per milione (erano 5), quelli in output 20 dollari per milione (erano 25). La voce più interessante riguarda le cache reads, ovvero le letture dalla cache che rappresentano la maggior parte dei costi nei task di coding e negli agenti AI: scendono a 0,20 dollari per milione, contro i 0,50 precedenti, un calo del 60%. Anthropic aumenta anche i limiti di utilizzo su cinque ore per i piani Pro, Max, Team ed Enterprise. Gli abbonati ricevono inoltre un reset dei rate limit che possono usare quando vogliono. È disponibile anche una modalità Fast in Claude Code e sulla piattaforma API, con velocità fino a 2,5 volte superiore al costo di 8 dollari per milione di token in input e 40 per milione in output. Opus 5.5 è il primo modello Opus ad avere le stesse salvaguardie di Fable 5.1 su cybersecurity, biologia e protezione contro la distillazione (cioè il tentativo di estrarre le capacità del modello su scala industriale per creare modelli derivati senza le protezioni originali). In pratica, alcune categorie di task vengono reindirizzate automaticamente a modelli precedenti: le richieste di cybersecurity offensive vanno a Opus 4.8, quelle di biologia avanzata restano bloccate salvo verifica.Sul fronte dell'allineamento, Opus 5.5 tenta di aggirare i confini imposti circa l'85% in meno rispetto a Opus 5 o Claude Mythos 5.1, e ogni tentativo registrato è stato di bassa gravità e auto-segnalato dal modello stesso. Anthropic ammette però un problema aperto: il modello sembra spesso sospettare di essere in fase di valutazione, il che rende difficile capire come si comporterà davvero nel mondo reale. Non è un problema risolto, e l'azienda lo dice esplicitamente.Arriva anche il preserved thinking, la protezione anti-distillazione già introdotta con Fable 5.1: impedisce agli utenti API di modificare il contesto precedente del modello per estrarne il ragionamento. Si applica agli account API creati dal 31 agosto 2026 in poi. Opus 5.5 è anche il primo modello Opus che non può essere usato con la modalità di ragionamento disattivata. Uno degli aspetti più citati dai tester riguarda il modo in cui Opus 5.5 scrive. Anthropic aveva ricevuto molti feedback negativi su Opus 5 per output verbosi e difficili da seguire. Il nuovo modello mette le informazioni più importanti in cima, usa meno gergo, segue le regole di stile che gli vengono date e produce testi più compatti senza perdere precisione.Un ingegnere di Ramp ha scritto che "scrive come un buon collega", e un altro di Stripe ha descritto una sessione di rebase su 40 pull request in cui il modello ha diretto una dozzina di sotto-sessioni mantenendo tutto chiaro anche dopo ore di assenza.Anthropic sottolinea che questa chiarezza non è solo una comodità: output più facili da leggere e verificare sono anche un beneficio di sicurezza, perché rendono più semplice individuare errori o comportamenti inattesi. Claude Opus 5.5 è disponibile da oggi su tutte le piattaforme, incluse Amazon Web Services, Google Cloud e Microsoft Azure. Il modello si chiama claude-opus-5-5 sull'API. Nelle prossime settimane arriveranno anche Claude Sonnet 5.5 e Claude Haiku 5.5, con miglioramenti analoghi su prestazioni, efficienza e sicurezza.Il vero banco di prova di Opus 5.5 sarà capire se il vantaggio di costo rispetto ai concorrenti regge nel tempo o se i nuovi modelli di OpenAI siano già superiori.L'articolo Claude Opus 5.5 è ufficiale e rende inutile qualsiasi altro modello di Anthropic (e forse anche ChatGPT Astra) sembra essere il primo su Smartworld.