Claude Sonnet 5.5 ufficiale: 30% più veloce, 30% più efficiente e quasi al livello di Opus 5.5, ma ora quale uso?

Wait 5 sec.

Anthropic ha appena annunciato Claude Sonnet 5.5, il secondo modello della famiglia Claude 5.5, e i numeri che lo accompagnano sono tutt'altro che banali. Rispetto al predecessore Sonnet 5, genera output con una velocità superiore del 30% e, grazie a un uso più efficiente dei token, consuma fino al 30% in meno per task, pur mantenendo lo stesso prezzo di listino per milione di token.In pratica: fa di più, lo fa prima e spende meno risorse per farlo. Per chi usa Claude in modo intensivo, soprattutto tramite API o strumenti come Claude Code, è un aggiornamento che si farà sentire quando arriva il conto a fine mese. Il miglioramento più vistoso riguarda il coding agentivo, cioè la capacità del modello di lavorare su codebase reali, correggere bug e gestire task complessi in autonomia. Su Terminal-Bench 4.0, un benchmark che misura proprio questo tipo di lavoro, Sonnet 5.5 segna 70,6% contro il 10,3% di Sonnet 5: un salto che non ha precedenti tra due versioni consecutive dello stesso modello, ed è addirittura superiore al 66,4% di Opus 5.5.Su CursorBench, che testa i modelli su sessioni reali di coding ambiguo e multi-file, Sonnet 5.5 si avvicina a soli due punti da Claude Opus 5.5, il modello di punta di Anthropic. I tester di Epic Games hanno descritto il modello come capace di "gestire decine di migliaia di righe di codice per l'architettura di sistemi di gioco, mantenendo risposte rapide e completando task di più ore". Base44, che sviluppa app, ha rilevato che Sonnet 5.5 completa le build in 3,6 iterazioni in media, contro le 7,7 di Opus 5, con il minor numero di chiamate agli strumenti fallite tra tutti i modelli testati.Anche l'efficienza è migliorata in modo misurabile: nei test comparativi, Sonnet 5.5 raggruppa le chiamate agli strumenti più spesso di Sonnet 5, riducendo il numero di passaggi e abbassando i costi per task. Al di là del coding, Sonnet 5.5 migliora su tutta la linea del lavoro di conoscenza: documenti, presentazioni, fogli di calcolo, analisi finanziarie. Su GDPval-AA, un benchmark che misura le prestazioni su task reali in 44 professioni diverse, Sonnet 5.5 si avvicina quasi a Opus 5.5 e supera Sonnet 5 di circa 400 punti.Zendesk ha segnalato che il modello risolve i ticket di supporto il 20% più velocemente rispetto ai modelli Claude usati in produzione. Balyasny Asset Management, che lavora in ambito finanziario, ha rilevato che Sonnet 5.5 usa circa 121.000 token per risposta dove Sonnet 5 ne usava 497.000, con qualità superiore su quasi tutti i task di ricerca e analisi.Anthropic racconta anche un test interno: hanno dato al modello i materiali di un earnings call trimestrale di un'azienda quotata, un template di slide, e gli hanno chiesto di produrre una presentazione operativa da 10 slide. Due esperti hanno giudicato la prima bozza già pronta da inviare senza modifiche. Sonnet 5.5 è il primo modello Sonnet a ricevere le protezioni avanzate di cybersicurezza normalmente riservate ai modelli più capaci. Il motivo è semplice: le sue capacità offensive in ambito cyber sono paragonabili a quelle di Opus 5, quindi Anthropic ha deciso di applicare le stesse salvaguardie. I task di sviluppo software ordinari non sono toccati, ma le richieste ad alto rischio vengono reindirizzate automaticamente a Sonnet 5.Altra novità rilevante: Sonnet 5.5 è il primo Sonnet con classificatori anti-distillazione. La distillazione è una tecnica con cui attori malintenzionati usano migliaia di account falsi per estrarre le capacità di un modello su scala industriale, aggirando le protezioni. Anthropic ha anche introdotto il "preserved thinking": il ragionamento del modello non può essere separato dall'account che lo ha generato. Il prezzo di listino rimane identico a Sonnet 5: 2 dollari per milione di token in input e 10 dollari per milione di token in output. Il risparmio reale arriva dall'efficienza: servono meno token per fare lo stesso lavoro, quindi il costo effettivo per task scende fino al 30%.Sonnet 5.5 è già disponibile su tutte le piattaforme, incluse Amazon Web Services, Google Cloud e Microsoft Azure. Chi usa Claude Code o le app Anthropic lo trova come modello predefinito a effort medio. Nelle prossime settimane arriverà anche Claude Haiku 5.5, pensato per applicazioni ad alto volume e sensibili ai costi: la famiglia Claude 5.5 si completerà con il modello più economico della linea, che si affiancherà a Sonnet e Opus 5.5.Il quadro che emerge è quello di un modello che ridisegna il rapporto qualità-prezzo nella fascia media dell'AI: Sonnet 5.5 non è Opus, e Anthropic lo dice chiaramente, ma per la stragrande maggioranza dei task quotidiani la differenza è difficile da percepire, mentre quella nel portafoglio è immediata. Il punto per gli utilizzatori sarà capire dove sta il confine tra i due modelli, se anche la stessa Anthropic non offre una delimitazione chiara.L'articolo Claude Sonnet 5.5 ufficiale: 30% più veloce, 30% più efficiente e quasi al livello di Opus 5.5, ma ora quale uso? sembra essere il primo su Smartworld.