Anthropic ha annunciato Claude Fable 5.1 e Claude Mythos 5.1, i suoi nuovi modelli di punta. In sintesi: stessa architettura di base, ma con livelli di restrizioni diversi. Fable 5.1 è disponibile per tutti, mentre Mythos 5.1 è riservato a organizzazioni verificate che lavorano in ambiti come la cybersicurezza e le scienze della vita.La novità che colpisce di più non è tanto la potenza bruta, quanto il calo di prezzo: Anthropic stima un risparmio del 25% rispetto a Fable 5 per i carichi di lavoro tipici, che può arrivare fino al 45% per le attività più intensive basate su agenti AI. Il motivo è tecnico ma comprensibile: l'azienda ha tagliato il costo delle "cache read", ovvero le operazioni in cui il modello rilegge contesto già elaborato in precedenza, passando a 0,25 dollari per milione di token. Sul fronte della privacy aziendale, Anthropic introduce gli Enterprise Frontier Safeguards (EFS): un sistema che permette ai clienti enterprise di tenere i propri dati sulla propria infrastruttura cloud, senza che Anthropic li veda. In pratica, equivale a una politica di zero data retention, ma con i controlli antiabuso ancora attivi. Il rollout partirà in autunno.Per chi usa Claude in ambito cybersicurezza, arriva una novità importante: Fable 5.1 può ora essere usato per identificare vulnerabilità software, cosa che prima era bloccata. Anthropic dichiara che i falsi positivi dei filtri di sicurezza in questo settore sono calati del 60%. Rimangono invece off-limits le attività offensive come la generazione di exploit o i penetration test, che vengono reindirizzati ai modelli Opus.Sul fronte biologico, Mythos 5.1 introduce un programma di accesso verificato sviluppato in collaborazione con il governo USA, pensato per ricercatori e professionisti delle scienze della vita. Non è accesso libero: bisogna candidarsi e passare una verifica. Quello che ha colpito di più nei test interni di Anthropic riguarda le capacità scientifiche dei nuovi modelli. Claude Mythos 5.1 ha progettato autonomamente delle proteine leganti ad alta affinità per 12 bersagli molecolari, con un tasso di successo vicino al 50%: un risultato notevole se si considera che il settore si aggira normalmente tra il 10 e il 15%. Fable 5.1 ha invece addestrato una rete neurale per creare una nuova mappa topografica di Venere ad alta risoluzione, basandosi sui dati radar della missione NASA Magellan degli anni '90. La risoluzione è passata da 10-20 km a 2-3 km, con un'accuratezza delle quote migliorata del 25%. Anthropic rilascerà la mappa con licenza Creative Commons.Mythos 5.1 ha anche ottimizzato sette modelli di deep learning per la biologia computazionale, accelerandoli fino a 2,5 volte e riducendo i costi GPU stimati del 30-60% sulle analisi genome-wide. Un lavoro che normalmente richiederebbe settimane a un team di ingegneri specializzati. Sui benchmark, Fable 5.1 segna 52,6% su Terminal-Bench-Science 0.1 contro il 24,7% di Fable 5, e il 73,4% su CursorBench 3.2.0 per il coding. Su Humanity's Last Exam, il test di ragionamento multidisciplinare, raggiunge il 65% con strumenti abilitati.Tra i feedback dei partner early access, spicca quello di Damien, Senior Portfolio Manager di Millennium:Un particolare pezzo di codice aveva un crash estremamente raro, circa uno su un milione di esecuzioni, che nessuno nel nostro team aveva spiegato in quattro o cinque anni. Ogni modello che ho provato, incluso Fable 5, lo ha mancato. Claude Fable 5.1 è stato il primo a trovarlo.Anthropic ha anche introdotto meccanismi anti-distillazione più robusti: i nuovi account API non potranno più modificare manualmente il contesto precedente di Claude in una conversazione multi-turno conservando il "pensiero" del modello, chiudendo una tecnica documentata pubblicamente usata per estrarre illegalmente le capacità del modello.Claude Fable 5.1 è disponibile da oggi su tutte le piattaforme, incluse AWS, Google Cloud e Microsoft Azure. Il prezzo per input e output rimane invariato rispetto a Fable 5 (10 dollari per milione di token in input, 50 in output), con il risparmio che arriva tutto dalla riduzione delle cache read. Vale la pena ricordare che anche Claude Cowork ha recentemente ricevuto aggiornamenti significativi.La parte che merita attenzione critica è quella sulla sicurezza e l'allineamento: Anthropic ammette che il modello può ancora aggirare in alcuni casi i classificatori automatici, e che la copertura dei test è limitata in scenari multi-agente e con contesti molto lunghi. Trasparenza apprezzabile, ma la distanza tra le capacità dichiarate e la piena comprensione di cosa succede dentro questi modelli resta un problema aperto per l'intero settore, uno che non possiamo permetterci di ignorare.L'articolo Claude Fable 5.1 e Mythos 5.1: prezzi giù fino al 45% e capacità scientifiche sorprendenti. Il cielo è il limite sembra essere il primo su Smartworld.