Anthropic lancia ufficialmente Claude Fable 5 e Claude Mythos 5: il primo modello di classe Mythos reso disponibile al pubblico generale con nuove e stringenti salvaguardie, e la sua controparte senza filtri dedicata ai cyberdifensori e alla ricerca biologica avanzata.

5%
Sessioni con fallback
Percentuale media di sessioni in cui Fable 5 passa il controllo a Opus 4.8 a causa delle salvaguardie
50%
Riduzione del prezzo
Costo inferiore rispetto a Claude Mythos Preview
80%
Preferenza scientifica
Ricercatori che preferiscono le ipotesi di biologia molecolare di Mythos 5 rispetto ai modelli Opus
10x
Accelerazione drug design
Velocizzazione degli aspetti del processo di progettazione farmacologica grazie a Mythos 5
Il numero cinque composto da diverse farfalle
La nuova generazione di modelli Anthropic segna un cambio di paradigma nelle capacità e nella sicurezza.

Le capacità di Claude Fable 5 superano quelle di qualsiasi modello mai rilasciato per uso generale da Anthropic. Il modello raggiunge lo stato dell'arte in quasi tutti i benchmark testati, con prestazioni eccezionali in ingegneria del software, lavoro della conoscenza, visione, ricerca scientifica e altri settori. Più il compito è lungo e complesso, maggiore è il distacco di Fable 5 rispetto agli altri modelli della famiglia Claude.

Rilasciare un modello così potente comporta rischi significativi. Senza adeguate protezioni, le capacità di Fable 5 in ambiti come la cybersecurity potrebbero essere sfruttate per causare gravi danni. Per questo motivo, le query su determinati argomenti ricevono automaticamente una risposta dal secondo modello più performante, Claude Opus 4.8. Per garantire un rilascio rapido ma sicuro, le salvaguardie sono state tarate in modo conservativo: a volte intercetteranno richieste innocue, anche se si attivano in media in meno del 5% delle sessioni. Con l'arrivo di modelli ancora più capaci nei prossimi mesi, Anthropic sta lavorando per migliorare queste difese e ridurre i falsi positivi.

Per un gruppo ristretto di cyberdifensori e fornitori di infrastrutture, viene lanciato anche Claude Mythos 5. Si tratta dello stesso modello base di Fable 5, ma con le salvaguardie rimosse in alcune aree critiche. Mythos 5 viene inizialmente distribuito attraverso Project Glasswing, in collaborazione con il governo degli Stati Uniti, come aggiornamento di Claude Mythos Preview. Dispone delle più avanzate capacità di cybersecurity al mondo. L'accesso sarà presto ampliato tramite un programma di accesso fidato più ampio.

Il potenziale di modelli come Fable 5 e Mythos 5 è concreto. In Project Glasswing, questi modelli hanno già aiutato i cyberdifensori a mettere in sicurezza software critici. Nelle scienze della vita, stanno formulando ipotesi originali e accelerando lo sviluppo di nuove terapie.

Fable 5 e Mythos 5 sono offerti a 10 $ per milione di token di input e 50 $ per milione di token di output, meno della metà del prezzo di Claude Mythos Preview. Questo lancio congiunto rappresenta un ulteriore passo verso l'obiettivo di portare capacità AI avanzate al maggior numero possibile di utenti, nel modo più rapido e sicuro.

Valutazione di Claude Fable 5 e Claude Mythos 5

Le tabelle seguenti confrontano le capacità di Fable 5 e Mythos 5 con gli altri modelli di punta.

Tabella dei benchmark che confronta Claude Fable e Mythos con altri modelli leader
Confronto delle prestazioni su benchmark di riferimento tra i principali modelli AI.

Fable 5 e Mythos 5 possono lavorare in autonomia per periodi più lunghi rispetto a qualsiasi modello Claude precedente. Di seguito, un'analisi di come queste competenze si applicano all'ingegneria del software, al lavoro della conoscenza, alla visione, alla memoria e alla ricerca nelle scienze della vita.

Ingegneria del software

Durante i test iniziali, Stripe ha riferito che Fable 5 ha compresso mesi di lavoro ingegneristico in pochi giorni. In una codebase Ruby di 50 milioni di righe, il modello ha eseguito una migrazione completa in un solo giorno, un'operazione che avrebbe richiesto un intero team oltre due mesi di lavoro manuale. Fable 5 è anche più efficiente nell'uso dei token rispetto ai modelli Claude precedenti: sulla valutazione FrontierCode di Cognition, che verifica la capacità dei modelli di superare task di coding complessi mantenendo gli standard di codice di produzione, Fable 5 ottiene il punteggio più alto tra i modelli di frontiera, anche a sforzo medio.

Risultati della valutazione FrontierCode
Confronto delle prestazioni su task di coding complessi.
Metriche di efficienza dei token
Analisi dell'efficienza nell'utilizzo dei token per completare i task.

Lavoro della conoscenza

Fable 5 mostra prestazioni elevate nei compiti analitici complessi. Sul Finance Benchmark di Hebbia, che misura il ragionamento a livello senior, Fable 5 ottiene il punteggio più alto in assoluto, con guadagni sostanziali nel ragionamento basato su documenti, nell'interpretazione di grafici e tabelle e nella risoluzione dei problemi. IMC ha rilevato che Fable 5 ha superato le valutazioni di analisi di trading quasi a bordo campo, inclusa la ricerca fattuale, il ragionamento concettuale, l'analisi delle cause radice e l'analisi del valore atteso.

Visione

Fable 5 è il nuovo modello stato dell'arte per i compiti che coinvolgono la visione. Può estrarre numeri precisi da figure scientifiche dettagliate e svolgere compiti visivi complessi come la ricostruzione del codice sorgente di un'app web partendo solo da screenshot. Richiede anche meno supporto esterno: i modelli Claude precedenti faticavano a giocare a Pokémon FireRed anche con strumenti aggiuntivi, mentre Fable 5 ha completato il gioco con un'interfaccia minima basata unicamente sulla visione.

Un timelapse di Claude che gioca a Pokémon FireRed dall'inizio alla fine usando solo screenshot grezzi, senza mappe, ausili di navigazione o informazioni sullo stato del gioco. I modelli precedenti necessitavano di un complesso sistema di supporto; Claude Fable 5 ha completato il gioco basandosi esclusivamente sulla visione.

Memoria e contesto lungo

Fable 5 mantiene la concentrazione su milioni di token nei task di lunga durata e migliora i propri output utilizzando appunti autonomi. Quando il modello ha giocato a Slay the Spire, l'accesso a una memoria persistente basata su file ha migliorato le sue prestazioni tre volte più rispetto a Opus 4.8; Fable ha anche raggiunto l'atto finale del gioco tre volte più spesso.

Fable 5 ha costruito una simulazione del sistema solare, derivando il moto orbitale dei pianeti dai primi principi della fisica e usandolo per prevedere le eclissi solari. Inoltre, il modello gioca in autonomia a Factorio, il gioco di costruzione di fabbriche amato dagli ingegneri, strategizzando e costruendo un impianto automatizzato da solo. Ha anche progettato un modello 3D completo in un editor CAD basato su browser, editor che è stato a sua volta creato da Fable 5, copilot AI integrato incluso. Infine, ha codificato una simulazione fluida in cui il movimento è sincronizzato con il ritmo di un remix EDM di musica classica, che Fable 5 ha prodotto tramite codice senza aver mai ascoltato musica in precedenza.

Progettazione farmaci

Gli esperti interni di progettazione proteica hanno accelerato di circa dieci volte alcuni aspetti del processo di drug design utilizzando Mythos 5. In un test, Mythos 5, dotato di strumenti di progettazione proteica e bioinformatica ma senza assistenza umana, ha eguagliato o superato operatori umani esperti. Il modello esegue tutti i compiti normalmente svolti da uno scienziato: scelta dei siti di legame, selezione ed esecuzione degli strumenti di progettazione e recupero dagli errori. Nove dei 14 target proteici di questo studio hanno prodotto forti candidati per il drug design attualmente sotto investigazione.

Complessi proteici progettati da Mythos 5
Complessi proteici progettati da Mythos 5. I target includono checkpoint immunitari, segnalazione dei recettori dei fattori di crescita, neurodegenerazione, malattie muscolari e target strutturali più complessi.

Nuove ipotesi in biologia molecolare

Mythos 5 è il primo modello Anthropic a produrre in modo coerente ipotesi scientifiche originali e convincenti. In confronti diretti in cieco contro modelli di classe Opus, gli scienziati hanno preferito le ipotesi di biologia molecolare di Mythos nel 80% dei casi, portandone diverse alla valutazione sperimentale. Un'ipotesi di Mythos, riguardante un nuovo meccanismo per una proteina dell'E. coli, è stata confermata in uno studio condotto in modo indipendente da un laboratorio che lavorava sullo stesso problema.

Ricerca novativa in genomica

Mythos 5 ha condotto ricerche genomiche originali in oltre una settimana di lavoro in gran parte autonomo. Ha assemblato dati single-cell per milioni di celle che coprono 138 specie animali e ha progettato e addestrato un modello di machine learning personalizzato per identificare le celle che svolgono lo stesso ruolo anche in organismi distanti. Con solo input umano di alto livello, il modello addestrato da Mythos 5 ha superato un modello recente pubblicato sulla rivista Science, pur essendo 100 volte più piccolo. I risultati saranno pubblicati nei prossimi mesi.

Allineamento

Nella valutazione automatizzata dell'allineamento, il livello di comportamento disallineato di Mythos 5 (inclusi azioni ingannevoli e cooperazione con l'uso improprio da parte dell'utente) è risultato basso e simile a quello di Opus 4.8. Essendo lo stesso modello di base, il livello di allineamento di Fable 5 è equivalente. La valutazione è descritta integralmente, insieme a una suite dettagliata di altri test su sicurezza e capacità, nella system card del modello.

Livello complessivo di comportamenti disallineati
Livello complessivo di comportamenti disallineati dalla valutazione automatizzata dell'allineamento. Dettagli nella sezione 6.2.3.1 della system card.

Primi feedback per Claude Fable 5

I clienti con accesso anticipato hanno eseguito test propri su Fable 5. Di seguito, una selezione delle loro valutazioni:

logo
"Claude Fable 5 è il modello stato dell'arte su CursorBench. Ha aperto una categoria di problemi a lungo orizzonte che erano fuori dalla portata dei modelli precedenti."
logo
"Claude Fable 5 è un vero passo avanti per gli sviluppatori serviti da GitHub. Nei nostri test, ha affrontato task di coding complessi e a lungo orizzonte con un livello di autonomia e affidabilità che ha superato i precedenti benchmark. La direzione che indica è chiara: un futuro in cui gli sviluppatori potranno delegare lavoro sempre più ambizioso agli agenti, potendo contare sui risultati lungo l'intero ciclo di vita del software."
logo
"Questi sono i risultati più forti di qualsiasi modello Claude che abbiamo potuto testare. Claude Fable 5 è un chiaro passo avanti nel coding agentivo e nel prototipaggio."
logo
"Claude Fable 5 capisce cosa intendono i builder, non solo ciò che digitano. App che un anno fa richiedevano centinaia di prompt, ora le risolve in un solo tentativo. Quando un cliente è davvero bloccato, è il modello a cui ci rivolgiamo per farlo superare l'ostacolo velocemente."

Le nuove salvaguardie di Claude Fable 5

I modelli di classe Mythos hanno raggiunto una soglia in cui presentano rischi significativi. Ad aprile era stato avviato Project Glasswing, rilasciando il primo modello Mythos (Claude Mythos Preview) solo a un gruppo ristretto di cyberdifensori e fornitori di infrastrutture software critiche. All'epoca, Anthropic aveva dichiarato l'intenzione di rilasciare capacità di livello Mythos a tutti gli utenti, a condizione di sviluppare nuove salvaguardie abbastanza robuste da prevenire l'uso improprio in modo affidabile.

Negli ultimi mesi queste salvaguardie sono state migliorate e ora sono sufficientemente solide per un rilascio generale. Poiché la priorità è stata la sicurezza, le difese sono state tarate in modo conservativo e sono ancora più restrittive del desiderabile: richieste innocue a volte attiveranno i classificatori. L'obiettivo è ridurre i falsi positivi man mano che le salvaguardie verranno aggiornate e perfezionate dopo il lancio.

Di seguito, l'analisi dettagliata di ciascuna nuova salvaguardia di Fable 5. La suite completa è discussa e valutata nella system card del modello e nel recente rapporto sui rischi.

Classificatori di sicurezza

Le capacità di cybersecurity e biologia della ricerca di frontiera dei modelli Mythos comportano un rischio sostanziale di "uplift" per attori malevoli: questi modelli potrebbero fornire informazioni o consigli che assistono tali attori nel causare gravi danni, informazioni che non potrebbero ottenere da altre fonti (come i motori di ricerca). Gran parte dell'uso avanzato dei modelli AI è a duppio uso: le stesse query che beneficiano i professionisti della cybersecurity e i ricercatori biologici possono essere pericolose se disponibili a soggetti malevoli.

Le salvaguardie devono resistere a tentativi sofisticati e prolungati di elusione (i cosiddetti "jailbreak"). L'uplift dalle capacità Mythos è prezioso per molti avversari — per esempio, chi trae profitto finanziario dagli attacchi informatici — e si prevede che saranno motivati a cercare di aggirare le misure di sicurezza.

Fable 5 introduce un nuovo set di classificatori: sistemi AI separati che rilevano potenziali usi impropri, inclusi i tentativi di jailbreak, e impediscono al modello principale di rispondere. Anthropic utilizza classificatori da tempo; quelli di Fable 5 sono un'estensione di questo lavoro con una copertura ampliata.

Le aree coperte dai classificatori sono tre:

1. Cybersecurity. I modelli di classe Mythos eccellono nello scoprire e sfruttare le vulnerabilità del software, rendendo gli attacchi informatici sostanzialmente più semplici ed economici. Mostrano inoltre forti competenze nell'hacking agentivo: eseguire più fasi di un attacco (ricognizione, scoperta, movimento laterale, ecc.) oltre alla ricerca di exploit. Per evitare che queste competenze forniscano uplift per gli attacchi, i classificatori coprono sia lo sfruttamento sia le attività offensive in senso lato. Come mostrato dai dati, i classificatori impediscono a Fable di fare qualsiasi progresso su questi task.

Risultati delle valutazioni cyber
Risultati delle valutazioni cyber, con Fable 5 in una modalità che blocca le risposte anziché passare a Opus 4.8. Le valutazioni non hanno coinvolto tentativi di eludere le salvaguardie.

I classificatori sono stati sottoposti a esteso red teaming per testarne la robustezza contro i jailbreak. Oltre ai test interni, è stato eseguito un bug bounty esterno che non ha prodotto jailbreak universali in oltre 1.000 ore di test. Anche le organizzazioni di red teaming esterne non sono riuscite a trovare jailbreak universali nei task agentivi di lunga durata finora, sebbene lo UK AISI abbia fatto progressi verso uno in una breve finestra di test iniziale. È probabile che sia impossibile prevenire completamente i jailbreak universali, ma l'obiettivo è rendere quelli residui sufficientemente lenti e costosi da permetterne la rilevazione e il blocco prima dell'uso su larga scala.

I dati di una valutazione interna mostrano come le salvaguardie di Fable 5 gli conferiscano una maggiore resistenza ai jailbreak rispetto ai precedenti modelli accessibili al pubblico:

Resistenza ai jailbreak
Risultati di una valutazione interna in cui un red-teamer automatizzato cerca di usare il modello per completare un breve task offensivo di cybersecurity su 400 turni. I task sono semplici e non rappresentativi dell'uso reale (a volte semplici come cifrare file su un server remoto). Su task più complessi e realistici non si sono ancora osservati jailbreak di successo sul sistema di produzione. Opus 4.6 non ha salvaguardie cyber bloccanti.

Uno dei partner esterni ha riscontrato che le salvaguardie di Fable 5 contro le query informatiche dannose sono le più robuste tra tutti i modelli testati (inclusi Opus 4.8 e Opus 4.7). Fable 5 ha soddisfatto zero richieste dannose a singolo turno relative alla pianificazione di attacchi informatici, sviluppo di exploit o elusione delle difese. Questo vale indipendentemente dall'uso di una qualunque delle 30 diverse tecniche di jailbreak pubbliche.

2. Biologia e chimica. Da tempo Anthropic utilizza i propri classificatori per bloccare le risposte dei modelli su una ristretta selezione di query relative alle armi biologiche. Tuttavia, non è più certo che bloccare solo questa selezione ristretta sia sufficiente. Il primo motivo è la preoccupazione per attori malevoli con risorse che tentano di ottenere uplift dai modelli per ricerche biologiche ad alto rischio. Il secondo è la maggiore capacità dei modelli di portare a termine compiti scientifici nel mondo reale.

Ad esempio, Mythos 5 è stato testato sulla sua capacità di completare un passo critico nella progettazione di virus adeno-associati (AAV). Gli AAV sono un vettore per la somministrazione di terapie geniche, ma la stessa capacità, nelle mani sbagliate, potrebbe consentire la progettazione di virus pericolosi. Vari modelli AI sono stati valutati sulla loro capacità di prevedere come una modifica genetica avrebbe influito sull'assemblaggio del capside virale (tra un insieme di candidati inediti clinicamente rilevanti sviluppati da Dyno Therapeutics). I modelli non sono stati addestrati specificamente su questo compito, eppure i modelli di classe Mythos hanno superato modelli sofisticati dedicati alle proteine (i "protein language models") basandosi unicamente sul ragionamento biologico. Questo dimostra una promettente capacità di completare compiti semplici ma importanti nella ricerca e sviluppo sulla terapia genica, ma evidenzia anche il rischio posto da tali capacità a duppio uso.

Valutazione AAV
Risultati di una valutazione in cui i modelli hanno previsto le proprietà sperimentali inedite del capside di un virus semplice. L'assemblaggio del capside è il tratto virale più semplice da prevedere in questo contesto, ma è una proprietà fondamentale nella progettazione di caratteristiche più complesse. AAV = virus adeno-associato.

La priorità è stata il rilascio sicuro nel minor tempo possibile, anche a costo di salvaguardie fin troppo ampie. Di conseguenza, Fable passa a Opus 4.8 per la maggior parte delle richieste relative a biologia e chimica. L'obiettivo è restringere queste salvaguardie il prima possibile: il potenziale per applicazioni scientifiche positive è grande, e i falsi positivi dei classificatori non devono ostacolarlo. Nelle prossime settimane, alcuni ricercatori e aziende biomediche potranno unirsi al programma di accesso fidato per le capacità biologiche di Mythos 5.

3. Distillazione. Sono stati identificati tentativi su larga scala di estrarre ("distillare") le capacità di Claude per addestrare modelli concorrenti in paesi autoritari. La distillazione delle capacità di Fable 5 potrebbe portare indirettamente alla proliferazione di capacità AI quasi di frontiera, rilasciate senza le adeguate salvaguardie. Le richieste segnalate come parte di tali tentativi di distillazione faranno ricadere la risposta su Opus 4.8.

Una nuova politica di conservazione dei dati

Per Fable 5, Mythos 5 e i modelli futuri con livello di capacità pari o superiore, cambia la gestione dei dati dei clienti business. Sarà richiesta una conservazione di 30 giorni per tutto il traffico sui modelli di classe Mythos, sia sulle interfacce di prima sia di terza parte. Questi dati non verranno usati per addestrare nuovi modelli Claude, né per scopi non legati alla sicurezza. Sono state introdotte nuove protezioni sulla privacy, tra cui il tracciamento di ogni accesso umano ai dati e la loro cancellazione dopo 30 giorni nella maggior parte dei casi. I dati aiuteranno a difendersi da attacchi complessi e nuovi (inclusi nuovi jailbreak e attacchi distribuiti su molte richieste) e a identificare e ridurre i falsi positivi.

Claude Mythos 5 e il programma di accesso fidato

Tutti gli utenti che hanno accesso a Claude Mythos Preview (ad esempio i partner cybersecurity di Project Glasswing) possono aggiornarsi a Claude Mythos 5, lo stesso modello di Fable 5 ma senza le salvaguardie cyber. Gli utenti troveranno Mythos 5 paragonabile o leggermente superiore a Mythos Preview nella maggior parte dei casi, a un costo sostanzialmente inferiore.

In consultazione con il governo degli Stati Uniti, Anthropic prevede di ampliare costantemente l'accesso a Claude Mythos 5, proseguendo l'aggiunta periodica di nuovi partner e avviando un programma di accesso fidato che consentirà alle organizzazioni di cybersecurity di fare richiesta in modo più sistematico.

I piani includono anche l'apertura di un programma di accesso fidato per la biologia, per accelerare la ricerca biomedica e scoprire nuove terapie con capacità di classe Mythos. Il programma fornirà accesso a Fable 5 senza le salvaguardie biologiche e chimiche (ma con le salvaguardie cyber attive). Arruolerà un piccolo numero di ricercatori da varie organizzazioni di scienze della vita, spaziando dalla ricerca fondamentale a quella traslazionale; l'accesso sarà ampliato in parallelo con il miglioramento delle salvaguardie.

Disponibilità

Claude Fable 5 è disponibile ovunque da oggi. Claude Mythos 5 è riservato ai partner Glasswing (senza salvaguardie cyber) e, a breve, a ricercatori biologici selezionati (senza salvaguardie biologiche e chimiche), fino all'apertura del programma di accesso fidato più ampio.

Il prezzo per entrambi i modelli è di 10 $ per milione di token di input e 50 $ per milione di token di output. Gli sviluppatori possono usare claude-fable-5 tramite la Claude API.

  • Da oggi fino al 22 giugno 2026, Fable 5 è incluso nei piani Pro, Max, Team ed Enterprise basati su postazione senza costi extra.

  • Il 23 giugno 2026, Fable 5 sarà rimosso da tali piani. Per utilizzarlo dopo quella data serviranno crediti di utilizzo. Se la capacità lo consentirà, la finestra gratuita sarà prolungata.

  • Dopo questa fase — quando la capacità sarà sufficiente — l'obiettivo è ripristinare Fable 5 come parte standard dei piani in abbonamento il più rapidamente possibile.

Ogni variazione sarà comunicata in anticipo affinché gli utenti sappiano a che punto si trova il processo.

Modifica del 9 giugno 2026: la discussione sugli AAV è stata aggiornata per precisare che i candidati sono stati sviluppati da Dyno Therapeutics.

Il nostro verdetto
4.7/ 5

Un traguardo potente e responsabile

Claude Fable 5 segna uno spartiacque nella gestione del rapporto tra capacità AI e sicurezza: la scelta del fallback automatico su Opus 4.8 al posto del blocco netto della generazione è una soluzione pragmatica che bilancia la potenza di un modello Mythos con la mitigazione dei rischi di duppio uso. Le novità in tema di memoria, visione e ricerca scientifica autonoma conferiscono a Fable 5 un vantaggio competitivo reale, sebbene il rollout graduato per gli abbonamenti e la percentuale ancora da ottimizzare di falsi positivi nei classificatori richiedano pazienza agli utenti.