Corso
GPT-5.6 Sol di OpenAI è arrivato con recensioni secondo cui avrebbe raggiunto Anthropic. La società di valutazione Vals AI ha detto al New York Times che Sol si allineava grosso modo a Claude Fable 5 sui benchmark standard. La risposta di Anthropic, a settembre 2026, è Claude Fable 5.1, che definisce il modello più avanzato al mondo per coding e lavori di conoscenza insieme al suo gemello con restrizioni, Claude Mythos 5.1.
Fable 5.1 mantiene il listino di Fable 5 di $10 per milione di token in input e $50 per milione di token in output, e riduce le letture della cache del 75% a $0,25 per milione. Anthropic stima un risparmio pratico di circa il 25% per carichi tipici fatturati a token e fino a circa il 45% per quelli altamente agentici. Offre una finestra di contesto da 1M token con output massimo di 128K e più che raddoppia il punteggio di Fable 5 su Terminal-Bench-Science 0.1.
In questo articolo, vedremo tutte le novità di Claude Fable 5.1: nuove funzionalità, risultati sui benchmark e quanto costa davvero usarlo. Puoi anche consultare le nostre guide a Claude Fable 5 e il confronto tra Claude Opus 5 e Claude Fable 5.
Riepilogo
- Claude Fable 5.1 è il modello di frontiera generalmente disponibile di Anthropic per coding e ricerca a lungo orizzonte.
- Il listino è invariato rispetto a Fable 5, quindi il risparmio deriva interamente da un contesto in cache molto più economico.
- Ora supera Claude Opus 5 in ogni benchmark pubblicato da Anthropic, ribaltando i casi in cui Opus 5 primeggiava.
- Sceglilo per esecuzioni agent non presidiate, e resta su Sonnet 5 o Opus 5 per chat e drafting quotidiani.
- Claude Mythos 5.1 è lo stesso modello con salvaguardie cyber e biologiche più permissive, ed è su invito.
Cos'è Claude Fable 5.1?
Claude Fable 5.1 è il modello di frontiera generalmente disponibile di Anthropic per ragionamento impegnativo e lavoro agentico a lungo orizzonte. Si colloca al vertice della famiglia Claude per prezzo, sopra Claude Opus 5 a $5 / $25 per milione di token e Claude Sonnet 5 a $2 / $10, e la documentazione Anthropic indica una latenza più lenta di entrambe.
Con quel sovrapprezzo ottieni la capacità al prezzo di listino di Fable 5, più letture della cache a un quarto del costo precedente. Il pensiero è adattivo e sempre attivo, guidato da un'impostazione di impegno che predefinisce su high sulle API di Claude. Il knowledge cutoff è giugno 2026.
Il risultato di punta è Terminal-Bench-Science 0.1, un benchmark di ricerca scientifica agentica, dove Fable 5.1 ottiene il 52,6% contro il 24,7% di Fable 5. Anthropic lo affianca al racconto della società d'investimento Millennium, il cui senior portfolio manager ha descritto un crash da circa uno su un milione che nessuno nel suo team aveva spiegato in 4-5 anni. Fable 5.1 ha smontato una libreria di un fornitore esterno, l'ha confrontata con il core dump e ha ricondotto il crash a un bug di quella libreria.
Cos'è Claude Mythos 5.1?
Claude Mythos 5.1 è lo stesso modello di Fable 5.1 con salvaguardie più permissive, accessibile solo tramite i programmi di accesso fidato di Anthropic. Non è un modello più grande né un'architettura diversa, e Anthropic non ne ha pubblicato un listino separato. L'unica differenza è ciò che le salvaguardie gli consentono di fare.
L'accesso al momento riguarda un insieme di organizzazioni statunitensi, con una più ampia adesione prevista. Due programmi lo regolano, entrambi costruiti in partnership con il governo degli Stati Uniti:
- Il Cyber Verification Program copre il lavoro di sicurezza difensiva.
- Il Life Sciences Verification Program copre la ricerca e sviluppo professionale nelle scienze della vita.
Il divario tra i gemelli emerge nel coding, dove Mythos 5.1 ottiene il 60,9% su Terminal-Bench 4.0 contro il 55,8% di Fable 5.1. Decrypt ha attribuito questa differenza alle salvaguardie extra di Fable, che instradano alcuni compiti rischiosi verso Claude Opus 4.8, come descritto nel nostro tutorial su Claude Fable 5. Claude Security, il prodotto di Anthropic per scansionare codebase e suggerire patch per revisione umana, ora gira su Mythos 5.1, e la nostra guida a Claude Mythos 5 spiega come funzionava la precedente generazione di questa separazione.
Funzionalità chiave di Claude Fable 5.1
Cinque cambiamenti in Fable 5.1 modificano ciò che puoi effettivamente fare con un modello Claude, e uno di questi è una decisione sui prezzi più che una capacità.
Lascia in esecuzione un agent di coding durante la notte
Puoi affidare a Fable 5.1 un lavoro di più ore e tornare a lavoro finito invece che a un loop bloccato. I partner early-access di Anthropic sono stati insolitamente specifici in merito:
- Ron Sanzone di MongoDB ha descritto un prototipo costruito in circa 3 giorni, in cui il modello ha prima studiato il loro codice dei servizi e la documentazione, prodotto un design, poi è rimasto in esecuzione per ore non presidiato con cicli di verifica.
- Dwight Temple di Ramp ha riportato una singola esecuzione non presidiata di 38 ore su un problema di machine learning che ha diagnosticato un risultato precedente come artefatto di etichettatura, lo ha corretto, ha avviato 6 esperimenti in parallelo durante la notte ed è tornato con un risultato e le prossime mosse.
- Ben Lafferty di Shopify l'ha messa così: il modello tiene i propri registri, riprioritizza quando le cose cambiano e riprende da dove aveva lasciato.
La finestra di contesto da 1M token e l'output massimo da 128K rendono possibili esecuzioni così lunghe, e Craig Falls di Jane Street ha notato che Fable 5.1 resta leggibile su compiti lunghi e multi-step dove i modelli precedenti diventavano difficili da seguire.
Anthropic ha misurato la sicurezza agentica di questo modello come Mythos 5.1, gli stessi pesi con salvaguardie più lasche, e riferisce che è il modello più difficile da far cadere che abbia rilasciato su un benchmark esterno di prompt injection. Il suo audit comportamentale automatizzato ha rilevato che Mythos 5.1 tenta e riesce meno spesso nel reward hacking rispetto a Mythos 5, ed è meno incline a cercare risorse fuori dal suo ambiente di test quando gli viene affidato un compito impossibile.
Anthropic segnala anche il limite di quel lavoro: l'audit offre meno visibilità in contesti a contesto molto lungo e multi-agent, che è proprio il territorio occupato da un'esecuzione di 38 ore.
Tieni un agent di classe Fable accessibile grazie al contesto in cache
Le letture della cache ora costano $0,25 per milione di token, -75%, il che riscrive l'aritmetica di qualsiasi loop agent che rilegge lo stesso contesto a ogni turno. Anthropic stima circa il 25% di costo in meno per carichi tipici fatturati a token e fino a circa il 45% per coding complesso e compiti altamente agentici. Se il caching dei prompt è nuovo per te, la nostra guida al prompt caching spiega la meccanica.
Cerca vulnerabilità software senza rifiuti continui
Fable 5.1 ora può essere usato per scoprire vulnerabilità software, ma non per svilupparne exploit. Anthropic afferma che le sue più recenti salvaguardie cyber bloccano il 60% in meno di falsi positivi rispetto a prima e che gli utenti di Claude Code dovrebbero vedere in media circa il 60% di interventi in meno per sessione.
I limiti non sono scomparsi. Il penetration testing, la generazione di exploit e la scansione di vulnerabilità basata su binari reindirizzano ancora ai modelli Opus di Anthropic, così come la ricerca e sviluppo nelle scienze della vita. Sul fronte biologico, le salvaguardie per Fable 5.1 e Fable 5 ora si attivano l'85% meno spesso su domande benigne di biologia elementare e medicina, affrontando il problema dei falsi positivi più che la restrizione di capacità.
Affidagli un problema di ricerca e lascialo scavare
Fable 5.1 ha addestrato una rete neurale che ha prodotto una nuova mappa altimetrica ad alta risoluzione su un terzo di Venere, lavorando su immagini radar della missione Magellan della NASA di oltre 30 anni fa. La mappa risolve dettagli fino a 2-3 chilometri invece di 10-20, e le altezze sono fino al 25% più accurate di prima. Anthropic l'ha rilasciata con licenza Creative Commons su Zenodo, in vista delle missioni NASA VERITAS ed ESA EnVision.
Mythos 5.1 ha portato i risultati nelle scienze della vita, cosa da tenere a mente se stai leggendo l'annuncio in fretta. Ha progettato leganti proteici con affinità 10 volte superiori ai migliori design presentati alle competizioni di Adaptyv Bio su 3 target, e ha raggiunto un tasso di leganti validi vicino al 50% su 12 target, laddove oggi è tipico il 10-15%. Ha anche scritto kernel GPU personalizzati che hanno accelerato 7 modelli open-source di deep learning fino a 2,5 volte con output identici, riducendo i costi GPU stimati nelle analisi genome-wide del 30-60%.
Se lavori in laboratorio, il canale di accesso conta tanto quanto la capacità. Il programma AI for Science di Anthropic offre crediti gratuiti ai ricercatori su progetti ad alto impatto, e c'è un piano Claude Team fortemente scontato per gli scienziati. L'azienda ha anticipato uno Standard Hardware del Modello che consente a Claude di operare direttamente le apparecchiature di laboratorio.
Tieni i dati enterprise nel tuo cloud
Enterprise Frontier Safeguards (EFS) archivia i dati dei clienti sull'infrastruttura cloud del cliente anziché su quella di Anthropic, offrendo la privacy di un accordo di zero data retention pur consentendo il rilevamento degli abusi. La revisione umana è svolta dal cliente per impostazione predefinita. Anthropic ha costruito EFS con oltre 100 clienti e i suoi partner cloud Amazon Web Services, Google Cloud e Microsoft Azure.
Arriva in fasi a partire da questo autunno, coprendo Claude Code, Claude Enterprise, la Claude Platform, Amazon Bedrock, la Agent Platform di Google e Microsoft Foundry. Fino al lancio, i clienti idonei possono eseguire Fable 5.1 con zero data retention.
Come si comporta Claude Fable 5.1 sui benchmark?
Fable 5.1 supera Claude Opus 5 in ogni benchmark pubblicato da Anthropic, cosa che VentureBeat ha notato ribaltare i casi precedenti in cui Opus 5 guidava la famiglia. I guadagni su Fable 5 sono maggiori nella scienza agentica e nel coding da terminale, minori nel ragionamento accademico.
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
| GDPval-AA v2 (Elo) | 1853 | 1723 | 1824 | 1711 |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| Humanity's Last Exam (with tools) | 65.0% | 63.8% | 63.6% | Not published |
| OSWorld 2.0 (strict) | 41.7% | 36.1% | 39.6% | Not published |
Ogni dato qui riportato proviene da Anthropic, misurato con le salvaguardie di produzione di Fable 5.1 attive.
Ricerca scientifica agentica e coding da terminale
Qui il salto generazionale è impossibile da ignorare. Su Terminal-Bench-Science 0.1, che valuta la ricerca scientifica agentica svolta in un terminale, Fable 5.1 raggiunge il 52,6% contro il 24,7% di Fable 5, il 29,0% di Opus 5 e il 22,4% di GPT-5.6 Sol.

Guarda il margine, non il decimale. Anthropic riporta un errore standard di ±3,5-4,5 punti per modello su quel benchmark e osserva che la classifica pubblica colloca Opus 5 al 30,0% e Fable 5 al 21,4%, entrambi riprodotti dal suo setup entro il rumore.
Terminal-Bench 4.0, che testa coding e debugging multi-step da riga di comando, assegna a Fable 5.1 il 55,8% contro il 42,0% di Fable 5 e il 52,3% di Opus 5. Su CursorBench 3.2.0, che valuta il coding all'interno di un flusso di lavoro IDE, raggiunge il 73,4%, qualche punto sopra Fable 5 al 70,5% e Opus 5 al 70,0%.
Lavoro di conoscenza e workflow aziendali
Il lavoro di conoscenza migliora, ma in modo diverso. Su GDPval-AA v2, una misura in stile Elo della qualità del lavoro di conoscenza, Fable 5.1 ottiene 1853 contro 1824 per Opus 5 e 1723 per Fable 5. Accanto a Opus 5 è un passo modesto; accanto a Fable 5, è concreto.
AutomationBench, che copre l'automazione dei workflow aziendali, li separa molto di più: 31,4% per Fable 5.1, 26,9% per Opus 5 e 17,1% per Fable 5. Anthropic nota che Fable 5 ha segnato zero sui compiti in cui sono intervenute le salvaguardie di produzione, quindi considera quella cifra più bassa come un pavimento.
Ragionamento e uso del computer
Il ragionamento accademico è la riga più piatta della tabella. Humanity's Last Exam colloca Fable 5.1 al 60,9% senza strumenti e al 65,0% con essi, contro 57,8% e 63,8% per Fable 5 e 56,6% e 63,6% per Opus 5. Anthropic non ha pubblicato punteggi per GPT-5.6 Sol su questo benchmark.
L'uso del computer sembra più forte ed è più difficile da fidare. Fable 5.1 guida OSWorld 2.0 con il 77,9% sull'impostazione partial e il 41,7% su strict, contro 75,4% e 39,6% per Opus 5. Anthropic ha valutato questi punteggi sul rilascio dei task di agosto 2026 degli autori del benchmark, quindi i numeri non sono comparabili con risultati OSWorld 2.0 pubblicati in precedenza, e entrambi i modelli Fable hanno ottenuto zeri sui compiti bloccati dalle salvaguardie.
Un caveat attraversa l'intera tabella. Dove le salvaguardie hanno bloccato un compito, Anthropic ha fatto completare il lavoro cyber da Claude Opus 4.8 e quello biologico da Claude Opus 5, cosa che a suo dire probabilmente abbassa i punteggi riportati di Fable anziché lusingarli.
Quale livello di Claude dovresti usare?
Fable 5.1 è la scelta di default solo quando un lavoro dura abbastanza a lungo che una svolta sbagliata costa più dei token. Per tutto ciò che è più breve, la stessa famiglia di Anthropic lo sottoprezza e lo batte in latenza, e Sonnet 5 è la scelta sensata per l'uso quotidiano piuttosto che uno dei due flagship.

Il sistema di varianti ha due assi. Fable 5.1 e Mythos 5.1 sono un unico modello separato dalle salvaguardie, e su entrambi c'è un'impostazione di impegno con livelli Low, Medium e High. Anthropic riferisce che Fable 5.1 a Low o Medium eguaglia o supera Fable 5 a costo molto inferiore, il che rende la manopola dell'impegno un controllo dei costi più che un interruttore di qualità.
I default variano per superficie, cosa utile da sapere prima di giudicare il modello su una singola sessione. Fable 5.1 predefinisce su High effort in Claude Code, Medium in Claude Cowork e su Claude.ai, e su high sulle API di Claude.
| Caso d'uso | Scelta | Perché |
|---|---|---|
| Esecuzioni agent non presidiate di più ore | Fable 5.1 a High effort | Mantiene un piano su lavori lunghi e letture cache a $0,25 tengono il loop accessibile |
| Pianificazione e revisione approfondite di repo | Opus 5 | Stessa finestra di contesto da 1M e pensiero adattivo a metà prezzo, $5 / $25, con latenza moderata anziché lenta |
| Coding e chat quotidiani | Sonnet 5 | $2 / $10 per una finestra di contesto da 1M, e Anthropic lo valuta veloce |
| Lavori ad alto volume o sensibili alla latenza | Haiku 4.5 | $1 / $5 e il più veloce della famiglia, sebbene scenda a una finestra di contesto da 200K e output massimo 64K |
| Ricerca difensiva di vulnerabilità e lavoro nelle scienze della vita | Mythos 5.1 | L'unico percorso oltre le salvaguardie che reindirizzano questo lavoro ai modelli Opus |
| Lavoro agent che vuoi su Fable ma non puoi permetterti a High | Fable 5.1 a Low o Medium effort | Anthropic riporta risultati pari o superiori a Fable 5 a costo molto inferiore |
Prezzi e disponibilità di Claude Fable 5.1
Fable 5.1 costa $10 per milione di token in input e $50 per milione di token in output, esattamente come Fable 5. Le letture di cache rappresentano l'intero cambiamento di prezzo, scendendo del 75% a $0,25 per milione.
| Voce | Prezzo per milione di token |
|---|---|
| Input | $10 |
| Output | $50 |
| Lettura cache | $0.25 |
| Scrittura cache (5 minuti) | $12.50 |
| Scrittura cache (1 ora) | $20 |
| Batch API | Sconto del 50% su input e output |
La stima di Anthropic sull'effetto netto è circa il 25% di costo in meno per carichi tipici fatturati a token e fino a circa il 45% per coding complesso e compiti altamente agentici. Non è pubblicato se i token di ragionamento siano fatturati alla tariffa di output, cosa qui più rilevante che altrove, perché il pensiero è sempre attivo.
Fable 5.1 è generalmente disponibile oggi su più piattaforme, tra cui Amazon Web Services, Google Cloud e Microsoft Azure. Mythos 5.1 no: va a cyberdefender e scienziati della vita selezionati tramite CVP e LSVP, al momento un insieme di organizzazioni statunitensi, e Anthropic sta collaborando con il governo USA per estenderne l'accesso.
Due cambiamenti minori riguardano gli sviluppatori:
- I nuovi account API creati dal giorno del lancio in poi non possono più modificare il contesto precedente di Claude in una conversazione multi-turn mantenendo la trascrizione del suo pensiero passato, una misura anti-distillazione che verrà applicata a tutti gli account con futuri rilasci.
- Ai sensi del Codice di condotta sulla trasparenza dei contenuti generati da IA dell'AI Act UE, Anthropic applica anche watermark all'output dei modelli rilasciati dopo il 2 agosto 2026, e una detection API è in private preview.
Come ottenere accesso a Claude Fable 5.1?
L'ID modello che gli sviluppatori digitano è claude-fable-5-1, attivo sulle API di Claude dal giorno del lancio. Oltre all'API proprietaria, Fable 5.1 arriva su Claude Code, Claude Cowork, Claude.ai e i principali cloud, con Amazon Bedrock, la Agent Platform di Google e Microsoft Foundry indicati come superfici supportate da EFS.
Una chiamata minima è così:
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-fable-5-1",
max_tokens=1024,
messages=[
{"role": "user", "content": "Trace this crash to its root cause and explain the fix."}
],
)
print(response.content[0].text)
Per la configurazione completa, inclusi controlli dei costi e streaming, vedi la nostra guida completa alle API di Claude. Il nostro tutorial sull'API di Claude Fable 5 costruisce un assistente per compiti di sviluppo in Python e richiede solo la sostituzione dell'ID modello, e il nostro articolo sulle best practice di Claude Code copre il workflow da terminale, dove High effort è il default.
Considerazioni finali
Anthropic scommette che la frontiera si misurerà in ore non presidiate più che in turni di chat, e ha prezzato Fable 5.1 per rendere economica quella scommessa. Mantenere il listino riducendo le letture della cache del 75% è una mossa più interessante di qualsiasi singola riga di benchmark, perché prende di mira l'unico carico di lavoro in cui una tariffa di $50 in output è sostenibile.
Passerei subito da Fable 5 e lascerei il lavoro quotidiano su Sonnet 5 o Opus 5. Ciò che mi lascia perplesso è il numero di zeri da salvaguardie sparsi nella stessa tabella di Anthropic e il fatto che i risultati scientifici più eclatanti siano arrivati da Mythos 5.1, che quasi nessuno tra chi legge può ottenere.
Se vuoi mettere al lavoro un modello di classe Fable nel tuo terminale, ti consiglio il nostro corso Claude Code 101.
FAQs
Come si confronta Claude Fable 5.1 con Claude Opus 5?
Claude Fable 5.1 supera Claude Opus 5 in ogni benchmark pubblicato da Anthropic, incluso il 52,6% contro il 29,0% su Terminal-Bench-Science 0.1 e il 55,8% contro il 52,3% su Terminal-Bench 4.0. Opus 5 resta a metà del listino, $5 / $25 per milione di token contro i $10 / $50 di Fable 5.1, e Anthropic ne valuta la latenza come moderata, mentre Fable 5.1 è più lento. Usa Fable 5.1 per esecuzioni agent lunghe e non presidiate e Opus 5 per coding e lavoro di conoscenza quotidiani.
Quanto costa Claude Fable 5.1?
Fable 5.1 costa $10 per milione di token in input e $50 per milione di token in output, invariato rispetto a Fable 5. Le letture della cache sono scese del 75% a $0,25 per milione, le scritture cache costano $12,50 per la finestra da 5 minuti e $20 per quella da 1 ora, e la Batch API applica il 50% di sconto su input e output. Anthropic stima un costo complessivo inferiore di circa il 25% per carichi tipici fatturati a token e fino a circa il 45% per quelli altamente agentici.
Dove posso accedere a Claude Fable 5.1?
Fable 5.1 è generalmente disponibile su più piattaforme, tra cui Amazon Web Services, Google Cloud e Microsoft Azure. Gli sviluppatori lo richiamano sulle API di Claude con l'ID modello claude-fable-5-1, e funziona anche in Claude Code, Claude Cowork e su Claude.ai.
Qual è la differenza tra Claude Fable 5.1 e Claude Mythos 5.1?
Sono lo stesso modello con salvaguardie diverse. Fable 5.1 è generalmente disponibile, mentre Mythos 5.1 ha salvaguardie più permissive per cybersecurity e scienze della vita ed è riservato al Cyber Verification Program e al Life Sciences Verification Program di Anthropic, al momento un insieme di organizzazioni statunitensi. Le salvaguardie più lasche emergono nel coding, dove Mythos 5.1 ottiene il 60,9% su Terminal-Bench 4.0 contro il 55,8% di Fable 5.1.
Quale impostazione di impegno dovrei usare con Claude Fable 5.1?
Fable 5.1 predefinisce su High effort in Claude Code, Medium in Claude Cowork e su Claude.ai, e su high sulle API di Claude. Anthropic riferisce che Low o Medium effort eguagliano o superano Fable 5 a costo molto inferiore, quindi i livelli più bassi sono un vero controllo dei costi e non un downgrade. Riserva High effort al lavoro agent a lungo orizzonte in cui una svolta sbagliata costa più dei token.
Tom è un data scientist e formatore tecnico. Scrive e gestisce i tutorial e i post del blog di DataCamp su data science. In precedenza, Tom ha lavorato nella data science presso Deutsche Telekom.
