Programma
Se stai decidendo quale modello Anthropic indirizzare al tuo agente, ora hai due opzioni di fascia alta che sono vicine per capacità ma lontane per prezzo. Claude Opus 5 è stato lanciato il 24 luglio 2026 a $5 per milione di token in input, mentre Claude Fable 5 è uscito il 9 giugno 2026 a esattamente il doppio. La domanda ovvia è se il livello superiore di Fable 5 ti offra qualcosa che Opus 5 non fornisce già.
Anthropic afferma che Opus 5 è il nuovo stato dell’arte nelle valutazioni di coding e knowledge work come Frontier-Bench e GDPval-AA e, su alcuni benchmark, batte addirittura Fable 5 in modo netto. Questo ribalta l’assunzione abituale secondo cui il modello più costoso vince sempre.
In questo articolo confronterò Opus 5 e Fable 5 su coding, compiti agentici, ragionamento, salvaguardie e prezzi, così puoi decidere quale si adatta al tuo flusso di lavoro. Per una panoramica più approfondita di ciascun modello, consulta la nostra guida a Claude Opus 5 e la nostra guida a Claude Fable 5.
TL;DR
- Opus 5 offre un’intelligenza grosso modo al livello di Fable 5 a metà prezzo ($5/$25 per milione di token contro $10/$50), il che lo rende la scelta predefinita per quasi tutti.
- Opus 5 batte effettivamente Fable 5 su Frontier-Bench v0.1 (43,3% vs 33,7%) e SWE-bench Verified (96,0% vs 95,0%), mentre Fable 5 ha un leggero vantaggio su SWE-bench Pro (80,3% vs 79,2%).
- L’Elo GDPval-AA v2 di Fable 5 (1.747) è inferiore a quello di Opus 5 (1.861), quindi Opus 5 è in testa anche sulla valutazione di knowledge work.
- Fable 5 include salvaguardie più pesanti su cyber e biologia che instradano le richieste segnalate a Opus 4.8; i classificatori di Opus 5 intervengono circa l’85% in meno.
- Scegli Fable 5 solo se hai un’esigenza specifica per il suo posizionamento con salvaguardie a soglia o per il routing di classe Mythos; scegli Opus 5 per praticamente ogni attività generale di coding, compiti agentici e knowledge work.
Che cos’è Claude Opus 5?
Claude Opus 5 è il modello più recente di Anthropic nella fascia Opus, rilasciato il 24 luglio 2026 e con lo stesso prezzo del suo predecessore Opus 4.8.
Anthropic lo descrive come un modello riflessivo e proattivo pensato per l’uso quotidiano; è ora il modello predefinito su Claude Max e il più potente su Claude Pro. Il suo tratto distintivo è la persistenza agentica: verifica il proprio lavoro e itera finché un compito non riesce davvero, invece di fermarsi a una risposta dall’aspetto plausibile.
Per vedere come si comporta in pratica, dai un’occhiata al nostro tutorial sull’API di Claude Opus 5, in cui costruiamo e valutiamo un agente di correzione bug su tutti e cinque i livelli di sforzo di ragionamento. Potrebbe interessarti anche la nostra guida ai template di Claude Code se prevedi di eseguire Opus 5 in un flusso di lavoro agentico.
Che cos’è Claude Fable 5?
Claude Fable 5 è un modello di classe Mythos che Anthropic ha reso sicuro per l’uso generale, rilasciato il 9 giugno 2026 a $10 per milione di token in input e $50 per milione di token in output. È stato temporaneamente ritirato il 12 giugno 2026 per conformarsi a un ordine statunitense di controllo all’esportazione, e Anthropic ha ripristinato l’accesso il 1° luglio 2026, una volta revocato l’ordine.
Anthropic lo colloca al di sopra del livello Opus in termini di capacità pura e, al lancio, era lo stato dell’arte su quasi tutti i benchmark testati, con un vantaggio crescente quanto più il compito era lungo e complesso. La sua caratteristica distintiva è un insieme di classificatori che instradano a Opus 4.8 le richieste segnalate su cybersicurezza, biologia e distillazione, invece di rispondere direttamente.
Claude Opus 5 vs Claude Fable 5: confronto diretto
Ecco il riepilogo prima di entrare nei dettagli. In breve: Opus 5 e Fable 5 sono entro il margine di rumore su molti benchmark, ma Opus 5 costa la metà.
| Caratteristica | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Data di rilascio | 24 luglio 2026 | 9 giugno 2026 |
| Prezzo input (per 1M token) | $5 | $10 |
| Prezzo output (per 1M token) | $25 | $50 |
| SWE-bench Verified | 96,0% * | 95,0% |
| SWE-bench Pro | 79,2% | 80,3% * |
| Frontier-Bench v0.1 | 43,3% * | 33,7% |
| ARC-AGI 3 | 30,2% * | non pubblicato |
| GDPval-AA v2 (Elo) | 1.861 * | 1.747 |
| Impostazione salvaguardie | Classificatori cyber più leggeri | Classificatori ampi su cyber/bio/distillazione |
| Disponibilità | Tutte le piattaforme e i piani | Tutte le piattaforme, rollout consumer a fasi |
* attuale leader complessivo su questo benchmark
Coding e workflow agentici
Il coding è dove la maggior parte degli utenti impiegherà davvero questi modelli, ed è anche l’ambito in cui il divario di prezzo sembra meno giustificato. Su SWE-bench Verified, Opus 5 ottiene il 96,0% contro il 95,0% di Fable 5, un punto di vantaggio per il modello più economico. Su Frontier-Bench v0.1, la valutazione di coding da terminale, Opus 5 allunga a 43,3% contro 33,7%.
Fable 5 recupera una vittoria di misura su SWE-bench Pro, con 80,3% contro il 79,2% di Opus 5. È un punto di differenza nell’altra direzione, il che indica che i due modelli sono sostanzialmente alla pari sull’ingegneria a livello di repository. Il team di Cognition ha riportato che Opus 5 si avvicina alle prestazioni di Fable a metà costo sulla loro valutazione FrontierCode 1.1, in linea con i numeri pubblici.
| Benchmark | Opus 5 | Fable 5 | Note |
|---|---|---|---|
| SWE-bench Verified | 96,0% | 95,0% | Segnalato dal vendor |
| SWE-bench Pro | 79,2% | 80,3% | Unica vittoria di Fable 5 nel coding qui |
| Frontier-Bench v0.1 | 43,3% | 33,7% | Coding da terminale; Opus 5 +9,6 pp |
| Terminal-Bench 2.1 | Non pubblicato | 88,0% | Punteggio di Opus 5 non pubblicato |
Il punto è che Opus 5 eguaglia o supera Fable 5 sui benchmark di coding, dove ci sono numeri pubblicati, con la sola eccezione di SWE-bench Pro. Secondo Anthropic, Opus 5 ha più che raddoppiato il punteggio di Opus 4.8 su Frontier-Bench con un costo per compito inferiore, e batte anche Fable 5 lì. Per il coding, il modello più costoso non ti dà nulla in più.

Compiti agentici e computer-use
Entrambi i modelli sono progettati per lavori agentici a lungo orizzonte, quindi questa dimensione conta se esegui pipeline autonome anziché prompt one-shot. Qui, il comportamento proattivo di verifica di Opus 5 è il fattore che i benchmark catturano solo in parte.
Su ARC-AGI 3, una valutazione in cui il modello deve risolvere problemi nuovi, Opus 5 passa dall’1,5% di Opus 4.8 al 30,2%, quasi quattro volte il modello successivo (GPT-5.6 Sol al 7,8%). Purtroppo, Anthropic non ha pubblicato alcun punteggio per Fable 5, quindi non possiamo confrontare direttamente i due modelli.
Su OSWorld 2.0, il benchmark di uso del computer, Opus 5 (70,6%) sostituisce Fable 5 (66,1%) come modello leader complessivo e, su AutomationBench di Zapier, ha raggiunto un tasso di successo del 100% su una sequenza di prevenzione del churn che i modelli precedenti non riuscivano a completare.
Opus 5 vince i compiti agentici in termini di performance per dollaro con un ampio margine.
Ragionamento e knowledge work
Il knowledge work è il terreno di marketing di Fable 5, quindi mi aspettavo che conducesse qui, ma non è così. Su GDPval-AA v2, il benchmark Elo del knowledge work, Opus 5 ottiene 1.861 contro 1.747 di Fable 5. È un divario di 114 punti Elo a favore del modello più economico.
Fable 5 mantiene comunque un vero vantaggio sul ragionamento scientifico più difficile e lungo, e Anthropic è esplicita che la capacità di classe Mythos resta più forte per la ricerca autonoma a lungo termine in biologia. Ma per le attività analitiche e di knowledge work che la maggior parte dei team esegue, il punteggio GDPval-AA superiore di Opus 5 significa che stai pagando il doppio per far rendere peggio Fable 5.
Salvaguardie e comportamento di rifiuto
Questa è la dimensione in cui i due modelli divergono davvero, ed è il vero motivo per cui Fable 5 esiste come prodotto separato. È anche la dimensione più facile da leggere nel modo sbagliato, perché qui due cose diverse vengono chiamate "sicurezza" e misurano estremi opposti del problema.
La prima è la resistenza all’abuso: un sistema di classificazione esterno che si pone davanti al modello e reindirizza le richieste pericolose prima che lo raggiungano. La seconda è l’allineamento: come si comporta il modello stesso, incluso se inganna, intraprende azioni sconsiderate e irreversibili o può essere indotto all’abuso.
Un modello può ottenere un buon punteggio su una dimensione e necessitare comunque di un forte supporto sull’altra, perché i classificatori non proteggono dal fatto che il modello impazzisca. Proteggono dal rischio che un utente estragga qualcosa di dannoso dal modello.
Fable 5 è un modello di classe Mythos con il sistema di classificazione più pesante tra i due. I suoi classificatori coprono tre aree e, quando scattano, la richiesta ricade su Opus 4.8:
- Cybersicurezza: sia lo sfruttamento sia compiti cyber offensivi più ampi sono bloccati, azzerando le prestazioni di Fable 5 sulle valutazioni cyber quando i classificatori sono attivi.
- Biologia e chimica: la maggior parte delle richieste di biologia e chimica ricade su Opus 4.8 per impostazione predefinita.
- Distillazione: le richieste segnalate come tentativi di estrarre le capacità di Fable 5 vengono reindirizzate altrove.
Anthropic le ha tarate in modo conservativo: i primi dati mostrano che oltre il 95% delle sessioni di Fable 5 non attiva alcun fallback.
Opus 5 adotta una versione più leggera dello stesso sistema. I suoi classificatori cyber consentono di trovare vulnerabilità nel codice sorgente ma bloccano la scansione basata su binari, il penetration testing e la generazione di exploit, e Anthropic prevede che scattino circa l’85% in meno rispetto a quelli di Fable 5.
Nel suo audit comportamentale automatizzato, Opus 5 ha ottenuto 2,3 sul comportamento non allineato, che Anthropic definisce il suo modello più allineato finora, davanti a Opus 4.8, Sonnet 5 e Fable 5.
Quindi questa è una biforcazione, non una classifica. Per coding generale, knowledge work e uso del computer, Opus 5 è un modello ben allineato che ostacola meno. Per la frontiera di un dominio sorvegliato, come la ricerca di sicurezza offensiva o la biologia a lungo orizzonte, Fable 5 (o Mythos 5 tramite il Cyber Verification Program) è lo strumento più capace, e il comportamento di rifiuto più pesante è il prezzo da pagare per raggiungerlo.
Prezzi: quanto paghi davvero
Fable 5 costa esattamente il doppio di Opus 5 sia in input che in output. La modalità Fast di Opus 5, che funziona a circa 2,5x la velocità predefinita, costa $10 in input e $50 in output, in linea con la tariffa standard di Fable 5.
| Tariffa | Opus 5 | Fable 5 |
|---|---|---|
| Input, per 1M token | $5,00 | $10,00 |
| Output, per 1M token | $25,00 | $50,00 |
| Input modalità Fast, per 1M token | $10,00 | Non applicabile |
| Output modalità Fast, per 1M token | $50,00 | Non applicabile |
Quanto costa un carico reale
Entrambi i modelli condividono il tokenizer più recente di Anthropic introdotto con la generazione Opus 4.7, quindi testo identico costa lo stesso numero di token in input su ciascuno, e nessun vendor ha pubblicato un confronto controllato del conteggio token tra i due per lo stesso compito.
| Volume mensile | Opus 5 | Fable 5 | Differenza |
|---|---|---|---|
| Leggero: 1M in / 250K out | $11,25 | $22,50 | Opus 5 risparmia $11,25 (50%) |
| Pesante: 100M in / 25M out | $1.125 | $2.250 | Opus 5 risparmia $1.125 (50%) |
A livello pesante, è una differenza mensile di $1.125 per una funzionalità in produzione o un agente in esecuzione continua, e i benchmark indicano che non rinunci a nulla in tema di coding o knowledge work per ottenerla.
Detto ciò, considera questi totali come un confronto di tariffa più che una previsione precisa. Opus 5 può costare più di Opus 4.8 in pratica perché tende a emettere più token di pensiero, ma non cambia il quadro generale: Opus 5 sarà il modello significativamente più economico tra i due nella maggior parte dei casi.
Quando scegliere Claude Opus 5 vs Claude Fable 5
Per la maggior parte dei lettori è una decisione rapida: Opus 5 è la scelta predefinita e Fable 5 è l’eccezione. La tabella seguente copre gli scenari in cui il verdetto si ribalta.
| Caso d’uso | Raccomandato | Perché |
|---|---|---|
| Agenti di coding a livello di repository | Opus 5 | Uguale o migliore di Fable 5 su SWE-bench e in testa su Frontier-Bench a metà costo. |
| Knowledge work e analisi quotidiani | Opus 5 | Elo GDPval-AA v2 più alto (1.861 vs 1.747) a metà prezzo. |
| Carichi di lavoro di produzione ad alto volume | Opus 5 | Il risparmio del 50% si traduce in oltre $1.000/mese al livello pesante. |
| Ragionamento astratto e su problemi nuovi | Opus 5 | Punteggio ARC-AGI 3 del 30,2%, tre volte il modello successivo. |
| Ricerca autonoma a lungo termine in biologia | Fable 5 | La capacità di classe Mythos resta più forte per questo lavoro specifico. |
| Workflow che richiedono copertura di salvaguardie ampia | Fable 5 | I suoi classificatori coprono in modo più ampio cyber, biologia e distillazione. |
Scegli Opus 5 se...
- Stai creando strumenti di coding o agentici e vuoi le migliori prestazioni per dollaro, dato che batte Fable 5 su Frontier-Bench e lo eguaglia su SWE-bench.
- Esegui carichi ad alto volume in cui un taglio tariffario del 50% si traduce in budget reale, e i benchmark confermano che non perdi in qualità.
- Vuoi il modello più allineato disponibile, dato il suo punteggio di audit del comportamento non allineato pari a 2,3, il migliore di Anthropic finora.
- Hai bisogno di un comportamento di rifiuto più leggero per ricerca di sicurezza legittima, dato che i suoi classificatori scattano circa l’85% in meno rispetto a quelli di Fable 5.
Scegli Fable 5 se...
- Il tuo lavoro è ricerca autonoma a lungo orizzonte in biologia, l’unica area in cui Anthropic afferma che la capacità di classe Mythos è ancora in vantaggio.
- Hai specificamente bisogno della copertura di classificatori più ampia su cyber, biologia e distillazione fornita dal sistema di salvaguardie di Fable 5.

Come iniziare con Claude Opus 5 e Claude Fable 5
Entrambi i modelli sono ampiamente disponibili nelle app Claude, nell’API, sulle principali piattaforme cloud e negli agenti di coding di Anthropic. Le differenze pratiche sono limitate e si notano soprattutto a livello di piani consumer.
| Superficie | Opus 5 | Fable 5 |
|---|---|---|
| App consumer | App Claude (incluso su Pro, Max, Team, Enterprise; predefinito su Max, più potente su Pro) | App Claude (Max & Team Premium: incluso, tetto settimanale 50%; Pro & Team Standard: solo crediti d’uso) |
| API proprietaria | Anthropic API | Anthropic API |
| Piattaforme cloud | Amazon Bedrock, Vertex AI, Microsoft Foundry | Amazon Bedrock, Vertex AI, Microsoft Foundry |
| Agenti di coding | Claude Code, Claude Cowork | Claude Code, Claude Cowork |
| ID modello API | claude-opus-5 |
claude-fable-5 |
Sull’API, entrambi richiedono solo la sostituzione di una stringa, usando rispettivamente claude-opus-5 e claude-fable-5.
La differenza più netta: su Pro e Team Standard, Fable 5 non è incluso. Funziona a crediti a consumo alle tariffe API, mentre Opus 5 è incluso in quei piani.
Uso di Opus 5 e Fable 5 in un agente di coding
Entrambi i modelli sono selezionabili in Claude Code e passare dall’uno all’altro significa cambiare la stringa del modello nella tua richiesta o nella configurazione dell’agente. Poiché condividono lo stesso SDK, spostare un agente funzionante dall’uno all’altro richiede una modifica su una sola riga.
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-opus-5", # swap for "claude-fable-5"
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor this function..."}],
)
print(response.content.text)
Un dettaglio implementativo dai nostri test pratici: Opus 5 restituisce per impostazione predefinita blocchi di pensiero, quindi accedere direttamente a response.content.text può generare un’AttributeError quando il primo blocco è un blocco di pensiero. Trattiamo l’intera configurazione, la taratura del livello di sforzo e il comportamento della cache dei prompt nel nostro tutorial sull’API di Claude Opus 5.
Considerazioni finali
Consiglio di usare Opus 5 a meno che tu non abbia un motivo specifico per non farlo. Eguaglia o supera Fable 5 nel coding, vince il benchmark Elo di knowledge work, triplica il campo sul ragionamento novativo e fa tutto questo a metà prezzo, registrando al contempo il miglior punteggio di allineamento di Anthropic.
Fable 5 chiaramente non è un cattivo modello. Semplicemente non è pensato per la maggior parte di ciò che i team fanno realmente. Ha salvaguardie più pesanti e detiene un vero vantaggio sulla frontiera del lavoro autonomo a lungo termine come la ricerca in biologia, ma al di fuori di quella fetta ristretta, pagare il doppio per Fable 5 significa pagare il doppio per ottenere punteggi leggermente inferiori sui benchmark che contano per coding e analisi.
Quello che trovo più interessante è che questo confronto inverte la logica abituale dei livelli di modello. Normalmente, il modello più nuovo e più economico scambia un po’ di capacità per l’accessibilità. Qui, Anthropic ha rilasciato un modello più economico che è anche la scelta più capace per quasi ogni compito mainstream, il che suggerisce che il prezzo di Fable 5 acquista soprattutto la sua impostazione di salvaguardia e l’eredità Mythos più che prestazioni pure.
FAQ
Claude Opus 5 è migliore di Claude Fable 5?
Per la maggior parte dei compiti, sì. Opus 5 eguaglia o supera Fable 5 nel coding (96,0% vs 95,0% su SWE-bench Verified, 43,3% vs 33,7% su Frontier-Bench v0.1), guida il benchmark di knowledge work GDPval-AA v2 (1.861 vs 1.747 Elo) e lo fa a metà prezzo. Fable 5 mantiene un vantaggio solo su lavori di frontiera ristretti come la ricerca autonoma a lungo termine in biologia.
Perché Claude Fable 5 è più costoso di Claude Opus 5?
Fable 5 costa $10/$50 per milione di token in input/output rispetto a $5/$25 di Opus 5, ma il sovrapprezzo acquista soprattutto la sua impostazione di salvaguardie e il posizionamento sulla frontiera, più che prestazioni superiori nell’uso quotidiano. Sui benchmark mainstream di coding e knowledge work, Opus 5 ottiene punteggi uguali o più alti, quindi per quei carichi di lavoro, stai pagando il doppio per fare leggermente peggio.
Quando dovrei scegliere Fable 5 invece di Opus 5?
Scegli Fable 5 se il tuo lavoro è ricerca autonoma a lungo orizzonte in biologia, dove Anthropic afferma che la sua capacità è ancora in vantaggio, o se hai specificamente bisogno della copertura di classificatori più ampia su cybersicurezza, biologia e distillazione. Per coding generale, pipeline agentiche, analisi e carichi di lavoro di produzione ad alto volume, Opus 5 è la scelta predefinita migliore.
Come faccio a passare tra Opus 5 e Fable 5 nell’API?
Entrambi i modelli condividono lo stesso SDK, quindi il passaggio è una modifica su una sola riga della stringa del modello (claude-opus-5 o claude-fable-5). Una cosa da notare: Opus 5 restituisce per impostazione predefinita blocchi di pensiero, quindi leggere direttamente response.content[0].text può generare un’AttributeError quando il primo blocco è un blocco di pensiero e non testo.
Opus 5 costa davvero la metà di Fable 5 nell’uso reale?
Per token, sì: Opus 5 costa esattamente la metà della tariffa di Fable 5 sia in input che in output. In pratica, il conto dipende dal volume di token, e Opus 5 emette più token di pensiero per impostazione predefinita rispetto a Opus 4.8, quindi considera il 50% come confronto di tariffa più che totale garantito. Anche così, Opus 5 resta significativamente più economico dell’altro modello nella maggior parte degli scenari.
Tom è un data scientist e formatore tecnico. Scrive e gestisce i tutorial e i post del blog di DataCamp su data science. In precedenza, Tom ha lavorato nella data science presso Deutsche Telekom.
