Anthropic non ha pubblicato un benchmark diretto tra Opus 5 e Sonnet 5. Ogni post di lancio confronta il modello con il suo predecessore e con Opus 4.8. Quindi i numeri qui sotto raccontano solo una parte della storia. Il resto è lo stesso tipo di valutazione che faresti con qualsiasi coppia Opus vs. Sonnet: di quanta "altezza del soffitto" hai davvero bisogno e quanto sei disposto a pagare per ottenerla.
Che cos'è Claude Opus 5?
Opus 5 è il modello di fascia alta di Anthropic, rilasciato il 24 luglio 2026, con un prezzo di $5 per milione di token in input e $25 per milione di token in output. Anthropic lo definisce lo stato dell'arte su Frontier-Bench e GDPval-AA, e vicino al modello Fable 5 più grande a metà prezzo. È il modello predefinito su Claude Max e il modello più potente su Claude Pro.
La sua caratteristica distintiva è l'auto-verifica: controlla il proprio lavoro, costruisce test harness quando non esiste un flusso dati, e contesta istruzioni sbagliate invece di eseguirle ciecamente.
Che cos'è Claude Sonnet 5?
Sonnet 5 è il modello di fascia media di Anthropic, rilasciato il 30 giugno 2026. Anthropic lo descrive come il suo Sonnet più agentico finora, con prestazioni vicine a Opus 4.8 a un prezzo inferiore. È il modello predefinito nei piani Free e Pro, ed è disponibile su Max, Team, Enterprise e via API.
Prezzi: $2 per milione di token in input e $10 per milione di token in output fino al 31 agosto 2026, poi $3/$15 standard.
La differenza di fascia, in termini pratici
Questa è la parte che i post di lancio non esplicitano, perché è semplicemente come funziona in generale la lineup dei modelli di Anthropic, non qualcosa di specifico per questa coppia.
Opus è il modello "soffitto"
Lo scegli quando sbagliare costa caro, quando un'attività dura a lungo e procede in autonomia senza controlli intermedi, o quando il problema è davvero nuovo e non una variazione di qualcosa che il modello ha già visto mille volte. Refactor profondi su più file, domande di ricerca ambigue, run agentici lunghi dove gli errori si accumulano — questo è territorio Opus. Stai pagando perché il modello intercetti i propri errori prima che diventino un tuo problema.
Sonnet è il cavallo da tiro
È pensato per essere abbastanza veloce ed economico da girare continuamente: assistenti chat, classificazione ad alto volume, coding iterativo dove sei tu a rimanere nel loop e rivedere ogni pochi passaggi, applicazioni sensibili alla latenza. Il soffitto del giudizio è più basso, ma per una grossa fetta di lavoro reale non lo tocchi mai. L'uso quotidiano della maggior parte dei team dovrebbe pendere verso Sonnet, chiamando in causa Opus in modo selettivo per i compiti che ne hanno davvero bisogno.
Sonnet 5, in particolare, è il tentativo di Anthropic di alzare quel soffitto più del solito per un modello mid-tier — da qui "il Sonnet più agentico finora" e l'affermazione che si avvicina a Opus 4.8 su alcuni compiti. Questo è il contesto con cui leggere i benchmark qui sotto: Sonnet 5 non è solo economico, è economico e più vicino alla fascia Opus rispetto ai Sonnet precedenti.
Cosa mostrano davvero i numeri delle release
Prezzo
La differenza più chiara e meno ambigua. Sonnet 5 costa $2/$10 (fino al 31 ago) o $3/$15 (standard) contro il prezzo fisso di $5/$25 di Opus 5 — Sonnet 5 costa dal 40% al 60% di Opus 5 a seconda della finestra di prezzo.
Allineamento
L'unico punto in cui i due post di lancio si citano direttamente. L'audit automatizzato di Anthropic ha rilevato che Opus 5 "aderisce alla Costituzione di Claude meglio di Opus 4.8, Sonnet 5 o Fable 5" — un risultato dichiarato esplicitamente, non un'inferenza. Opus 5 ottiene 2,3 in quell'audit, il suo punteggio di sicurezza più alto finora. Sonnet 5 è migliorato rispetto al suo predecessore (meno allucinazioni, minore piaggeria, migliore resistenza a attacchi di prompt-injection), ma Anthropic osserva che presenta ancora un tasso di comportamento disallineato più alto di Opus 4.8.
Cybersecurity
Entrambi i modelli non sono stati addestrati deliberatamente sul cyber, ma arrivano a risultati diversi.
Opus 5 si avvicina a Mythos 5 nel trovare vulnerabilità, anche se è indietro nel trasformarle in exploit. Sonnet 5 è più arretrato: Anthropic afferma apertamente che Sonnet 5 ha "capacità cyber sostanzialmente inferiori rispetto a Opus 4.8 e Mythos 5", e in una valutazione sullo sviluppo di exploit per Firefox non ha mai prodotto un exploit pienamente funzionante (0,0% di successo, solo un lieve vantaggio su Sonnet 4.6 nei tentativi parziali).
Se il tuo caso d'uso tocca qualcosa di adiacente al cyber, questo divario è reale e favorisce chiaramente Opus 5.
Coding e knowledge work
Qui i due post usano set di benchmark diversi, quindi non c'è un confronto pulito.
Opus 5 più che raddoppia Opus 4.8 su Frontier-Bench v0.1 e arriva entro lo 0,5% di Fable 5 su CursorBench 3.2 a metà del costo. Sonnet 5 viene descritto come vicino a Opus 4.8 su BrowseComp e OSWorld-Verified ad alto sforzo.
Letti insieme alla logica delle fasce di cui sopra: Sonnet 5 si avvicina sui compiti specifici che Anthropic ha scelto di mettere in evidenza, ma le vittorie di Opus 5 sembrano più ampie e marcate. Prendi questa parte come direzionale, non come misura puntuale.
Quando scegliere cosa
Scegli Opus 5 se
il compito è ad alto rischio, di lunga durata o davvero nuovo; lavori su scienze della vita, chimica o lavoro agentico complesso a più step; ti serve il modello più allineato disponibile; rientra qualcosa di adiacente alla cybersecurity.
Scegli Sonnet 5 se
gestisci volumi elevati, la latenza conta, o il compito è abbastanza ben delimitato da non richiedere il soffitto di giudizio di Opus; sei su Free o Pro dove è già il predefinito; il costo per token è il vincolo determinante.
Nessuno dei due, se
ti serve lavoro di cybersecurity con barriere protettive ridotte. Opus 5 retrocede automaticamente a Opus 4.8, e Sonnet 5 resta dietro a Opus 4.8 a tutti gli effetti.
Considerazioni finali
La maggior parte del fattore decisivo qui è lo stesso che decide qualsiasi domanda Opus vs. Sonnet: questo compito ha bisogno del soffitto, o ha solo bisogno di essere svolto in modo affidabile su larga scala? Sonnet 5 alza quel soffitto più di quanto abbiano fatto i Sonnet passati, che è la vera novità del suo lancio. Ma dove Anthropic ha messo un numero sui due modelli insieme — l'audit di allineamento — Opus 5 è risultato davanti, e la storia della cybersecurity va nella stessa direzione. Imposta Sonnet 5 come predefinito per il volume, scegli Opus 5 quando il compito non può permettersi una risposta sbagliata.

