Anthropic heeft geen directe Opus 5 vs. Sonnet 5-benchmark gepubliceerd. In elke lancering wordt het model vergeleken met zijn eigen voorganger en met Opus 4.8. De cijfers hieronder vertellen dus maar een deel van het verhaal. De rest blijft dezelfde afweging als bij elke Opus- vs. Sonnet-combinatie: hoeveel plafond heb je echt nodig, en wat ben je bereid ervoor te betalen.
Wat is Claude Opus 5?
Opus 5 is het topmodel van Anthropic, uitgebracht op 24 juli 2026, geprijsd op $5 per miljoen inputtokens en $25 per miljoen outputtokens. Anthropic noemt het state-of-the-art op Frontier-Bench en GDPval-AA, en dicht bij het grotere Fable 5-model voor de helft van de prijs. Het is het standaardmodel op Claude Max en het krachtigste model op Claude Pro.
De opvallendste eigenschap is zelfverificatie: eigen werk controleren, test-harnesses bouwen als er geen datafeed is, en bezwaar maken tegen slechte instructies in plaats van ze klakkeloos te volgen.
Wat is Claude Sonnet 5?
Sonnet 5 is het mid-tier model van Anthropic, uitgebracht op 30 juni 2026. Anthropic omschrijft het als de meest agentische Sonnet tot nu toe, met prestaties dichtbij Opus 4.8 tegen een lagere prijs. Het is het standaardmodel op Free- en Pro-abonnementen, en beschikbaar op Max, Team, Enterprise en via de API.
Prijzen: $2 per miljoen inputtokens en $10 per miljoen outputtokens tot en met 31 augustus 2026, daarna standaard $3/$15.
Het verschil in tiers, in de praktijk
Dit is het deel dat de lanceringposts niet uitschrijven, omdat het gewoon is hoe de modellijn van Anthropic in het algemeen werkt, niet specifiek voor dit paar.
Opus is het plafondmodel
Je kiest hiervoor wanneer fout zitten duur is, wanneer een taak lang en autonoom draait zonder tussentijdse checks, of wanneer het probleem echt nieuw is in plaats van een variatie op iets dat het model al duizend keer heeft gezien. Diepe refactors over meerdere bestanden, ambigue onderzoeksvragen, lange agentische runs waar fouten zich opstapelen — dat is Opus-terrein. Je betaalt ervoor dat het model zijn eigen fouten onderschept voordat ze jouw probleem worden.
Sonnet is het werkpaard
Het is gemaakt om snel en goedkoop genoeg te zijn om voortdurend te draaien: chatassistenten, classificatie op hoge schaal, iteratief coderen waarbij jij toch elke paar stappen beoordeelt, latency-gevoelige toepassingen. Het beoordelingsplafond ligt lager, maar bij een groot deel van het echte werk kom je daar nooit tegenaan. Het dagelijks gebruik van de meeste teams zal naar Sonnet neigen, met Opus selectief ingezet voor taken die het echt nodig hebben.
Sonnet 5 is specifiek Anthropics poging om dat plafond hoger te duwen dan gebruikelijk voor een mid-tier model — vandaar "meest agentische Sonnet tot nu toe" en de claim dat het op sommige taken Opus 4.8 benadert. Dat is de context om de benchmarkcijfers hieronder te lezen: Sonnet 5 is niet alleen goedkoop, het is goedkoop én dichter bij Opus-niveau dan eerdere Sonnets waren.
Wat de releasenummers echt laten zien
Prijs
Het duidelijkste, minst dubbelzinnige verschil. Sonnet 5 kost $2/$10 (t/m 31 aug) of $3/$15 (standaard) tegenover Opus 5's vaste $5/$25 — Sonnet 5 kost 40–60% van Opus 5, afhankelijk van het prijsvenster.
Alignment
De ene plek waar de twee releaseposts elkaar direct noemen. Anthropics geautomatiseerde audit vond dat Opus 5 "beter vasthoudt aan Claude's Constitutie dan Opus 4.8, Sonnet 5 of Fable 5" — een daadwerkelijke, uitgesproken uitkomst, geen interpretatie. Opus 5 scoort 2,3 op die audit, zijn veiligste score tot nu toe. Sonnet 5 verbeterde ten opzichte van zijn eigen voorganger (minder hallucinatie, minder slijmballen-gedrag, betere weerstand tegen prompt-injection-kapingen) maar Anthropic merkt op dat het nog steeds een hogere mate van misaligned gedrag vertoont dan Opus 4.8.
Cybersecurity
Beide modellen zijn niet doelbewust getraind op cyber, maar ze komen op verschillende plekken uit.
Opus 5 komt dicht in de buurt van Mythos 5 bij het vinden van kwetsbaarheden, al loopt het achter bij het omzetten daarvan in exploits. Sonnet 5 staat verder naar achteren: Anthropic zegt expliciet dat Sonnet 5 "aanzienlijk zwakkere cybercapaciteiten heeft dan Opus 4.8 en Mythos 5," en op een Firefox-evaluatie voor exploitontwikkeling produceerde het nooit een volledig werkende exploit (0,0% succes, slechts een kleine voorsprong op Sonnet 4.6 bij gedeeltelijke pogingen).
Als je usecase ook maar iets met cyber te maken heeft, is deze kloof reëel en slaat die duidelijk uit in het voordeel van Opus 5.
Coderen en kenniswerk
Hier gebruiken de twee posts verschillende benchmarksets, dus er is geen nette scorelijn.
Opus 5 meer dan verdubbelt Opus 4.8 op Frontier-Bench v0.1 en komt binnen 0,5% van Fable 5 op CursorBench 3.2 voor de helft van de kosten. Sonnet 5 wordt omschreven als dat het Opus 4.8 benadert op BrowseComp en OSWorld-Verified bij hoge inspanning.
Gezamenlijk gelezen met de tier-logica hierboven: Sonnet 5 komt dichtbij op de specifieke taken die Anthropic uitlicht, maar de overwinningen van Opus 5 lijken groter en breder. Behandel dit als richtinggevend, niet als hard gemeten.
Wanneer welke kiezen
Kies Opus 5 als
de taak high-stakes is, lang loopt of echt nieuw is; je werkt doet in life sciences, chemie of complex meerstaps agentisch werk; je het meest aligned model nodig hebt; alles wat met cybersecurity te maken heeft binnen scope valt.
Kies Sonnet 5 als
je op hoge schaal draait, latency telt, of de taak zo afgebakend is dat je het beoordelingsplafond van Opus niet nodig hebt; je op Free of Pro zit waar het al standaard is; kosten per token de beperkende factor zijn.
Geen van beide, als
je cybersecuritywerk nodig hebt met lagere vangrails. Opus 5 valt automatisch terug naar Opus 4.8, en Sonnet 5 ligt überhaupt achter op Opus 4.8.
Tot slot
Het belangrijkste beslispunt hier is hetzelfde als bij elke Opus-versus-Sonnet-vraag: heeft deze taak het plafond nodig, of moet het vooral betrouwbaar op schaal gedaan worden? Sonnet 5 duwt dat plafond hoger dan eerdere Sonnets, en dat is het echte nieuws van de lancering. Maar waar Anthropic wél een getal op beide modellen samen zette — de alignment-audit — kwam Opus 5 als beste uit de bus, en het cybersecurityverhaal wijst dezelfde kant op. Standaard op Sonnet 5 voor volume, kies Opus 5 wanneer de taak zich geen fout antwoord kan veroorloven.
