Anthropic heeft geen directe benchmark tussen Opus 5 en Sonnet 5 gepubliceerd. Elke lanceringspost vergelijkt het model met z’n eigen voorganger en met Opus 4.8. De cijfers hieronder vertellen dus maar een deel van het verhaal. De rest is dezelfde afweging die je bij elke Opus-vs-Sonnet-combinatie maakt: hoeveel topniveau heb je echt nodig, en wat ben je bereid ervoor te betalen.
Wat is Claude Opus 5?
Opus 5 is het topmodel van Anthropic, uitgebracht op 24 juli 2026, geprijsd op $5 per miljoen inputtokens en $25 per miljoen outputtokens. Anthropic noemt het state-of-the-art op Frontier-Bench en GDPval-AA, en dicht bij het grotere Fable 5-model voor de helft van de prijs. Het is het standaardmodel op Claude Max en het sterkste model op Claude Pro.
De opvallendste eigenschap is zelfverificatie: z’n eigen werk controleren, test-harnesses bouwen als er geen datafeed is, en slechte instructies tegenspreken in plaats van volgen.
Wat is Claude Sonnet 5?
Sonnet 5 is het midtier-model van Anthropic, uitgebracht op 30 juni 2026. Anthropic beschrijft het als de meest agentische Sonnet tot nu toe, met prestaties dicht bij Opus 4.8 voor een lagere prijs. Het is het standaardmodel op Free- en Pro-abonnementen, en beschikbaar op Max, Team, Enterprise en de API.
Prijs: $2 per miljoen inputtokens en $10 per miljoen outputtokens tot en met 31 augustus 2026, daarna standaard $3/$15.
Het verschil in tiers, in praktische termen
Dit is het deel dat de releaseposts niet expliciet maken, omdat het gewoon is hoe Anthropic’s modellijn doorgaans werkt, niet specifiek voor dit paar.
Opus is het plafondmodel
Je kiest hiervoor wanneer fout zitten duur is, wanneer een taak lang en autonoom draait zonder tussentijdse controles, of wanneer het probleem echt nieuw is in plaats van een variant op iets dat het model al duizend keer zag. Diepe refactors over meerdere bestanden, ambigue onderzoeksvragen, lange agentische runs waar fouten zich opstapelen — dat is Opus-terrein. Je betaalt ervoor dat het model z’n eigen fouten vangt voordat ze jouw probleem worden.
Sonnet is het werkpaard
Het is gebouwd om snel en goedkoop genoeg te zijn om constant te draaien: chatassistenten, classificatie op grote schaal, iteratief coderen waarbij jij toch elke paar stappen beoordeelt, latency-gevoelige toepassingen. De beoordelingsplafond ligt lager, maar voor een groot deel van het echte werk tik je het nooit aan. Het dagelijks gebruik van de meeste teams zal richting Sonnet neigen, met Opus selectief ingezet voor de taken die het echt nodig hebben.
Sonnet 5 specifiek is Anthropics poging om dat plafond hoger te duwen dan gebruikelijk voor een midtier-model — vandaar "meest agentische Sonnet tot nu toe" en de claim dat het op sommige taken in de buurt komt van Opus 4.8. Dat is de context om de benchmarkcijfers hieronder te lezen: Sonnet 5 is niet alleen goedkoop, het is goedkoop én dichter bij Opus-niveau dan eerdere Sonnets waren.
Wat de releasenummers echt laten zien
Prijs
Het duidelijkste, minst dubbelzinnige verschil. Sonnet 5 draait op $2/$10 (tot en met 31 aug) of $3/$15 (standaard) tegenover Opus 5’s vaste $5/$25 — Sonnet 5 kost 40–60% van Opus 5 afhankelijk van het prijsvenster.
Alignment
De ene plek waar de twee releaseposts elkaar direct noemen. Anthropics geautomatiseerde audit vond dat Opus 5 "Claude’s Constitution beter naleeft dan Opus 4.8, Sonnet 5 of Fable 5" — een echt, vermeld resultaat, geen afleiding. Opus 5 scoort 2,3 op die audit, z’n veiligste score tot nu toe. Sonnet 5 verbeterde ten opzichte van z’n eigen voorganger (minder hallucinaties, minder jaknikkeren, betere weerstand tegen prompt-injection-hijacks) maar Anthropic merkt op dat het nog steeds een hogere mate van misaligned gedrag vertoont dan Opus 4.8.
Cyberbeveiliging
Beide modellen zijn niet bewust getraind op cyber, maar ze komen op verschillende plekken uit.
Opus 5 komt dicht bij Mythos 5 in het vinden van kwetsbaarheden, al loopt het achter bij het omzetten ervan in exploits. Sonnet 5 staat verder naar achter: Anthropic zegt expliciet dat Sonnet 5 "aanzienlijk zwakkere cybercapaciteiten heeft dan Opus 4.8 en Mythos 5", en op een Firefox-evaluatie voor exploit-ontwikkeling produceerde het nooit een volledig werkende exploit (0,0% succes, slechts een kleine voorsprong op Sonnet 4.6 bij gedeeltelijke pogingen).
Als je usecase iets met cyber te maken heeft, is dit gat reëel en werkt het duidelijk in het voordeel van Opus 5.
Coderen en kenniswerk
Hier gebruiken de twee posts verschillende benchmarksets, dus er is geen nette scorelijn.
Opus 5 verdubbelt ruim Opus 4.8 op Frontier-Bench v0.1 en komt binnen 0,5% van Fable 5 op CursorBench 3.2 voor de helft van de kosten. Sonnet 5 wordt beschreven als dicht bij Opus 4.8 komend op BrowseComp en OSWorld-Verified bij hoge inspanning.
Samen gelezen met de tierlogica hierboven: Sonnet 5 komt dichtbij op de specifieke taken die Anthropic uitlichtte, maar de overwinningen van Opus 5 lijken groter en breder. Beschouw dit als richtinggevend, niet exact gemeten.
Wanneer kies je welke
Kies Opus 5 als
de taak high-stakes, langdurig of echt nieuw is; je werkt in life sciences, chemie of complex meerstaps agentisch werk; je het meest aligned model nodig hebt; iets cybergerelateerds binnen scope valt.
Kies Sonnet 5 als
je op hoge volumes draait, latency telt, of de taak zo goed is afgebakend dat je Opus’ beoordelingsplafond niet nodig hebt; je op Free of Pro zit waar het al de standaard is; de kosten per token de beperkende factor zijn.
Geen van beide, als
je cyberbeveiligingswerk nodig hebt met minder vangrails. Opus 5 valt automatisch terug naar Opus 4.8, en Sonnet 5 staat sowieso achter Opus 4.8.
Slotgedachten
Het grootste deel van de keuze hier is dezelfde afweging als bij elke Opus-vs-Sonnet-vraag: heeft deze taak het plafond nodig, of moet het vooral betrouwbaar op schaal gebeuren? Sonnet 5 duwt dat plafond hoger dan eerdere Sonnets, wat het echte nieuws bij de lancering is. Maar waar Anthropic wél een getal op beide modellen samen plakte — de alignment-audit — kwam Opus 5 als beste uit de bus, en het cyberverhaal wijst dezelfde kant op. Standaard op Sonnet 5 voor volume, grijp naar Opus 5 wanneer de taak zich geen fout antwoord kan permitteren.
