Ga naar hoofdinhoud

Claude Sonnet 5 vs. GPT-5.6: benchmarks, prijzen en toegang

Sonnet 5 is nu met korting beschikbaar. GPT-5.6 scoort sterker op Terminal-Bench-2.1 maar is nog niet algemeen beschikbaar. Hier is het volledige overzicht.
Bijgewerkt 30 sep 2026  · 7 min lezen

Verkennen met AI

ChatGPTClaudePerplexity

Anthropic en OpenAI hebben deze week allebei nieuwe releases op tafel, maar de twee lanceringen zitten in verschillende fases.

GPT-5.6 is onthuld, maar zit achter een beperkte preview. En terwijl GPT-5.6 nog niet algemeen beschikbaar is, is Claude Sonnet 5 vandaag verscheept en live in elk Claude-abonnement — met een introductieprijs voor de API die, voorlopig, zelfs onder die van GPT-5.6's middensegmentmodel Terra duikt.

Dit is wat we over elk model weten, hoe ze zich tot elkaar verhouden en waar de cijfers overlappen.

Wat is Claude Sonnet 5?

Claude Sonnet 5 is Anthropic's nieuwste model in het middensegment, en het bedrijf presenteert het als het meest agentische Sonnet-model tot nu toe. Het idee is dat het veel van de kloof naar Opus-klasse modellen dicht op het vlak van plannen en toolgebruik, terwijl het aanzienlijk goedkoper blijft.

Volgens Anthropic is Sonnet 5 een flinke stap vooruit ten opzichte van Sonnet 4.6 op redeneren, coderen en toolgebruik, en ligt de prestatie nu enigszins in de buurt van Opus 4.8 op verschillende agentische evaluaties, waaronder BrowseComp (agentische zoekopdrachten) en OSWorld-Verified (computergebruik).

Opus 4.8 loopt nog steeds voor op pure nauwkeurigheid, vooral bij de hogere of hoogste inspanningsniveaus, maar Sonnet 5 biedt ontwikkelaars wel een sterkere prijs-prestatie-optie. Anthropic's modellen in het middensegment hebben er een handje van om boven hun gewichtsklasse te presteren wanneer een nieuwe generatie landt voordat de volgende Opus-refresh bijtrekt. Het lijkt inmiddels lang geleden, maar Claude Sonnet 3.5 presteerde in 2024 op verschillende benchmarks daadwerkelijk beter dan de oudere Claude Opus 3.

Sonnet 5 gebruikt ook een geüpdatete tokenizer, wat betekent dat dezelfde invoertekst naar meer tokens kan worden gemapt dan voorheen (grofweg 1,0–1,35x afhankelijk van de inhoud).

Wat is GPT-5.6?

GPT-5.6 is niet één model. Het is een familie van drie, georganiseerd onder een nieuw naamgevingssysteem waarbij het getal de generatie markeert en de naam de prestatielaag:

  • Sol is het vlaggenschip. Het is de enige laag met toegang tot twee nieuwe instellingen: een max-instelling voor redeneerinspanning en ultra mode, die een taak uitbesteedt aan een pool van subagenten.

  • Terra is het alledaagse, gebalanceerde model — grofweg vergelijkbaar met GPT-5.5 qua algehele kwaliteit tegen ongeveer de helft van de prijs.

  • Luna is de goedkope laag, gericht op workloads die gevoelig zijn voor latency.

Met het nieuws benadrukt OpenAI vooruitgang in coderen, biologie en cybersecurity. Het grote benchmarkverhaal was de prestatie op verschillende interessante benchmarks, met name Terminal-Bench 2.1, maar ook GeneBench v1, een langetermijn-genomica-benchmark, en twee benchmarks voor exploit-ontwikkeling (ExploitBench en ExploitGym).

Claude Sonnet 5 en GPT-5.6: benchmarkvergelijking

Uit de respectieve aankondigingen delen Sonnet 5 en GPT-5.6 geen enkele gemeenschappelijke benchmark met cijfers van beide kanten.

Hoewel Anthropic wat harde cijfers voor Sonnet 5 heeft gepubliceerd in de lanceringpost en systeemkaart, heeft OpenAI tot nu toe slechts één benchmarkscore voor GPT-5.6 bevestigd: Terminal-Bench 2.1. Dit is wat er daadwerkelijk officieel is voor beide kanten, naast elkaar gezet:

Benchmark Claude Sonnet 5 GPT-5.6 Sol GPT-5.6 Sol Ultra GPT-5.6 Terra GPT-5.6 Luna
Terminal-Bench 2.1 Niet gepubliceerd 88,8% 91,9% 82,5% 84,3%
SWE-bench Pro 63,2% Niet gepubliceerd — Niet gepubliceerd Niet gepubliceerd
OSWorld-Verified (computergebruik) 81,2% Niet gepubliceerd — Niet gepubliceerd Niet gepubliceerd
Humanity's Last Exam (met tools) 57,4% Niet gepubliceerd — Niet gepubliceerd Niet gepubliceerd

Terminal-Bench 2.1 is de ene rij waar GPT-5.6 überhaupt iets heeft gepubliceerd, en Sonnet 5 heeft daar geen gepubliceerde score om te plaatsen. Misschien is dat strategisch omdat GPT-5.6 het goed deed. 

Op de benchmarks waar Sonnet 5 wel cijfers heeft — SWE-bench Pro, OSWorld-Verified, Humanity's Last Exam — heeft GPT-5.6 zijn kaarten simpelweg nog niet laten zien, dus valt er niets tegen te vergelijken.

De eerlijke conclusie is dat een echte Sonnet 5 vs. GPT-5.6-benchmarkvergelijking nog niet volledig bestaat. Elk bedrijf heeft een andere set evaluaties gepubliceerd.

Uitzoomen: waar elk model in het bredere veld past

Omdat Sonnet 5 en GPT-5.6 niet direct overlappen, is het de moeite waard om uit te zoomen en te kijken hoe de gepubliceerde scores zich verhouden tot de rest van het veld — Opus 4.8, het geschorste Fable 5, GPT-5.5 en Gemini 3.1 Pro. Dit beslecht Sonnet 5 vs. GPT-5.6 niet, maar laat wel zien waar elk van beide staat ten opzichte van dezelfde set concurrenten:

Benchmark Claude Opus 4.8 Claude Fable 5 (voor schorsing) GPT-5.5 Gemini 3.1 Pro GPT-5.6 Sol Ultra
Terminal-Bench 2.1 78,9% 83,4% 88,0% 70,7% 91,9%
SWE-bench Pro 69,2% 80,3% 58,6% — Niet gepubliceerd
Humanity's Last Exam (geen tools) 49,8% 59,0% — 44,4% Niet gepubliceerd

Een paar dingen: op Terminal-Bench 2.1 scoort GPT-5.6 Sol Ultra met 91,9% hoger dan elk Claude-model in de boeken, inclusief Opus 4.8 met 78,9%. OpenAI overdreef dus niet toen ze pronkten met GPT-5.6's score op Terminal-Bench 2.1.

Fable 5 leidt nog steeds Opus 4.8 en GPT-5.5 op SWE-bench Pro en Humanity's Last Exam, zelfs terwijl het geschorst is. Die cijfers zijn simpelweg nog niet verslagen, door niemand, inclusief GPT-5.6 (dat geen SWE-bench- of HLE-score heeft gepubliceerd om te vergelijken). Sonnet 5's 63,2% op SWE-bench Pro (uit de tabel hierboven) zou boven GPT-5.5's 58,6% uitkomen maar onder Opus 4.8 en Fable 5 — hooguit een ruwe proxy, aangezien het een andere modelgeneratie is die over twee aparte tabellen van verschillende bedrijven wordt uitgelezen.

Claude Sonnet 5 en GPT-5.6: prijzen

Model Input (per 1M tokens) Output (per 1M tokens)
Claude Sonnet 5 (intro, t/m 31 aug 2026) $2.00 $10.00
Claude Sonnet 5 (standaard) $3.00 $15.00
GPT-5.6 Sol $5.00 $30.00
GPT-5.6 Terra $2.50 $15.00
GPT-5.6 Luna $1.00 $6.00

Qua lijstprijs valt Sonnet 5's introductieprijs tussen GPT-5.6 Terra en Luna, en ruim onder Sol. Maar de introductieprijs is het interessantere datapunt: met $2/$10 onderbiedt Sonnet 5 feitelijk GPT-5.6 Terra's $2,50/$15, in elk geval tot de zomer wanneer er een prijsverhoging komt.

Voor de duidelijkheid: het prijsverhaal is iets complexer dan simpele achterkant-van-de-envelopberekeningen. Anthropic merkt op dat de introductieprijs van Sonnet 5 is gekalibreerd om ruwweg kostenneutraal te zijn ten opzichte van de hogere tokenaantallen van de nieuwe tokenizer. En OpenAI introduceert op zijn beurt voorspelbaardere promptcaching voor GPT-5.6 en latere modellen, waarbij cache-writes worden gefactureerd tegen 1,25x het niet-gecachete inputtarief en cache-reads een korting van 90% behouden. 

Waarom überhaupt met een gereduceerde introductieprijs lanceren, in plaats van vanaf dag één het standaardtarief te zetten? De tokenizer-verklaring dekt een deel, maar de timing sluit ook aan bij wat we zien: een druk en snel bewegend veld. In de afgelopen weken alleen al bracht Sakana AI Fugu uit, een orkestrator die routeert over een pool van frontiermodellen en claimt in de buurt te komen van Anthropics eigen Mythos-klasse systemen voor een fractie van de kosten. Dus door Sonnet 5 te prijzen op $2/$10 tot eind augustus heeft Anthropic een oprecht goedkoop, breed beschikbaar agentisch model om naar te wijzen terwijl GPT-5.6 nog in preview vastzit. Het model zijn dat mensen daadwerkelijk kunnen gebruiken, tegen een lage prijs, is een echt concurrentievoordeel.

Claude Sonnet 5 en GPT-5.6: beschikbaarheid

Claude Sonnet 5 is per vandaag overal beschikbaar. Het is het standaardmodel op Free- en Pro-abonnementen, toegankelijk op Max, Team en Enterprise, en live in Claude Code en op het Claude Platform via de API (modelstring claude-sonnet-5). Je hebt Claude Sonnet 5 misschien al in het chatvenster gezien voordat je de aankondiging überhaupt zag. 

claude sonnet 5 chat

GPT-5.6 is niet algemeen beschikbaar. Tijdens de preview is het alleen toegankelijk via de API en Codex voor een geselecteerde groep partners. OpenAI zegt dat bredere beschikbaarheid eraan komt, maar heeft geen datum gegeven. 

Tot slot

Op de ene overlappende benchmark rapporteert GPT-5.6's vlaggenschiplaag hogere scores dan Claude's huidige vlaggenschip, Opus 4.8, wat suggereert dat OpenAI een echte capaciteitsvoorsprong kan hebben zodra GPT-5.6 breed uitrolt. Maar Sonnet 5 is qua capaciteit niet echt Sol's of Terra's directe concurrent — het is een middensegmentmodel dat concurreert op agentische performance per dollar, en op dat front is het beschikbaar, scherp geprijsd en werkt het vandaag.


Josef Waples's photo
Author
Josef Waples

Ik ben een schrijver en editor op het gebied van data science en heb bijgedragen aan onderzoeksartikelen in wetenschappelijke tijdschriften. Ik ben vooral geïnteresseerd in lineaire algebra, statistiek, R en dergelijke. Ik speel ook best wat schaak! 

Onderwerpen
Kunstmatige intelligentie

Leer met DataCamp

Cursus

Introductie tot Claude-modellen

3 Hr
14.6K
Leer hoe je met Claude kunt werken met de Anthropic API om echte taken op te lossen en AI-gestuurde apps te bouwen.
Bekijk detailsRight Arrow
Begin Met De Cursus
Meer zienRight Arrow