Cursus
Je zit midden in een refactor, Claude Code boekt vooruitgang, en dan stopt hij ineens met reageren. Geen crash. Geen fouten. Alleen een melding dat je een gebruikslimiet hebt bereikt. De meeste gebruikers denken dat dit gebeurt omdat ze te veel prompts hebben gestuurd. In werkelijkheid zijn prompts maar een klein deel van de puzzel. Ik ben hier zelf ook tegenaan gelopen, en het kostte me wat tijd om het helemaal te begrijpen.
Het limietensysteem van Claude Code is gebaseerd op een combinatie van rollende sessievensters, wekelijkse plafonds, modelspecifieke toekenningen en context op de achtergrond die veel tokens verbruikt en met elk verzoek wordt meegestuurd. Dingen als regelsbestanden, MCP-tooldefinities, geheugenbestanden en gespreksgeschiedenis kunnen een groot deel van je beschikbare capaciteit opsouperen nog voordat je veel hebt getypt.
In deze gids leg ik uit hoe de gebruikslimieten van Claude Code werken, hoe je je huidige verbruik controleert en welke verborgen bronnen van overhead er vaak voor zorgen dat ontwikkelaars sneller dan verwacht tegen limieten aanlopen.
Als je nieuw bent met Claude Code, raad ik aan om eerst onze Claude Code-tutorial te bekijken of de cursus Claude Code 101 te volgen.
Wat zijn gebruikslimieten van Claude Code?
Het gebruik van Claude Code wordt geregeld door twee overlappende systemen:
- Een rollend sessievenster van 5 uur
- Een of meer wekelijkse gebruiksplafonds
Als je een van beide raakt, loop je tegen rate limiting aan.
Het rollende venster van 5 uur
De meest zichtbare rate limit van Claude Code is het rollende venster van 5 uur. Je venster begint wanneer je je eerste prompt verstuurt. Alles wat je in de volgende vijf uur doet, gaat uit dezelfde gebruikspool. Deze pool wordt gedeeld door Claude Code en Claude chat, wat betekent dat activiteit in de ene invloed heeft op de andere.
Bijvoorbeeld:
- Eerste prompt: 9:00
- Venster eindigt: 14:00
Als je je beschikbare gebruik om 10:30 al hebt opgebruikt, pauzeert de toegang tot het venster om 14:00 wordt gereset.
Een veelvoorkomend misverstand is dat een nieuw gesprek starten het gebruik reset. Dat is niet zo. Het commando /clear start alleen een nieuwe gesprekscontext. Het herstelt geen gebruikstoekenning en reset de 5-uurstimer niet.
Wekelijkse limieten
Naast tijdsgebonden sessielimieten hanteert Claude Code ook wekelijkse limieten. Zelfs als je nog ruimte hebt in je huidige sessie, kan het bereiken van een wekelijks plafond tijdelijk verder gebruik verhinderen totdat de wekelijkse reset plaatsvindt.
Zie het zo: het 5-uurplafond beperkt het moment van je gebruik, en de wekelijkse limiet begrenst je totale gebruiksvolume.
Dat betekent dat het mogelijk is om nog capaciteit over te hebben in je huidige 5-uurssessie, maar toch geblokkeerd te zijn omdat je je wekelijkse toekenning hebt opgebruikt. Voor de meeste Pro-gebruikers is dit onderscheid vrij eenvoudig. Max-abonnementen voegen echter een extra laag complexiteit toe.
Wekelijkse Sonnet-limiet voor Max-gebruikers
Anthropic past momenteel de volgende limiet toe voor Max-abonnementen:
- Een wekelijkse limiet voor alle modellen samen
- Een aparte wekelijkse limiet specifiek voor Sonnet-gebruik
Dit onderscheid is belangrijk, omdat je nog Sonnet-capaciteit beschikbaar kunt hebben nadat je je bredere modeltoekenning hebt opgebruikt, of andersom.
Stel bijvoorbeeld dat je het grootste deel van je week Sonnet gebruikt voor implementatiewerk. Je zou je Sonnet-specifieke wekelijkse toekenning kunnen uitputten terwijl je nog capaciteit over hebt in je algemene wekelijkse toekenning. Op dat moment moet je mogelijk overschakelen naar een ander model, wachten op de Sonnet-reset of je abonnement upgraden, afhankelijk van je resterende limieten.
Het omgekeerde kan ook gebeuren. Als je gedurende de week veel Opus hebt gebruikt, kun je je algemene wekelijkse limiet bereiken, ook al is je Sonnet-specifieke toekenning nog niet volledig verbruikt. Omdat de algemene limiet de overkoepelende limiet is, voorkomt het bereiken ervan verder gebruik, ongeacht hoeveel Sonnet-capaciteit er nog resteert.
Voor succesvolle Sonnet-verzoeken moeten beide voorwaarden waar zijn:
- Je hebt nog ruimte binnen je algemene wekelijkse limiet.
- Je hebt nog ruimte binnen je wekelijkse Sonnet-limiet.
Opus-verzoeken daarentegen gebruiken alleen de algemene wekelijkse pool, omdat er geen aparte Opus-specifieke toekenning is. Dit is waarom de pagina Usage in Claude.ai zo belangrijk is. Daar zie je elke wekelijkse limiet afzonderlijk met de reset-tijd, wat het veel makkelijker maakt te begrijpen welke limiet je nadert voordat je aan een lange codeersessie begint.

Gebruik van Claude Code per abonnement
Een uitdaging bij het vergelijken van abonnementen is dat Anthropic geen simpele "prompt-aantallen" meer publiceert.
In plaats daarvan worden abonnementen beschreven met relatieve capaciteitsvermenigvuldigers. Deze vermenigvuldigers weerspiegelen de gebruikscapaciteit die je krijgt ten opzichte van de Pro-basislijn. Het is niet eenvoudig om deze exacte cijfers te krijgen; sommige gebruikers volgen hun gebruik als percentage om een redelijk idee te krijgen van hoeveel tokens ze per percentage capaciteit hebben gebruikt.
|
Abonnement |
Maandprijs |
Relatieve capaciteit |
Wekelijkse limieten |
Gedeeld met Claude Chat |
|
Pro |
$20 |
Basislijn |
Ja |
Ja |
|
Max 5x |
$100 |
5× Pro-capaciteit |
Ja |
Ja |
|
Max 20x |
$200 |
20× Pro-capaciteit |
Ja |
Ja |
|
Team |
Variabel |
Hogere gedeelde toekenning |
Ja |
Ja |
|
Enterprise |
Maatwerk |
Organisatiespecifiek |
Ja |
Ja |
Wijzigingen in gebruikslimieten in mei 2026
Anthropic heeft in mei 2026 de capaciteit van Claude Code vergroot door de abonnementslimieten te verdubbelen en de piekurenreducties te verwijderen die eerder Pro- en Max-abonnees troffen. In plaats van vaste prompt-aantallen te publiceren, drukt Anthropic de verschillen tussen abonnementen nu uit als relatieve capaciteitsvermenigvuldigers, omdat het daadwerkelijke gebruik afhangt van modelkeuze, contextgrootte en toolgebruik.
Sindsdien heeft Anthropic de wekelijkse limieten af en toe aangepast via tijdelijke promoties. Zo werden tijdens de uitrol van Claude Fable 5 de wekelijkse limieten van Claude Code voor in aanmerking komende abonnees met 50% verhoogd. Omdat deze promotionele verhogingen tijdelijk zijn, moeten lezers altijd de nieuwste limieten in het Claude Usage-dashboard controleren voordat ze langdurige workloads plannen.
Agent SDK-credits (juni 2026)
Het plan om interactieve codeersessies te scheiden van geautomatiseerde agent-workloads zorgde in juni 2026 voor enige verwarring.
Voor 15 juni kwam alle activiteit in Claude Code uit dezelfde abonnementspool. Of je nu interactief in de terminal chat, een GitHub Action uitvoert of claude -p aanroept in een CI-pipeline: alles concurreerde om dezelfde 5-uurse en wekelijkse limieten.
Anthropic was van plan om deze workloads op 15 juni 2026 te gaan splitsen, maar pauzeerde de wijziging op de lanceringsdag zelf. Dit betekent dat interactief gebruik en programmatisch gebruik (Agent SDK, claude -p, GitHub Actions) nog steeds uit dezelfde abonnementspool putten als voorheen.
Vanaf juli 2026 is er geen aparte Agent SDK-credit live en geen opt-in-credit om te claimen.
Wat put je quotum nu echt uit?
Veel ontwikkelaars focussen op promptgebruik en token-tuning. De echte boosdoener is vaak context. Elke interactie bevat aanzienlijk meer informatie dan de vraag die je typt.
CLAUDE.md en regelsbestanden
Claude Code laadt automatisch instructies uit:
-
CLAUDE.md -
Bovenliggende directory-
CLAUDE.md-bestanden -
Geïmporteerde
@-verwijzingen -
.claude/rules/*.md-bestanden
Al deze context en extra instructies worden herhaaldelijk in verzoeken opgenomen. Dit betekent dat een opgeblazen regelsbestand stilletjes het tokenverbruik gedurende de hele sessie verhoogt. Anthropic raadt aan om individuele CLAUDE.md-bestanden onder ongeveer 200 regels te houden.
Overweeg bij grotere projecten om instructies op te splitsen in afgebakende regels die paths-frontmatter gebruiken, zodat ze alleen laden wanneer relevant. Wil je dieper duiken, bekijk dan onze gids voor het schrijven van de beste CLAUDE.md met effectieve organisatiestrategieën.
MCP-tooldefinities
Model Context Protocol (MCP)-servers zijn een andere verborgen bron van overhead. Elke gekoppelde MCP-server injecteert toolschema's in de context van Claude, zelfs als je die tools nooit gebruikt.
Stel je voor:
- 5 MCP-servers
- 10 tools per server
Dat zijn 50 tooldefinities die bij elk verzoek worden meegestuurd. Ongebruikte MCP-servers loskoppelen is een van de eenvoudigste manieren om het tokenverbruik van Claude Code te verminderen.
Eén belangrijke kanttekening: vermijd het toevoegen of verwijderen van MCP-servers tijdens een actieve sessie. Dit maakt promptcache-prefixen ongeldig en kan het gebruik verhogen.
Automatisch geheugen
Sinds Claude Code v2.1.59 is automatisch geheugen standaard ingeschakeld. Geheugen is globale kennis die Claude tijdens verschillende sessies heeft opgeslagen en die extra context geeft. Dit kan variëren van methodes om data uit een database te halen tot technische details die zijn geïmplementeerd.
Bij het opstarten laadt Claude inhoud uit MEMORY.md, tot:
- Eerste 200 regels
- Eerste 25 KB
Voor sommige workflows is dit nuttig. Voor andere is het gewoon extra context.
Je kunt automatisch geheugen op een paar manieren uitschakelen. Voor een permanente kill-switch die alle andere instellingen overschrijft (handig in CI-pipelines en geautomatiseerde omgevingen), stel je de omgevingsvariabele in je shell in:
export CLAUDE_CODE_DISABLE_AUTO_MEMORY=1
Of voeg het volgende toe aan je settings.json. Gebruik ~/.claude/settings.json om het voor alle projecten uit te schakelen, of .claude/settings.json voor één project:
{ "autoMemoryEnabled": false }
Als je geheugenbestanden niet actief gebruikt, kan het uitschakelen van deze functie de baselinesize van de context verminderen.
Gespreksgeschiedenis en zoeken
Gespreksgeschiedenis groeit continu. Elk toolresultaat, bestandslezing, grep-uitvoer, terminalcommando en codezoekactie wordt onderdeel van de sessiecontext.
Mijn ervaring is dat het verkennen van repositories vaak de grootste bijdrage levert. Claude kan tientallen bestanden lezen om één functie te vinden. Die bestanden blijven beschikbaar in de context en dragen bij aan token-overhead bij volgende beurten.
Voor geautomatiseerde workflows kan claude -p --bare veel van deze vaste overhead verminderen door onnodige sessiecontext te strippen. Dit kan een hoop van de maandelijkse Agent SDK-credits besparen die anders zouden worden verbrand doordat Claude door bestanden zoekt.
Hoe controleer je je Claude Code-gebruik
De beste tijd om je gebruik te controleren is vóór een lange codeersessie. Zo weet je hoe dicht je bij je limieten zit voordat je daadwerkelijk gaat coderen.
Met /usage
In Claude Code toont het typen van /usage:
- Sessieverbruik
- Wekelijks verbruik
- Resterende toekenning
Dit is een mooie manier om een overzicht te krijgen van hoeveel quotum je nog hebt in je interactieve sessie, zodat je vooruit kunt plannen. Proberen om net voor je limiet een grote, complexe taak te starten is misschien niet het slimst, maar eenvoudige taken zoals opruimen van bestanden kunnen een goede besteding van je resterende quotum zijn.
Met /status
Je kunt ook /status uitvoeren, dat de volgende informatie geeft:
- Huidig abonnement
- Accountinformatie
- Actieve gebruiksstatus
Weten welk abonnement je hebt en wat je actieve status is, helpt je potentiële beperkingen te begrijpen. Het maakt uit of je gebruik 5× of 20× de basislijn is.
Het Claude-dashboard controleren
De meest volledige weergave vind je in Settings → Usage binnen Claude.ai.

Dit dashboard combineert:
- Gebruik van Claude chat
- Gebruik van Claude Code
- Wekelijkse resetschema's
- Modelspecifieke limieten
Omdat er meerdere limieten tegelijk kunnen bestaan, moet je dit dashboard als de bron van waarheid zien. Een handige gewoonte is om het gebruik te checken voordat je aan groot refactorwerk, lange debugsessies of autonome coding-taken begint.
Hoe je het meeste uit je Claude Code-limieten haalt
Laten we het hebben over hoe we onze gebruikslimieten kunnen oprekken zonder abonnementen te upgraden. Soms krijgen we veel efficiëntere capaciteit door simpelweg de overhead te verminderen.
Snoei je CLAUDE.md
Streef naar minder dan 200 regels per bestand om de hoeveelheid context die je verstuurt te minimaliseren en de verwarring voor de agent te beperken. Let op:
- Verouderde projectinstructies
- Historische notities
- Regels die in individuele prompts thuishoren
Als instructies alleen voor specifieke mappen gelden, gebruik dan afgebakende regels met paths-frontmatter, zodat niet al je regels constant worden gebruikt, maar alleen binnen bepaalde paden. Je kunt ook projectniveau-CLAUDE.md-bestanden hebben in plaats van één globaal bestand.
Controleer je MCP-servers
Houd alleen de MCP-servers aan die je actief gebruikt. Elke verbonden server voegt schema-overhead toe aan elke interactie. Behandel je MCP-configuratie als browsertabbladen. Gebruik je het nu niet, sluit het dan.
Een goede manier om MCP-servers te beheren is om ze op projectniveau te installeren wanneer je weet dat je bepaalde MCP's alleen voor bepaalde projecten nodig hebt, in plaats van op gebruikersniveau. Zo probeert Claude ze niet bij elk project of elke sessie te laden, maar alleen wanneer je ze voor een specifieke usecase nodig hebt.
Gebruik /compact vroeg
Het commando /compact vat de gespreksgeschiedenis samen en vermindert toekomstige tokencosts. Door de groei van de context die bij elke beurt wordt verwerkt te beperken, verminderen we het quotumverbruik.
Hoewel het het reeds verbruikte quotum niet herstelt, kan het helpen als je /compact gebruikt voordat de sessie té groot wordt.
Kies het model passend bij de taak
Niet elke taak heeft Opus of Fable nodig. Soms kunnen kleinere modellen of slim gebruik van modellen helpen om je quotum te beheren. Je kunt je beschikbare capaciteit vaak aanzienlijk vergroten door premium modellen te reserveren voor werk met hoge waarde.
Hier zijn enkele modeloptimalisatiestrategieën:
- Gebruik Opus voor architectuurbeslissingen, complexe redenering en onduidelijke requirements
- Sonnet voor bewerken, zoeken en implementatiewerk
- Haiku voor lichte taken en snelle lezingen
Maar voorkom dat je binnen een sessie herhaaldelijk van model wisselt. Promptcaches zijn modelspecifiek, dus elke wissel dwingt het nieuwe model om de hele gespreksgeschiedenis opnieuw volledig te verwerken tegen volledige tokencost, in plaats van deze goedkoop uit de cache te lezen. Dit kan je quotum sneller opbranden dan blijven zitten, zelfs als je naar een "goedkoper" model overschakelt.
Als je de muur raakt: API-achtervang
Als abonnementsquota een bottleneck worden, biedt de Claude API een alternatief. API-gebruik beperkt je niet tot sessievensters van vijf uur of wekelijkse abonnementsplafonds. In plaats daarvan betaal je op basis van tokenverbruik.
Dit model is vaak logisch voor:
- CI-pipelines
- Langlopende autonome agents
- Grootschalige automatisering
- Productieworkflows met voorspelbare budgetten
Let erop dat je de omgevingsvariabele ANTHROPIC_API_KEY niet in je Claude Code-shell laat staan. Als die sleutel aanwezig is in je omgeving, kan Claude Code via de API authenticeren in plaats van via je abonnement.
Dit kan tot onverwachte API-kosten leiden, omdat je niet langer je abonnementslimieten gebruikt, maar in plaats daarvan tokencosts betaalt. Wanneer kosten ongewoon lijken, zou het controleren van de authenticatie-instellingen een van je eerste stappen voor probleemoplossing moeten zijn.
Raadpleeg voor actuele modelprijzen altijd de officiële prijsdocumentatie van Anthropic, omdat tarieven vaak wijzigen en per model verschillen.
Tot slot
De gebruikslimieten van Claude Code zijn makkelijker te beheren als je begrijpt dat er niet simpelweg prompts worden geteld.
Het systeem combineert:
- Een rollend venster van 5 uur
- Wekelijkse plafonds
- Modelspecifieke toekenningen
- Context-overhead
De grootste verrassing voor veel ontwikkelaars is dat prompts vaak een minderheid van het totale tokenverbruik vormen. Grote CLAUDE.md-bestanden, MCP-tooldefinities, automatisch geheugen, repository-zoekacties en groeiende gespreksgeschiedenis verbruiken vaak meer capaciteit dan de vragen zelf.
In de praktijk hebben de meeste mensen die ongewoon snel limieten raken eerder een configuratieprobleem dan een capaciteitsprobleem. Verminder eerst de overhead door de context op te schonen voordat je je abonnement upgrade om een groter quotum te kopen.
Om je workflow verder te verbeteren, raad ik onze gids met best practices voor Claude Code en onze tutorial Claude Code Hooks aan, die beide technieken behandelen om Claude Code efficiënter en robuuster te maken tijdens lange ontwikkelsessies.
Veelgestelde vragen over gebruikslimieten van Claude Code
Wat zijn de gebruikslimieten van Claude Code?
De gebruikslimieten van Claude Code bestaan uit een rollend sessievenster van 5 uur en een of meer wekelijkse gebruiksplafonds. Zowel Claude Code als Claude chat putten uit dezelfde abonnementspool.
Hoe controleer ik het gebruik van Claude Code?
Je kunt het gebruik controleren met /usage binnen Claude Code, /status voor accountdetails, of het Usage-dashboard in Claude.ai onder Settings → Usage.
Wat verbruikt de meeste Claude Code-tokens?
Veelvoorkomende verborgen oorzaken zijn grote CLAUDE.md-bestanden, MCP-toolschema's, automatisch geheugen, gespreksgeschiedenis, tooluitvoer en zoekresultaten in de repository.
Hoe kan ik het tokenverbruik van Claude Code verminderen?
Best practices zijn onder meer het beknopt houden van CLAUDE.md-bestanden, het uitschakelen van ongebruikte MCP-servers, het proactief gebruiken van /compact, het verwijderen van onnodige geheugenbestanden, het model afstemmen op de complexiteit van de taak en het vermijden van overmatige repository-brede zoekacties.
Is het Agent SDK-creditsysteem gelanceerd?
Nee. Anthropic was van plan om programmatisch gebruik te scheiden van interactief Claude-gebruik vanaf 15 juni 2026, maar pauzeerde deze wijziging op de lanceringsdag zelf, met de mededeling dat "er voorlopig niets verandert". Claude Agent SDK, claude -p, Claude Code GitHub Actions en toepassingen van derden die de Agent SDK gebruiken, blijven momenteel uit dezelfde abonnementslimieten putten als interactief gebruik van Claude Code.
Ik ben een data scientist met ervaring in ruimtelijke analyse, machine learning en datapijplijnen. Ik heb gewerkt met GCP, Hadoop, Hive, Snowflake, Airflow en andere data science- en engineeringprocessen.

