Claude Code-tokengebruik controleren en verlagen
Bijgewerkt September 27, 2026 · eerst gepubliceerd September 27, 2026
Voer /usage uit om te zien wat Claude Code uitgeeft, en /context om te zien wat het venster vult. Om minder uit te geven, houd je de context klein: maak tussen taken door leeg, verlaag het effortniveau en houd uitgebreide uitvoer uit het hoofdgesprek. Context weegt zwaarder dan al het andere, omdat Claude Code het hele gesprek bij elk verzoek opnieuw verstuurt. In onze eigen logs waren 96% van de tokens het opnieuw lezen van context door de agent.
Deze pagina behandelt de commando's die je gebruik tonen, de instellingen die het het meest verschuiven, en waar de tokens echt naartoe gaan. De tips komen uit de kostendocumentatie van Anthropic. De cijfers komen uit onze eigen Claude Code-logs en gepubliceerde benchmarks.
Hoe controleer ik het tokengebruik van Claude Code?
/usage: toont tokenaantallen en een geschatte kost voor de huidige sessie, een regel voor de prompt-cache, en op Pro-, Max-, Team- en Enterprise-abonnementen je gebruiksbalken per abonnement. Ook splitst het uit wat je abonnement gebruikt: skills, subagents, plugins, MCP-servers en geplande loops, over de afgelopen 24 uur of 7 dagen./context: toont wat nu het contextvenster vult, met hints over wat je kunt inkorten./insights: schrijft een HTML-rapport over je recente sessies en waar je tijd en tokens verliest.- De statusregel: een script kan bij elke prompt kosten, gebruikte context en je 5-uurs- en 7-dagenpercentages van het abonnement tonen. Zie documentatie over de statusregel.
- claude.ai Settings > Usage: abonnementslimieten en uitgaven aan gebruikscredits, ook gebruik vanaf andere apparaten.
Bij een Pro- of Max-abonnement is het dollarbedrag in /usage wat de sessie zou hebben gekost tegen API-listprijzen, niet wat je betaalt. Het blijft de beste enkele maatstaf voor hoe zwaar een sessie is.
Waar gaan de tokens van Claude Code echt naartoe?
Vooral naar het opnieuw lezen van context. Elk verzoek draagt het volledige gesprek mee, en elke toolaanroep stuurt nog een verzoek met de resultaten. Over onze Claude Code-logs waren 7.0 miljard cache-lees-tokens 96% van alle tokens en de helft van een API-rekening van $6,986. Uitvoertokens, het deel dat je ziet, waren onder de 1% van het volume.
Daarom is een vraag van één regel in een sessie die de hele dag open staat niet goedkoop. Die draagt de hele dag mee. Onze pagina over tokens per abonnement heeft de volledige uitsplitsing: ongeveer 1.9 miljard tokens in een Max 20x-week en ongeveer 39 miljoen in een Max 5x-sessie.
Hoe verlaag ik het tokengebruik van Claude Code?
Dit zijn de wijzigingen die het gebruik het meest verschuiven, in grove volgorde van effect.
- Maak tussen niet-verwante taken leeg.
/clearstart een nieuwe context en kost niets. Gebruik eerst/renameals je de oude sessie later wilt openen met/resume. - Verlaag het effortniveau. Op Opus 5.5 kostte één taak in Artificial Analysis-runs $5.98 op maximale effort en $1.34 op medium, een verschil van 4.5x door één instelling. Gebruik
/effortom het te wijzigen. Details op onze pagina over kosten per effortniveau. - Kies het model dat bij de taak past. Anthropic raadt Sonnet aan voor het meeste coderen en Opus voor zware architectuur- of meerstapswerk. Wissel met
/model, en zetmodel: haikuop eenvoudige subagents. - Neem geen lange pauzes midden in een sessie. De prompt-cache duurt een uur bij een abonnement en vijf minuten bij gebruikscredits of een API-sleutel. Terugkomen nadat hij is verlopen verwerkt je hele context opnieuw tegen volle prijs.
- Houd luidruchtige uitvoer uit de hoofdcontext. Stuur testruns, het lezen van logs en het ophalen van documentatie naar subagents, zodat alleen een samenvatting terugkomt. Een hook kan een log van 10,000 regels terugbrengen tot de foutregels voordat Claude het ziet.
- Snoei wat bij de start laadt. Houd CLAUDE.md onder ongeveer 200 regels en verplaats workflowspecifieke instructies naar skills, die alleen laden als ze gebruikt worden. Zet MCP-servers die je niet gebruikt uit met
/mcp. Gebruik CLI-tools zoalsghwaar er één bestaat. - Schrijf specifieke prompts en plan eerst. “Verbeter deze codebase” laat Claude alles scannen. Plan-modus (Shift+Tab) vangt een verkeerde aanpak op voordat die een volledige implementatie kost.
- Let op achtergrondwerk. Geplande loops, agent-teamgenoten en inactieve subagents blijven je volledige context sturen. Agent-teams gebruiken ongeveer 7x de tokens van een normale sessie wanneer teamgenoten in plan-modus draaien.
Bespaart /compact tokens?
Alleen bij latere verzoeken, en het comprimeren van een grote context is zelf een groot verzoek. /compact leest het hele gesprek om het samen te vatten. Als je de geschiedenis niet nodig hebt, is /clear goedkoper. Als je die wel nodig hebt, bewaart /compact met instructies (bijvoorbeeld /compact bewaar de API-wijzigingen en de falende tests) wat ertoe doet. Je kunt ook een eerdere drempel voor automatisch comprimeren instellen met /autocompact.
Hoeveel kost Claude Code per ontwikkelaar?
Anthropic zegt ongeveer $13 per ontwikkelaar per actieve dag en $150 tot $250 per maand over enterprise-implementaties, en onder de $30 per dag voor 90% van de gebruikers. Dat wordt gefactureerd tegen API-tarieven. Op een abonnement wordt de vraag welke abonnementslimiet je het eerst raakt. Onze pagina over de wekelijkse limiet van Claude Max rekent een Max 20x-week op ongeveer $1.86k aan API-equivalent gebruik.
Hoe volgen teams het gebruik van Claude Code?
- Team- en Enterprise-abonnementen: het uitgavenrapport in org-analytics, met een CSV per gebruiker. Enterprise heeft ook een analytics-API. Uitgavenlimieten stel je in via de beheerinstellingen.
- API (Claude Console): de gebruikspagina van de Console en uitgavenlimieten per workspace.
- Elke opzet: stel
CLAUDE_CODE_ENABLE_TELEMETRY=1in om per gebruiker tokens- en kostenmetrics via OpenTelemetry naar je eigen stack te exporteren. Zie documentatie over monitoring.
Als je contractuele tarieven betaalt, zorgt de instelling modelPricing ervoor dat de kostcijfers in /usage en OpenTelemetry aansluiten op je contract in plaats van op de listprijs.
Bronnen
- Claude Code-documentatie: kosten effectief beheren
- Claude Code-documentatie: statusregel
- Claude Code-documentatie: gebruik monitoren
- Artificial Analysis: modelbenchmarks en kosten per taak
Gerelateerd
- Hoeveel tokens Claude Pro en Max je geven
- Opus 5.5-effortniveaus zijn de echte prijs
- Claude Max 20x vs 5x: de wekelijkse limiet, gemeten
Wilt u dit toepassen op uw stack? Neem leveranciersfacturen, gatewaylogs en de belangrijkste workflows mee; we brengen kostenfactoren en besparingskansen in kaart. Plan een gratis audit →