Ga naar inhoud

Claude Code-tokengebruik controleren en verlagen

Bijgewerkt September 27, 2026 · eerst gepubliceerd September 27, 2026

Kort antwoord: Voer /usage uit om te zien wat Claude Code uitgeeft, en /context om te zien wat het venster vult. Om minder uit te geven, houd je de context klein: maak tussen taken door leeg, verlaag het...

Voer /usage uit om te zien wat Claude Code uitgeeft, en /context om te zien wat het venster vult. Om minder uit te geven, houd je de context klein: maak tussen taken door leeg, verlaag het effortniveau en houd uitgebreide uitvoer uit het hoofdgesprek. Context weegt zwaarder dan al het andere, omdat Claude Code het hele gesprek bij elk verzoek opnieuw verstuurt. In onze eigen logs waren 96% van de tokens het opnieuw lezen van context door de agent.

Deze pagina behandelt de commando's die je gebruik tonen, de instellingen die het het meest verschuiven, en waar de tokens echt naartoe gaan. De tips komen uit de kostendocumentatie van Anthropic. De cijfers komen uit onze eigen Claude Code-logs en gepubliceerde benchmarks.

Hoe controleer ik het tokengebruik van Claude Code?

Bij een Pro- of Max-abonnement is het dollarbedrag in /usage wat de sessie zou hebben gekost tegen API-listprijzen, niet wat je betaalt. Het blijft de beste enkele maatstaf voor hoe zwaar een sessie is.

Waar gaan de tokens van Claude Code echt naartoe?

Vooral naar het opnieuw lezen van context. Elk verzoek draagt het volledige gesprek mee, en elke toolaanroep stuurt nog een verzoek met de resultaten. Over onze Claude Code-logs waren 7.0 miljard cache-lees-tokens 96% van alle tokens en de helft van een API-rekening van $6,986. Uitvoertokens, het deel dat je ziet, waren onder de 1% van het volume.

Daarom is een vraag van één regel in een sessie die de hele dag open staat niet goedkoop. Die draagt de hele dag mee. Onze pagina over tokens per abonnement heeft de volledige uitsplitsing: ongeveer 1.9 miljard tokens in een Max 20x-week en ongeveer 39 miljoen in een Max 5x-sessie.

Hoe verlaag ik het tokengebruik van Claude Code?

Dit zijn de wijzigingen die het gebruik het meest verschuiven, in grove volgorde van effect.

  1. Maak tussen niet-verwante taken leeg. /clear start een nieuwe context en kost niets. Gebruik eerst /rename als je de oude sessie later wilt openen met /resume.
  2. Verlaag het effortniveau. Op Opus 5.5 kostte één taak in Artificial Analysis-runs $5.98 op maximale effort en $1.34 op medium, een verschil van 4.5x door één instelling. Gebruik /effort om het te wijzigen. Details op onze pagina over kosten per effortniveau.
  3. Kies het model dat bij de taak past. Anthropic raadt Sonnet aan voor het meeste coderen en Opus voor zware architectuur- of meerstapswerk. Wissel met /model, en zet model: haiku op eenvoudige subagents.
  4. Neem geen lange pauzes midden in een sessie. De prompt-cache duurt een uur bij een abonnement en vijf minuten bij gebruikscredits of een API-sleutel. Terugkomen nadat hij is verlopen verwerkt je hele context opnieuw tegen volle prijs.
  5. Houd luidruchtige uitvoer uit de hoofdcontext. Stuur testruns, het lezen van logs en het ophalen van documentatie naar subagents, zodat alleen een samenvatting terugkomt. Een hook kan een log van 10,000 regels terugbrengen tot de foutregels voordat Claude het ziet.
  6. Snoei wat bij de start laadt. Houd CLAUDE.md onder ongeveer 200 regels en verplaats workflowspecifieke instructies naar skills, die alleen laden als ze gebruikt worden. Zet MCP-servers die je niet gebruikt uit met /mcp. Gebruik CLI-tools zoals gh waar er één bestaat.
  7. Schrijf specifieke prompts en plan eerst. “Verbeter deze codebase” laat Claude alles scannen. Plan-modus (Shift+Tab) vangt een verkeerde aanpak op voordat die een volledige implementatie kost.
  8. Let op achtergrondwerk. Geplande loops, agent-teamgenoten en inactieve subagents blijven je volledige context sturen. Agent-teams gebruiken ongeveer 7x de tokens van een normale sessie wanneer teamgenoten in plan-modus draaien.

Bespaart /compact tokens?

Alleen bij latere verzoeken, en het comprimeren van een grote context is zelf een groot verzoek. /compact leest het hele gesprek om het samen te vatten. Als je de geschiedenis niet nodig hebt, is /clear goedkoper. Als je die wel nodig hebt, bewaart /compact met instructies (bijvoorbeeld /compact bewaar de API-wijzigingen en de falende tests) wat ertoe doet. Je kunt ook een eerdere drempel voor automatisch comprimeren instellen met /autocompact.

Hoeveel kost Claude Code per ontwikkelaar?

Anthropic zegt ongeveer $13 per ontwikkelaar per actieve dag en $150 tot $250 per maand over enterprise-implementaties, en onder de $30 per dag voor 90% van de gebruikers. Dat wordt gefactureerd tegen API-tarieven. Op een abonnement wordt de vraag welke abonnementslimiet je het eerst raakt. Onze pagina over de wekelijkse limiet van Claude Max rekent een Max 20x-week op ongeveer $1.86k aan API-equivalent gebruik.

Hoe volgen teams het gebruik van Claude Code?

Als je contractuele tarieven betaalt, zorgt de instelling modelPricing ervoor dat de kostcijfers in /usage en OpenTelemetry aansluiten op je contract in plaats van op de listprijs.

Bronnen

Gerelateerd


Wilt u dit toepassen op uw stack? Neem leveranciersfacturen, gatewaylogs en de belangrijkste workflows mee; we brengen kostenfactoren en besparingskansen in kaart. Plan een gratis audit →

Terug naar finopsllm.com