Vérifier et réduire l'usage de tokens de Claude Code
Mis à jour September 27, 2026 · première publication September 27, 2026
Lancez /usage pour voir ce que dépense Claude Code, et /context pour voir ce qui remplit la fenêtre. Pour dépenser moins, gardez le contexte réduit : videz-le entre les tâches, baissez le niveau d'effort et gardez les sorties volumineuses hors de la conversation principale. Le contexte compte plus que tout le reste parce que Claude Code renvoie toute la conversation à chaque requête. Dans nos propres journaux, 96 % des tokens correspondaient à l'agent qui relisait son contexte.
Cette page présente les commandes qui affichent votre usage, les réglages qui le font le plus bouger et la destination réelle des tokens. Les conseils viennent de la documentation d'Anthropic sur les coûts. Les chiffres viennent de nos propres journaux Claude Code et de benchmarks publiés.
Comment vérifier l'usage de tokens de Claude Code ?
/usage: affiche le nombre de tokens et un coût estimé pour la session en cours, une ligne sur le cache de prompts et, sur les forfaits Pro, Max, Team et Enterprise, vos barres d'utilisation du forfait. Il détaille aussi ce qui consomme votre forfait : skills, sous-agents, plugins, serveurs MCP et boucles planifiées, sur les 24 dernières heures ou les 7 derniers jours./context: montre ce qui occupe la fenêtre de contexte à l'instant, avec des pistes sur ce qu'il faut élaguer./insights: produit un rapport HTML sur vos sessions récentes et sur l'endroit où vous perdez du temps et des tokens.- La ligne d'état : un script peut afficher le coût, le contexte utilisé et vos pourcentages de forfait sur 5 heures et 7 jours à chaque prompt. Voir la documentation de la ligne d'état.
- claude.ai Settings > Usage : limites du forfait et dépenses de crédits d'utilisation, y compris l'usage depuis d'autres appareils.
Sur un forfait Pro ou Max, le montant en dollars affiché par /usage est ce que la session aurait coûté aux tarifs catalogue de l'API, pas ce que vous payez. C'est tout de même la meilleure mesure unique du poids d'une session.
Où vont réellement les tokens de Claude Code ?
Surtout à relire le contexte. Chaque requête transporte toute la conversation, et chaque appel d'outil envoie une nouvelle requête avec les résultats. Dans nos journaux Claude Code, 7,0 milliards de tokens de lecture du cache représentaient 96 % de tous les tokens et la moitié d'une facture équivalente API de $6,986. Les tokens de sortie, la partie visible, représentaient moins de 1 % du volume.
C'est pourquoi une question d'une ligne dans une session ouverte toute la journée n'est pas bon marché : elle emporte toute la journée avec elle. Notre page sur les tokens par forfait donne le détail complet : environ 1,9 milliard de tokens sur une semaine Max 20x et environ 39 millions sur une session Max 5x.
Comment réduire l'usage de tokens de Claude Code ?
Voici les changements qui font le plus bouger l'usage, à peu près par ordre d'effet.
- Videz le contexte entre tâches sans rapport.
/cleardémarre un contexte neuf et ne coûte rien. Utilisez d'abord/renamesi vous voulez/resumel'ancienne session plus tard. - Baissez le niveau d'effort. Sur Opus 5.5, une tâche a coûté 5,98 $ à l'effort maximal et 1,34 $ à l'effort moyen dans les exécutions d'Artificial Analysis, soit 4,5x d'écart avec un seul réglage. Utilisez
/effortpour le changer. Détails sur notre page du coût par niveau d'effort. - Adaptez le modèle à la tâche. Anthropic recommande Sonnet pour la plupart du code et Opus pour le travail d'architecture difficile ou en plusieurs étapes. Changez avec
/modelet définissezmodel: haikusur les sous-agents simples. - Évitez les longues pauses en pleine session. Le cache de prompts dure une heure sur un abonnement et cinq minutes avec des crédits d'utilisation ou une clé d'API. Revenir après son expiration retraite tout votre contexte au tarif plein.
- Gardez les sorties bruyantes hors du contexte principal. Envoyez les exécutions de tests, la lecture de logs et la récupération de docs à des sous-agents pour qu'il ne revienne qu'un résumé. Un hook peut réduire un log de 10,000 lignes aux seules lignes d'erreur avant que Claude le voie.
- Allégez ce qui se charge au démarrage. Gardez CLAUDE.md sous environ 200 lignes et déplacez les instructions propres à un workflow dans des skills, qui ne se chargent qu'à l'usage. Désactivez les serveurs MCP inutilisés avec
/mcp. Préférez les outils CLI commeghquand il en existe un. - Rédigez des prompts précis et planifiez d'abord. « Améliore ce codebase » pousse Claude à tout scanner. Le mode plan (Shift+Tab) repère une mauvaise approche avant qu'elle ne coûte une implémentation complète.
- Surveillez le travail en arrière-plan. Les boucles planifiées, les coéquipiers d'agents et les sous-agents inactifs continuent d'envoyer tout votre contexte. Les équipes d'agents utilisent environ 7x les tokens d'une session normale quand les coéquipiers tournent en mode plan.
/compact économise-t-il des tokens ?
Seulement sur les requêtes suivantes, et compacter un gros contexte est en soi une grosse requête. /compact lit toute la conversation pour la résumer. Si vous n'avez pas besoin de l'historique, /clear coûte moins cher. Si vous en avez besoin, /compact avec des instructions (par exemple /compact keep the API changes and failing tests) conserve l'essentiel. Vous pouvez aussi fixer un seuil d'auto-compactage plus précoce avec /autocompact.
Combien coûte Claude Code par développeur ?
Anthropic indique environ 13 $ par développeur et par jour actif, et de 150 à 250 $ par mois sur les déploiements en entreprise, et moins de 30 $ par jour pour 90 % des utilisateurs. Cela est facturé aux tarifs de l'API. Avec un abonnement, la question devient : les limites de quel forfait atteignez-vous en premier ? Notre page sur la limite hebdomadaire de Claude Max évalue une semaine Max 20x à environ 1,86 k$ d'usage équivalent API.
Comment les équipes suivent-elles l'usage de Claude Code ?
- Forfaits Team et Enterprise : le rapport de dépenses dans l'analytique de l'organisation, avec un CSV par utilisateur. Enterprise dispose aussi d'une API d'analytique. Les plafonds de dépenses se définissent dans les paramètres d'administration.
- API (Claude Console) : la page d'usage de la Console et les plafonds de dépenses par workspace.
- Toute configuration : définissez
CLAUDE_CODE_ENABLE_TELEMETRY=1pour exporter des métriques de tokens et de coût par utilisateur via OpenTelemetry vers votre propre stack. Voir la documentation de supervision.
Si vous payez des tarifs contractuels, le paramètre géré modelPricing aligne les coûts affichés dans /usage et OpenTelemetry sur votre contrat plutôt que sur le tarif catalogue.
Sources
- Claude Code docs: Manage costs effectively
- Claude Code docs: Status line
- Claude Code docs: Monitoring usage
- Artificial Analysis: model benchmarks and cost per task
À lire aussi
- Combien de tokens offrent Claude Pro et Max
- Les niveaux d'effort d'Opus 5.5 sont le vrai prix
- Claude Max 20x vs 5x : la limite hebdomadaire, mesurée
Vous souhaitez appliquer cela à votre plateforme ? Transmettez vos factures fournisseurs, journaux de passerelle et principaux workflows ; nous cartographierons les coûts et les économies possibles. Demander un audit gratuit →