Come verificare e ridurre il consumo di token di Claude Code
Aggiornato September 27, 2026 · pubblicato inizialmente September 27, 2026
Esegui /usage per vedere cosa sta spendendo Claude Code, e /context per vedere cosa riempie la finestra. Per spendere meno, tieni piccolo il contesto: svuotalo tra un task e l’altro, abbassa il livello di effort e tieni l’output verboso fuori dalla conversazione principale. Il contesto conta più di ogni altra cosa, perché Claude Code reinvia l’intera conversazione a ogni richiesta. Nei nostri log, il 96% dei token era l’agente che rilegge il proprio contesto.
Questa pagina copre i comandi che mostrano il tuo consumo, le impostazioni che lo spostano di più e dove finiscono davvero i token. I suggerimenti vengono dalla documentazione di Anthropic sui costi. I numeri vengono dai nostri log di Claude Code e da benchmark pubblicati.
Come verifico il consumo di token di Claude Code?
/usage: mostra i conteggi dei token e un costo stimato per la sessione corrente, una riga della cache dei prompt e, sui piani Pro, Max, Team ed Enterprise, le barre di utilizzo del piano. Scompone anche cosa consuma il piano: skill, subagenti, plugin, server MCP e loop pianificati, sulle ultime 24 ore o sugli ultimi 7 giorni./context: mostra cosa occupa la finestra di contesto in questo momento, con suggerimenti su cosa tagliare./insights: genera un report HTML sulle sessioni recenti e su dove perdi tempo e token.- La status line: uno script può mostrare costo, contesto usato e le tue percentuali del piano a 5 ore e a 7 giorni a ogni prompt. Vedi la documentazione della status line.
- claude.ai Settings > Usage: limiti del piano e spesa dei crediti di utilizzo, incluso l’uso da altri dispositivi.
Su un piano Pro o Max, la cifra in dollari in /usage è quanto la sessione sarebbe costata ai prezzi di listino dell’API, non quanto paghi. Resta comunque la misura singola migliore di quanto una sessione sia pesante.
Dove vanno davvero i token di Claude Code?
Soprattutto nella rilettura del contesto. Ogni richiesta porta con sé l’intera conversazione, e ogni chiamata a uno strumento invia un’altra richiesta con i risultati. Nei nostri log di Claude Code, 7,0 miliardi di token di cache-read sono stati il 96% di tutti i token e la metà di una fattura equivalente API da $6,986. I token di output, la parte che vedi, erano sotto l’1% del volume.
Ecco perché una domanda di una riga, in una sessione aperta da tutto il giorno, non è economica: si porta dietro l’intera giornata. La nostra pagina sui token per piano contiene la ripartizione completa: circa 1,9 miliardi di token in una settimana Max 20x e circa 39 milioni in una sessione Max 5x.
Come riduco il consumo di token di Claude Code?
Sono le modifiche che spostano di più il consumo, in ordine approssimativo di effetto.
- Svuota tra task non correlati.
/clearavvia un contesto nuovo e non costa nulla. Usa prima/renamese vuoi riprendere la vecchia sessione in seguito con/resume. - Abbassa il livello di effort. Su Opus 5.5, un task è costato $5.98 con effort massimo e $1.34 con effort medio nelle esecuzioni di Artificial Analysis: una differenza di 4,5x da una sola impostazione. Cambialo con
/effort. Dettagli nella nostra pagina sul costo dei livelli di effort. - Adatta il modello al lavoro. Anthropic consiglia Sonnet per la maggior parte del coding e Opus per il lavoro architetturale difficile o multi-step. Cambia con
/model, e impostamodel: haikusui subagenti semplici. - Non fare pause lunghe a metà sessione. La cache dei prompt dura un’ora con un abbonamento e cinque minuti con i crediti di utilizzo o con una chiave API. Se torni dopo la scadenza, l’intero contesto viene rielaborato a prezzo pieno.
- Tieni l’output rumoroso fuori dal contesto principale. Manda test, lettura di log e recupero di documentazione ai subagenti, così torna solo un riassunto. Un hook può filtrare un log da 10.000 righe fino alle righe di errore prima che Claude lo veda.
- Riduci ciò che si carica all’avvio. Tieni CLAUDE.md sotto circa 200 righe e sposta le istruzioni specifiche di workflow nelle skill, che si caricano solo quando servono. Disattiva con
/mcpi server MCP che non usi. Preferisci strumenti CLI comeghdove ne esiste uno. - Scrivi prompt specifici e pianifica prima. “Migliora questa codebase” fa scansionare tutto a Claude. La modalità plan (Shift+Tab) intercetta un approccio sbagliato prima che costi un’implementazione completa.
- Controlla il lavoro in background. Loop pianificati, teammate di agenti e subagenti inattivi continuano a inviare l’intero contesto. I team di agenti consumano circa 7x i token di una sessione normale quando i teammate lavorano in modalità plan.
/compact fa risparmiare token?
Solo sulle richieste successive, e comprimere un contesto grande è di per sé una richiesta grande. /compact legge l’intera conversazione per riassumerla. Se non ti serve la cronologia, /clear costa meno. Se ti serve, /compact con istruzioni (per esempio /compact keep the API changes and failing tests) conserva ciò che conta. Puoi anche impostare una soglia di auto-compact più bassa con /autocompact.
Quanto costa Claude Code per sviluppatore?
Anthropic indica circa $13 per sviluppatore al giorno attivo e da $150 a $250 al mese nei deployment enterprise, e meno di $30 al giorno per il 90% degli utenti. È fatturato a tariffe API. Con un abbonamento la domanda diventa quale limite del piano raggiungi per primo. La nostra pagina sul limite settimanale di Claude Max valuta una settimana Max 20x a circa $1.86k di utilizzo equivalente API.
Come tracciano l’uso di Claude Code i team?
- Piani Team ed Enterprise: il report di spesa nelle analytics dell’organizzazione, con un CSV per utente. Enterprise ha anche un’API di analytics. I limiti di spesa si impostano nelle impostazioni admin.
- API (Claude Console): la pagina di utilizzo della Console e i limiti di spesa per workspace.
- Qualsiasi configurazione: imposta
CLAUDE_CODE_ENABLE_TELEMETRY=1per esportare metriche di token e costo per utente via OpenTelemetry verso il tuo stack. Vedi la documentazione sul monitoraggio.
Se paghi tariffe contrattuali, l’impostazione gestita modelPricing fa sì che i valori di costo in /usage e in OpenTelemetry corrispondano al tuo contratto invece che al prezzo di listino.
Fonti
- Documentazione Claude Code: Gestire i costi in modo efficace
- Documentazione Claude Code: Status line
- Documentazione Claude Code: Monitoraggio dell’utilizzo
- Artificial Analysis: benchmark dei modelli e costo per task
Correlati
- Quanti token ti danno Claude Pro e Max
- I livelli di effort di Opus 5.5 sono il prezzo reale
- Claude Max 20x vs 5x: il limite settimanale, misurato
Vuoi applicarlo al tuo stack? Porta le fatture dei provider, i log del gateway e i flussi di lavoro principali: mapperemo i costi e i possibili risparmi. Prenota un audit gratuito →