Jak sprawdzić i ograniczyć zużycie tokenów w Claude Code
Zaktualizowano September 27, 2026 · pierwsza publikacja September 27, 2026
Uruchom /usage, żeby zobaczyć, co Claude Code wydaje, i /context, żeby zobaczyć, co zapełnia okno. Żeby wydawać mniej, trzymaj kontekst mały: czyść go między zadaniami, obniż poziom effort i trzymaj rozwlekłe wyjście poza główną rozmową. Kontekst liczy się bardziej niż cokolwiek innego, bo Claude Code wysyła całą rozmowę ponownie przy każdym żądaniu. W naszych własnych logach 96% tokenów to agent ponownie czytający swój kontekst.
Ta strona opisuje polecenia pokazujące zużycie, ustawienia, które najbardziej je zmieniają, i to, dokąd tokeny faktycznie idą. Wskazówki pochodzą z dokumentacji Anthropic o kosztach. Liczby pochodzą z naszych własnych logów Claude Code i opublikowanych benchmarków.
Jak sprawdzić zużycie tokenów w Claude Code?
/usage: pokazuje liczbę tokenów i szacunkowy koszt bieżącej sesji, wiersz pamięci podręcznej promptów oraz, w planach Pro, Max, Team i Enterprise, paski zużycia planu. Rozbija też, co zużywa plan: skills, subagenty, wtyczki, serwery MCP i zaplanowane pętle, z ostatnich 24 godzin lub 7 dni./context: pokazuje, co teraz zajmuje okno kontekstu, z podpowiedziami, co przyciąć./insights: zapisuje raport HTML o ostatnich sesjach i o tym, gdzie tracisz czas i tokeny.- Linia stanu: skrypt może pokazywać przy każdym prompcie koszt, użyty kontekst oraz procenty planu za 5 godzin i za 7 dni. Zobacz dokumentację linii stanu.
- claude.ai Settings > Usage: limity planu i wydatki z kredytów użycia, w tym użycie z innych urządzeń.
W planie Pro lub Max kwota w dolarach w /usage to tyle, ile sesja kosztowałaby po cenach katalogowych API, a nie to, co faktycznie płacisz. Nadal jest to najlepsza pojedyncza miara tego, jak ciężka jest sesja.
Dokąd naprawdę idą tokeny Claude Code?
Głównie w ponowne czytanie kontekstu. Każde żądanie niesie całą rozmowę, a każde wywołanie narzędzia wysyła kolejne żądanie z wynikami. W naszych logach Claude Code 7.0 miliarda tokenów odczytu z cache stanowiło 96% wszystkich tokenów i połowę rachunku równoważnego API wynoszącego $6,986. Tokeny wyjściowe, czyli ta część, którą widzisz, to mniej niż 1% objętości.
Dlatego pytanie w jednej linii w sesji otwartej od rana nie jest tanie. Niesie ze sobą cały dzień. Nasza strona o tokenach na plan ma pełne zestawienie: około 1.9 miliarda tokenów w tygodniu Max 20x i około 39 milionów w sesji Max 5x.
Jak zmniejszyć zużycie tokenów w Claude Code?
To zmiany, które najbardziej przesuwają zużycie, w przybliżonej kolejności wpływu.
- Czyść między niepowiązanymi zadaniami.
/clearzaczyna świeży kontekst i nic nie kosztuje. Najpierw użyj/rename, jeśli chcesz później wznowić starą sesję przez/resume. - Obniż poziom effort. W Opus 5.5 jedno zadanie kosztowało $5.98 przy maksymalnym effort i $1.34 przy średnim w przebiegach Artificial Analysis, czyli różnica 4.5x z jednego ustawienia. Zmień go poleceniem
/effort. Szczegóły na naszej stronie o koszcie poziomów effort. - Dopasuj model do zadania. Anthropic zaleca Sonnet do większości kodowania, a Opus do trudnej pracy architektonicznej lub wieloetapowej. Przełączaj przez
/modeli ustawmodel: haikuw prostych subagentach. - Nie rób długich przerw w środku sesji. Pamięć podręczna promptów trwa godzinę przy subskrypcji, a pięć minut przy kredytach użycia lub kluczu API. Powrót po jej wygaśnięciu przetwarza cały kontekst od nowa w pełnej cenie.
- Trzymaj hałaśliwe wyjście poza głównym kontekstem. Wysyłaj uruchomienia testów, czytanie logów i pobieranie dokumentacji do subagentów, tak aby wracało tylko podsumowanie. Hook może przefiltrować log o 10,000 wierszy do samych linii błędów, zanim Claude go zobaczy.
- Przytnij to, co ładuje się na starcie. Trzymaj CLAUDE.md poniżej około 200 wierszy, a instrukcje dotyczące konkretnego workflow przenoś do skills, które ładują się tylko wtedy, gdy są używane. Wyłącz serwery MCP, których nie używasz, poleceniem
/mcp. Tam, gdzie istnieje, preferuj narzędzia CLI, takie jakgh. - Pisz konkretne prompty i najpierw planuj. „Popraw ten codebase” sprawia, że Claude skanuje wszystko. Tryb planu (Shift+Tab) wyłapuje błędne podejście, zanim kosztuje pełną implementację.
- Pilnuj pracy w tle. Zaplanowane pętle, współpracownicy agentów i bezczynne subagenty ciągle wysyłają pełny kontekst. Zespoły agentów zużywają około 7x tokenów zwykłej sesji, gdy współpracownicy działają w trybie planu.
Czy /compact oszczędza tokeny?
Tylko przy późniejszych żądaniach, a kompaktowanie dużego kontekstu to samo w sobie duże żądanie. /compact czyta całą rozmowę, żeby ją streścić. Jeśli nie potrzebujesz historii, /clear jest tańszy. Jeśli potrzebujesz, /compact z instrukcjami (na przykład /compact keep the API changes and failing tests) zachowa to, co ważne. Możesz też ustawić wcześniejszy próg automatycznego kompaktowania poleceniem /autocompact.
Ile kosztuje Claude Code na jednego developera?
Anthropic podaje około $13 na developera za aktywny dzień i od $150 do $250 miesięcznie we wdrożeniach enterprise, a poniżej $30 dziennie dla 90% użytkowników. To jest rozliczane po stawkach API. Przy subskrypcji pytanie brzmi, który limit planu wyczerpujesz jako pierwszy. Nasza strona o tygodniowym limicie Claude Max wycenia tydzień Max 20x na około $1.86k zużycia równoważnego API.
Jak zespoły śledzą zużycie Claude Code?
- Plany Team i Enterprise: raport wydatków w analityce organizacji, z CSV na użytkownika. Enterprise ma też API analityki. Limity wydatków ustawia się w ustawieniach administratora.
- API (Claude Console): strona użycia w Console i limity wydatków dla workspace.
- Każda konfiguracja: ustaw
CLAUDE_CODE_ENABLE_TELEMETRY=1, aby eksportować metryki tokenów i kosztów per użytkownik przez OpenTelemetry do własnego stacku. Zobacz dokumentację monitoringu.
Jeśli płacisz stawki kontraktowe, zarządzane ustawienie modelPricing sprawia, że wartości kosztów w /usage i w OpenTelemetry odpowiadają kontraktowi, a nie cenie katalogowej.
Źródła
- Claude Code docs: Manage costs effectively
- Claude Code docs: Status line
- Claude Code docs: Monitoring usage
- Artificial Analysis: model benchmarks and cost per task
Powiązane
- Ile tokenów dają Claude Pro i Max
- Poziomy effort w Opus 5.5 to realna cena
- Claude Max 20x vs 5x: tygodniowy limit, zmierzony
Chcesz zastosować to w swoim stosie? Przynieś faktury dostawców, logi bramy i najważniejsze przepływy pracy; wskażemy czynniki kosztów i ścieżkę oszczędności. Umów bezpłatny audyt →