Przejdź do treści

Jak sprawdzić i ograniczyć zużycie tokenów w Claude Code

Zaktualizowano September 27, 2026 · pierwsza publikacja September 27, 2026

Krótka odpowiedź: Uruchom /usage, żeby zobaczyć, co Claude Code wydaje, i /context, żeby zobaczyć, co zapełnia okno. Żeby wydawać mniej, trzymaj kontekst mały: czyść go między zadaniami, obniż poziom effort i trzymaj...

Uruchom /usage, żeby zobaczyć, co Claude Code wydaje, i /context, żeby zobaczyć, co zapełnia okno. Żeby wydawać mniej, trzymaj kontekst mały: czyść go między zadaniami, obniż poziom effort i trzymaj rozwlekłe wyjście poza główną rozmową. Kontekst liczy się bardziej niż cokolwiek innego, bo Claude Code wysyła całą rozmowę ponownie przy każdym żądaniu. W naszych własnych logach 96% tokenów to agent ponownie czytający swój kontekst.

Ta strona opisuje polecenia pokazujące zużycie, ustawienia, które najbardziej je zmieniają, i to, dokąd tokeny faktycznie idą. Wskazówki pochodzą z dokumentacji Anthropic o kosztach. Liczby pochodzą z naszych własnych logów Claude Code i opublikowanych benchmarków.

Jak sprawdzić zużycie tokenów w Claude Code?

W planie Pro lub Max kwota w dolarach w /usage to tyle, ile sesja kosztowałaby po cenach katalogowych API, a nie to, co faktycznie płacisz. Nadal jest to najlepsza pojedyncza miara tego, jak ciężka jest sesja.

Dokąd naprawdę idą tokeny Claude Code?

Głównie w ponowne czytanie kontekstu. Każde żądanie niesie całą rozmowę, a każde wywołanie narzędzia wysyła kolejne żądanie z wynikami. W naszych logach Claude Code 7.0 miliarda tokenów odczytu z cache stanowiło 96% wszystkich tokenów i połowę rachunku równoważnego API wynoszącego $6,986. Tokeny wyjściowe, czyli ta część, którą widzisz, to mniej niż 1% objętości.

Dlatego pytanie w jednej linii w sesji otwartej od rana nie jest tanie. Niesie ze sobą cały dzień. Nasza strona o tokenach na plan ma pełne zestawienie: około 1.9 miliarda tokenów w tygodniu Max 20x i około 39 milionów w sesji Max 5x.

Jak zmniejszyć zużycie tokenów w Claude Code?

To zmiany, które najbardziej przesuwają zużycie, w przybliżonej kolejności wpływu.

  1. Czyść między niepowiązanymi zadaniami. /clear zaczyna świeży kontekst i nic nie kosztuje. Najpierw użyj /rename, jeśli chcesz później wznowić starą sesję przez /resume.
  2. Obniż poziom effort. W Opus 5.5 jedno zadanie kosztowało $5.98 przy maksymalnym effort i $1.34 przy średnim w przebiegach Artificial Analysis, czyli różnica 4.5x z jednego ustawienia. Zmień go poleceniem /effort. Szczegóły na naszej stronie o koszcie poziomów effort.
  3. Dopasuj model do zadania. Anthropic zaleca Sonnet do większości kodowania, a Opus do trudnej pracy architektonicznej lub wieloetapowej. Przełączaj przez /model i ustaw model: haiku w prostych subagentach.
  4. Nie rób długich przerw w środku sesji. Pamięć podręczna promptów trwa godzinę przy subskrypcji, a pięć minut przy kredytach użycia lub kluczu API. Powrót po jej wygaśnięciu przetwarza cały kontekst od nowa w pełnej cenie.
  5. Trzymaj hałaśliwe wyjście poza głównym kontekstem. Wysyłaj uruchomienia testów, czytanie logów i pobieranie dokumentacji do subagentów, tak aby wracało tylko podsumowanie. Hook może przefiltrować log o 10,000 wierszy do samych linii błędów, zanim Claude go zobaczy.
  6. Przytnij to, co ładuje się na starcie. Trzymaj CLAUDE.md poniżej około 200 wierszy, a instrukcje dotyczące konkretnego workflow przenoś do skills, które ładują się tylko wtedy, gdy są używane. Wyłącz serwery MCP, których nie używasz, poleceniem /mcp. Tam, gdzie istnieje, preferuj narzędzia CLI, takie jak gh.
  7. Pisz konkretne prompty i najpierw planuj. „Popraw ten codebase” sprawia, że Claude skanuje wszystko. Tryb planu (Shift+Tab) wyłapuje błędne podejście, zanim kosztuje pełną implementację.
  8. Pilnuj pracy w tle. Zaplanowane pętle, współpracownicy agentów i bezczynne subagenty ciągle wysyłają pełny kontekst. Zespoły agentów zużywają około 7x tokenów zwykłej sesji, gdy współpracownicy działają w trybie planu.

Czy /compact oszczędza tokeny?

Tylko przy późniejszych żądaniach, a kompaktowanie dużego kontekstu to samo w sobie duże żądanie. /compact czyta całą rozmowę, żeby ją streścić. Jeśli nie potrzebujesz historii, /clear jest tańszy. Jeśli potrzebujesz, /compact z instrukcjami (na przykład /compact keep the API changes and failing tests) zachowa to, co ważne. Możesz też ustawić wcześniejszy próg automatycznego kompaktowania poleceniem /autocompact.

Ile kosztuje Claude Code na jednego developera?

Anthropic podaje około $13 na developera za aktywny dzień i od $150 do $250 miesięcznie we wdrożeniach enterprise, a poniżej $30 dziennie dla 90% użytkowników. To jest rozliczane po stawkach API. Przy subskrypcji pytanie brzmi, który limit planu wyczerpujesz jako pierwszy. Nasza strona o tygodniowym limicie Claude Max wycenia tydzień Max 20x na około $1.86k zużycia równoważnego API.

Jak zespoły śledzą zużycie Claude Code?

Jeśli płacisz stawki kontraktowe, zarządzane ustawienie modelPricing sprawia, że wartości kosztów w /usage i w OpenTelemetry odpowiadają kontraktowi, a nie cenie katalogowej.

Źródła

Powiązane


Chcesz zastosować to w swoim stosie? Przynieś faktury dostawców, logi bramy i najważniejsze przepływy pracy; wskażemy czynniki kosztów i ścieżkę oszczędności. Umów bezpłatny audyt →

Wróć do finopsllm.com