Перейти к содержанию

Как проверить и снизить расход токенов Claude Code

Обновлено September 27, 2026 · впервые опубликовано September 27, 2026

Краткий ответ: Выполните /usage, чтобы увидеть, на что тратит Claude Code, и /context, чтобы увидеть, что заполняет окно. Чтобы тратить меньше, держите контекст небольшим: очищайте его между задачами, снижайте...

Выполните /usage, чтобы увидеть, на что тратит Claude Code, и /context, чтобы увидеть, что заполняет окно. Чтобы тратить меньше, держите контекст небольшим: очищайте его между задачами, снижайте уровень effort и не выводите многословный вывод в основную беседу. Контекст важнее всего остального, потому что Claude Code отправляет всю беседу заново с каждым запросом. В наших собственных логах 96% токенов приходилось на то, что агент перечитывал свой контекст.

Эта страница описывает команды, которые показывают использование, настройки, которые его меняют сильнее всего, и то, куда на самом деле уходят токены. Советы взяты из документации Anthropic по стоимости. Цифры получены из наших собственных логов Claude Code и опубликованных бенчмарков.

Как проверить расход токенов Claude Code?

На тарифе Pro или Max сумма в долларах в /usage — это то, во что обошлась бы сессия по прайсу API, а не то, что вы платите. Тем не менее это лучшая единая мера того, насколько тяжёлая сессия.

Куда на самом деле уходят токены Claude Code?

В основном в повторное чтение контекста. Каждый запрос несёт всю беседу целиком, а каждый вызов инструмента отправляет ещё один запрос с результатами. По нашим логам Claude Code 7.0 миллиарда токенов чтения из кэша составили 96% всех токенов и половину счёта на $6,986 в эквиваленте API. Выходные токены, то есть та часть, которую вы видите, составили меньше 1% объёма.

Поэтому однострочный вопрос в сессии, открытой весь день, не дёшев. Он несёт с собой весь день. На нашей странице о токенах по тарифам есть полная разбивка: около 1.9 миллиарда токенов за неделю на Max 20x и около 39 миллионов за сессию на Max 5x.

Как снизить расход токенов Claude Code?

Ниже перечислены изменения, которые сильнее всего меняют расход, примерно в порядке эффекта.

  1. Очищайте контекст между несвязанными задачами. /clear начинает новый контекст и ничего не стоит. Используйте /rename заранее, если потом хотите вернуться к старой сессии через /resume.
  2. Снизьте уровень effort. На Opus 5.5 одна задача стоила $5.98 при максимальном effort и $1.34 при среднем в прогонах Artificial Analysis, то есть разница в 4.5 раза из-за одной настройки. Меняйте её через /effort. Подробнее на нашей странице о стоимости уровней effort.
  3. Подбирайте модель под задачу. Anthropic рекомендует Sonnet для большинства задач по коду и Opus для сложной архитектуры или многошаговой работы. Переключайтесь через /model и ставьте model: haiku для простых субагентов.
  4. Не делайте долгих перерывов посреди сессии. Кэш промптов живёт час на подписке и пять минут на кредитах использования или API-ключе. Возвращение после его истечения заново обрабатывает весь контекст по полной цене.
  5. Держите шумный вывод вне основного контекста. Отправляйте прогоны тестов, чтение логов и загрузку документации субагентам, чтобы обратно возвращалось только резюме. Хук может отфильтровать лог на 10,000 строк до строк с ошибками, прежде чем Claude их увидит.
  6. Сократите то, что загружается при старте. Держите CLAUDE.md примерно в пределах 200 строк и переносите инструкции для конкретных процессов в навыки, которые загружаются только при использовании. Отключайте неиспользуемые серверы MCP через /mcp. Предпочитайте CLI-инструменты вроде gh, где они есть.
  7. Пишите конкретные промпты и сначала планируйте. «Улучши этот кодовый базис» заставляет Claude просканировать всё. Режим планирования (Shift+Tab) ловит неверный подход до того, как он обойдётся в полную реализацию.
  8. Следите за фоновой работой. Запланированные циклы, агенты-напарники и простаивающие субагенты продолжают отправлять весь ваш контекст. Команды агентов расходуют примерно в 7 раз больше токенов, чем обычная сессия, когда напарники работают в режиме планирования.

Экономит ли /compact токены?

Только в последующих запросах, а сжатие большого контекста само по себе большой запрос. /compact читает всю беседу, чтобы её резюмировать. Если история вам не нужна, /clear дешевле. Если нужна, /compact с инструкциями (например, /compact keep the API changes and failing tests) сохранит то, что важно. Также можно задать более ранний порог автосжатия через /autocompact.

Сколько стоит Claude Code на одного разработчика?

Anthropic сообщает примерно $13 на разработчика в активный день и $150–250 в месяц по корпоративным внедрениям, а для 90% пользователей — меньше $30 в день. Это считается по ставкам API. На подписке вопрос в том, какие лимиты плана вы исчерпаете первыми. На нашей странице о недельном лимите Claude Max неделя на Max 20x оценена примерно в $1.86 тыс. использования по эквиваленту API.

Как команды отслеживают использование Claude Code?

Если вы платите по согласованным ставкам, управляемая настройка modelPricing делает цифры стоимости в /usage и OpenTelemetry соответствующими вашему контракту, а не прайсу.

Источники

По теме


Хотите применить это к своему стеку? Принесите счета провайдеров, логи шлюза и ключевые рабочие процессы — мы определим драйверы затрат и пути экономии. Заказать бесплатный аудит →

Вернуться на finopsllm.com