Перейти к содержанию

98% входных токенов Codex были в кэше. Без кэша счёт был бы в 12 раз больше

Обновлено October 9, 2026 · впервые опубликовано October 9, 2026

Краткий ответ: За 12 дней интенсивного использования Codex на тарифе ChatGPT Pro $100 мы отправили 13.0 миллиарда входных токенов и получили 47 миллионов выходных. 97.6% входа было попаданием в кэш. По ценам API...

За 12 дней интенсивного использования Codex на тарифе ChatGPT Pro $100 мы отправили 13.0 миллиарда входных токенов и получили 47 миллионов выходных. 97.6% входа было попаданием в кэш. По ценам API OpenAI эта работа стоит $1,211. Если посчитать те же токены без единого попадания в кэш, выйдет $14,198, в 12 раз больше.

Стоимость 12 дней Codex по API в разбивке по моделям: с кэшем и без кэша$0$2k$4k$6k$8k$10k$12k$14k$1,073$13,299Sol$95$655Luna$27$144GPT-5.5$16$99AstraОранжевый: что мы заплатили в ценах API, с кэшемСиний: те же токены без попаданий в кэш
Стоимость 12 дней Codex по API в разбивке по моделям: с кэшем и без кэша

Почему почти весь вход у агентов для кода кэшированный

Цикл агента на каждом шаге заново отправляет всю беседу: системный промпт, определения инструментов, прочитанные файлы и каждый предыдущий результат инструмента. Каждый шаг добавляет немного и перечитывает всё. Поэтому вход растёт пропорционально квадрату длины сессии, а выход остаётся небольшим. За 12 дней это дало соотношение входа к выходу 279:1.

Кэширование промптов делает такой объём доступным. Кэшированный вход в API OpenAI стоит в десять раз дешевле обычного или ещё дешевле. GPT-6 Sol, на котором шла большая часть работы, берёт $2 за миллион входных токенов и $0.10 за миллион кэшированных.

Куда ушли деньги

МодельВходные токеныВ кэшеВыходные токеныСтоимость по APIБез кэша
Sol6.56B98.1%17.5M$1,073$13,299
Luna6.41B97.2%29.0M$95$655
GPT-5.50.03B93.5%0.2M$27$144
Astra0.01B94.5%0.0M$16$99
Итого13.01B97.6%47M$1,211$14,198
Статья стоимостиСтоимость по APIДоля
Кэшированный вход$72860%
Некэшированный вход$28824%
Выход$19616%

Даже при скидке 95% кэшированный вход остаётся самой крупной статьёй. Это признак нагрузки агента: самый дешёвый тип токенов в огромном объёме. Итоги по моделям приведены в codex-pro-100-model-mix.csv.

Что ломает кэш

Попадание в кэш требует идентичного префикса. Любое изменение в начале контекста заставляет заново перечитать по полной цене всё, что идёт после него.

Почему это важно для лимитов Codex

Если счётчик Codex учитывает кэшированный вход близко к его цене в API, падение доли попаданий в кэш на 1 пункт обходится дорого. При нашем объёме переход Sol с 98.1% до 90% в кэше добавил бы около $1,004 только за вход Sol, примерно 6 лишних окон Pro $100. Дисциплина кэша — это дисциплина квоты. Что помещается в одно окно, см. в нашем замере множителя Pro $100; как мы получили восемь окон за 12 дней, см. в журнале сбросов.

Как мы измеряли

Codex пишет JSONL-журнал каждой сессии в ~/.codex/sessions/. Каждый запрос фиксирует накопленный вход, кэшированный вход и выход, а также недельный счётчик (used_percent) и время его сброса resets_at. Мы оценили дельту токенов каждого запроса по прайс-листу API модели, на которой он выполнялся, и сгруппировали запросы по недельному окну. Суммы в долларах — это эквивалентная стоимость по API, а не деньги, которые мы реально заплатили.

Источники

По теме


Хотите применить это к своему стеку? Принесите счета провайдеров, логи шлюза и ключевые рабочие процессы — мы определим драйверы затрат и пути экономии. Заказать бесплатный аудит →

Вернуться на finopsllm.com