98% входных токенов Codex были в кэше. Без кэша счёт был бы в 12 раз больше
Обновлено October 9, 2026 · впервые опубликовано October 9, 2026
За 12 дней интенсивного использования Codex на тарифе ChatGPT Pro $100 мы отправили 13.0 миллиарда входных токенов и получили 47 миллионов выходных. 97.6% входа было попаданием в кэш. По ценам API OpenAI эта работа стоит $1,211. Если посчитать те же токены без единого попадания в кэш, выйдет $14,198, в 12 раз больше.
- Соотношение входа к выходу: около 279 входных токенов на каждый выходной.
- Доля кэшированного входа в счёте: 60%, даже при скидке 95%.
- Доля выхода в счёте: 16%.
Почему почти весь вход у агентов для кода кэшированный
Цикл агента на каждом шаге заново отправляет всю беседу: системный промпт, определения инструментов, прочитанные файлы и каждый предыдущий результат инструмента. Каждый шаг добавляет немного и перечитывает всё. Поэтому вход растёт пропорционально квадрату длины сессии, а выход остаётся небольшим. За 12 дней это дало соотношение входа к выходу 279:1.
Кэширование промптов делает такой объём доступным. Кэшированный вход в API OpenAI стоит в десять раз дешевле обычного или ещё дешевле. GPT-6 Sol, на котором шла большая часть работы, берёт $2 за миллион входных токенов и $0.10 за миллион кэшированных.
Куда ушли деньги
| Модель | Входные токены | В кэше | Выходные токены | Стоимость по API | Без кэша |
|---|---|---|---|---|---|
| Sol | 6.56B | 98.1% | 17.5M | $1,073 | $13,299 |
| Luna | 6.41B | 97.2% | 29.0M | $95 | $655 |
| GPT-5.5 | 0.03B | 93.5% | 0.2M | $27 | $144 |
| Astra | 0.01B | 94.5% | 0.0M | $16 | $99 |
| Итого | 13.01B | 97.6% | 47M | $1,211 | $14,198 |
| Статья стоимости | Стоимость по API | Доля |
|---|---|---|
| Кэшированный вход | $728 | 60% |
| Некэшированный вход | $288 | 24% |
| Выход | $196 | 16% |
Даже при скидке 95% кэшированный вход остаётся самой крупной статьёй. Это признак нагрузки агента: самый дешёвый тип токенов в огромном объёме. Итоги по моделям приведены в codex-pro-100-model-mix.csv.
Что ломает кэш
Попадание в кэш требует идентичного префикса. Любое изменение в начале контекста заставляет заново перечитать по полной цене всё, что идёт после него.
- Смена модели в середине сессии. У новой модели нет кэша для вашего контекста.
- Правка инструкций или списков инструментов в середине сессии. Они стоят в начале промпта, поэтому всё ниже перечитывается.
- Долгие паузы. Кэш истекает. Возврат после перерыва перечитывает сессию по полной цене.
- Компактация. Сжатие истории переписывает префикс. Это экономит токены позже, но сейчас стоит одного прохода без кэша.
Почему это важно для лимитов Codex
Если счётчик Codex учитывает кэшированный вход близко к его цене в API, падение доли попаданий в кэш на 1 пункт обходится дорого. При нашем объёме переход Sol с 98.1% до 90% в кэше добавил бы около $1,004 только за вход Sol, примерно 6 лишних окон Pro $100. Дисциплина кэша — это дисциплина квоты. Что помещается в одно окно, см. в нашем замере множителя Pro $100; как мы получили восемь окон за 12 дней, см. в журнале сбросов.
Как мы измеряли
Codex пишет JSONL-журнал каждой сессии в ~/.codex/sessions/. Каждый запрос фиксирует накопленный вход, кэшированный вход и выход, а также недельный счётчик (used_percent) и время его сброса resets_at. Мы оценили дельту токенов каждого запроса по прайс-листу API модели, на которой он выполнялся, и сгруппировали запросы по недельному окну. Суммы в долларах — это эквивалентная стоимость по API, а не деньги, которые мы реально заплатили.
Источники
По теме
- ChatGPT Pro $100 на деле равен 2.6x Plus
- 8 недельных окон Codex за 12 дней
- Сбросы Codex превратили $40 в $1,211
- Что входит в Codex по ChatGPT Pro
- Claude Max 20x против ChatGPT Pro
Хотите применить это к своему стеку? Принесите счета провайдеров, логи шлюза и ключевые рабочие процессы — мы определим драйверы затрат и пути экономии. Заказать бесплатный аудит →