Модель стоимости постоянно работающего агента OpenAI O / AON
Обновлено September 27, 2026 · впервые опубликовано September 27, 2026
Утёкшие ссылки раскрывают «O» от OpenAI (кодовое имя AON) — постоянно работающего ассистента для задач с длинным горизонтом. В отличие от чат-моделей, которые отвечают и останавливаются, O получает собственную облачную среду, может создавать контексты выполнения, писать код, проводить исследования и работать непрерывно в течение часов, дней или, возможно, недель. Он может включать несколько агентов, которые общаются по одной задаче. Ожидаемое раскрытие: OpenAI Dev Day, 29 сентября 2026 года.
Что меняется для моделирования стоимости
Традиционная стоимость LLM: токены на запрос × тариф. Стоимость O/AON: время × выделенные вычисления + пропускная способность токенов.
| Измерение | API chat/completions | O / AON (прогноз) |
|---|---|---|
| Единица тарификации | За 1M токенов | За час (вычисления) + за 1M токенов |
| Стоимость простоя | $0 | >$0 (резерв среды) |
| Максимальная длительность | Минуты (таймаут) | Дни/недели |
| Параллелизм | Последовательные запросы | Рои из нескольких агентов |
| Состояние | Передаётся в контексте | Постоянная среда |
Прогнозная модель стоимости (умозрительная, по паттернам утечек)
OpenAI не опубликовала цены. Две вероятные структуры:
Вариант A: час вычислений + токены (как Codespaces)
- Резерв среды: ~$0.50–2.00/час (CPU + память + хранилище)
- Пропускная способность токенов: сверху стандартные тарифы GPT-5
- Сверхбыстрый уровень: множитель токенов 5–10x при включении
Запуск агента на 24 часа с 5M входных и 2M выходных токенов:
| Компонент | Стоимость (низкая) | Стоимость (высокая) |
|---|---|---|
| Среда 24 ч ($1/ч) | $24 | $48 |
| 5M входных по $5/MTok | $25 | $25 |
| 2M выходных по $15/MTok | $30 | $30 |
| Итого | $79 | $103 |
Вариант B: фиксированная подписка (пакет Pro Max)
- ChatGPT Pro Max за $500/мес. включает доступ к O/AON и квоту сверхбыстрого режима
- Эффективная стоимость в час: $500 / 720 ч = $0.69/ч (при работе 24/7)
- Точка безубыточности относительно варианта A: ~15 часов в день устойчивого использования
Стратегии оптимизации стоимости для постоянно работающих агентов
- Переводить в спячку, а не завершать. Если среда сохраняется, приостанавливайте цикл агента в периоды простоя вместо остановки: холодный старт обходится дороже резерва на простое.
- Группировать токены подзадач. Накапливайте результаты подзадач и записывайте контекст большими блоками, чтобы повысить долю попаданий в кэш в постоянной среде.
- Направлять подзадачи на более дешёвые модели. O/AON оркестрирует; кодирование передавайте Sonnet 5.5, исследования — моделям Flash, а к премиальной модели переходите только для критических решений.
- Задавайте жёсткие бюджеты времени и денег на каждую цель. «Реши этот баг, макс. $10 / 2 часа» — обеспечивайте через оркестратор, а не на удачу.
Когда использовать O/AON, а когда Opus 5.5 для долгих запусков
- O/AON: многодневные исследования, непрерывный мониторинг, координация нескольких агентов, задачи, которым нужно постоянное состояние среды
- Цикл агента Opus 5.5: задачи по коду с одной целью (часы, а не дни), чётко определённые результаты, выполнение за один проход
Связанное чтение
См. экономику ChatGPT Pro Max, цены OpenAI Ultra Fast API, стоимость 25-часового агента на Opus 5.5 и экономику агентов.
По теме
- Экономика ChatGPT Pro Max
- Цены OpenAI Ultra Fast API
- Стоимость 25-часового агента Opus 5.5
- Экономика агентов
Хотите применить это к своему стеку? Принесите счета провайдеров, логи шлюза и ключевые рабочие процессы — мы определим драйверы затрат и пути экономии. Заказать бесплатный аудит →