Модель затрат GPT-6 Luna
Обновлено September 23, 2026 · впервые опубликовано September 23, 2026
GPT-6 Luna — дешёвая модель семейства GPT-6 от OpenAI, выпущенная 22 сентября 2026 года вместе с GPT-6 Sol. OpenAI позиционирует её для работы с большим объёмом с понятной целью: суммаризация, извлечение данных и быстрые вопросы. При $0.10 за 1M входных токенов это модель, на которую стоит направлять запросы в первую очередь, и переходить с неё только тогда, когда задача докажет, что ей нужно больше.
Цены GPT-6 Luna
| Тариф | Вход | Закэшированный вход | Выход |
|---|---|---|---|
| Стандартный | $0.10 | $0.01 | $0.50 |
| Batch или flex | $0.05 | $0.005 | $0.25 |
| Быстрый режим | $0.20 | $0.02 | $1.00 |
| Длинный контекст (свыше 272K входа) | $0.20 | $0.02 | $0.75 |
За 1M токенов, по данным страницы цен OpenAI. Запись в кэш стоит $0.125. У Luna то же окно контекста 1,050,000 токенов, что и у остальных моделей GPT-6, срез знаний на май 2026 года (самый свежий из трёх) и полный диапазон effort от none до max.
Тот же балл, что у GPT-5.6 Luna, на 61% дешевле за задачу
Artificial Analysis прогнал оба поколения Luna через свой Intelligence Index (v4.3.2) на максимальном effort.
| Модель | Балл индекса | Стоимость задачи | Скорость вывода |
|---|---|---|---|
| GPT-6 Luna (max) | 37 | $0.07 | 132.2 токена/с |
| GPT-5.6 Luna (max) | 37 | $0.18 | 142.3 токена/с |
| GPT-6 Sol (low) | 33.9 | $0.13 | — |
Балл не изменился. Стоимость задачи упала на 61%, в основном из-за более низкой цены за токен. GPT-6 Luna на max также обходит GPT-6 Sol на effort low и по баллу, и по стоимости. Если вы гоняли Sol на low, чтобы экономить, то по этому индексу Luna на max выгоднее.
Во сколько обходится большой объём
Миллион запросов классификации в месяц, каждый с 600 входными и 100 выходными токенами, без кэширования:
| Модель | Стоимость в месяц |
|---|---|
| GPT-6 Luna, batch | $55 |
| GPT-6 Luna | $110 |
| GPT-5.6 Luna | $240 |
| Claude Haiku 4.5 | $1,100 |
| GPT-6 Sol | $2,200 |
| GPT-6 Astra | $11,000 |
Claude Haiku 4.5 стоит в 10× дороже за токен и набрал 15 баллов в том же индексе, будучи моделью без рассуждений. Перенос той же работы с Sol на Luna снижает счёт на 95%, поэтому имеет смысл строить роутер, который отправляет на Sol только сложные случаи.
Подвох: задержка и многословность
Цифры индекса выше получены на максимальном effort, а на нём Luna медленно начинает отвечать. Artificial Analysis зафиксировал 104 секунды до первого токена. Кроме того, по всему индексу модель выдала 150M выходных токенов при медиане 84M, что Artificial Analysis описывает как умеренную многословность. Эта многословность уже учтена в $0.07 за задачу, так что цифра стоимости остаётся верной, но ожидание не подходит для чата с пользователями.
Для интерактивного трафика запускайте Luna на none, low или на значении по умолчанию medium и измеряйте точность на своих промптах. Баллы на этой странице относятся только к максимальному effort, так что точность на более низких настройках нужно проверять, а не искать в таблицах. Максимальный effort оставьте для пакетных задач, где задержка не важна, а пакетная цена снижает счёт ещё вдвое.
Лимиты запросов масштабируются дальше, чем у Sol
Luna стартует с 500K токенов в минуту на Tier 1, как и Sol, но на Tier 5 достигает 180M токенов в минуту (у Sol потолок 40M), при этом до 30,000 запросов в минуту. Для массовых пайплайнов этот запас важен не меньше цены.
Как использовать Luna
- Маршрутизируйте по типу задачи: извлечение, классификация, тегирование и короткие резюме по умолчанию идут в Luna.
- Несрочный объём отправляйте через Batch API по $0.05/$0.25.
- Выбирайте effort по маршруту: low для интерактивных запросов, max для офлайн-задач.
- Эскалируйте на GPT-6 Sol, когда валидатор отклоняет ответ Luna, а не заранее.
Источники: страница модели GPT-6 Luna на сайте OpenAI, Artificial Analysis: GPT-6 Luna, Artificial Analysis: GPT-5.6 Luna, TechCrunch. Цены сняты 23 сентября 2026 года.
По теме
- Цены GPT-6: Astra, Sol и Luna
- Модель затрат GPT-6 Sol
- Модель затрат GPT-6 Astra
- Руководство по затратам на модели с рассуждениями
- Трекер цен на LLM API
Хотите применить это к своему стеку? Принесите счета провайдеров, логи шлюза и ключевые рабочие процессы — мы определим драйверы затрат и пути экономии. Заказать бесплатный аудит →