Перейти к содержанию

Модель затрат GPT-6 Luna

Обновлено September 23, 2026 · впервые опубликовано September 23, 2026

GPT-6 Luna — дешёвая модель семейства GPT-6 от OpenAI, выпущенная 22 сентября 2026 года вместе с GPT-6 Sol. OpenAI позиционирует её для работы с большим объёмом с понятной целью: суммаризация, извлечение данных и быстрые вопросы. При $0.10 за 1M входных токенов это модель, на которую стоит направлять запросы в первую очередь, и переходить с неё только тогда, когда задача докажет, что ей нужно больше.

Цены GPT-6 Luna

ТарифВходЗакэшированный входВыход
Стандартный$0.10$0.01$0.50
Batch или flex$0.05$0.005$0.25
Быстрый режим$0.20$0.02$1.00
Длинный контекст (свыше 272K входа)$0.20$0.02$0.75

За 1M токенов, по данным страницы цен OpenAI. Запись в кэш стоит $0.125. У Luna то же окно контекста 1,050,000 токенов, что и у остальных моделей GPT-6, срез знаний на май 2026 года (самый свежий из трёх) и полный диапазон effort от none до max.

Тот же балл, что у GPT-5.6 Luna, на 61% дешевле за задачу

Artificial Analysis прогнал оба поколения Luna через свой Intelligence Index (v4.3.2) на максимальном effort.

МодельБалл индексаСтоимость задачиСкорость вывода
GPT-6 Luna (max)37$0.07132.2 токена/с
GPT-5.6 Luna (max)37$0.18142.3 токена/с
GPT-6 Sol (low)33.9$0.13—

Балл не изменился. Стоимость задачи упала на 61%, в основном из-за более низкой цены за токен. GPT-6 Luna на max также обходит GPT-6 Sol на effort low и по баллу, и по стоимости. Если вы гоняли Sol на low, чтобы экономить, то по этому индексу Luna на max выгоднее.

Во сколько обходится большой объём

Миллион запросов классификации в месяц, каждый с 600 входными и 100 выходными токенами, без кэширования:

МодельСтоимость в месяц
GPT-6 Luna, batch$55
GPT-6 Luna$110
GPT-5.6 Luna$240
Claude Haiku 4.5$1,100
GPT-6 Sol$2,200
GPT-6 Astra$11,000

Claude Haiku 4.5 стоит в 10× дороже за токен и набрал 15 баллов в том же индексе, будучи моделью без рассуждений. Перенос той же работы с Sol на Luna снижает счёт на 95%, поэтому имеет смысл строить роутер, который отправляет на Sol только сложные случаи.

Подвох: задержка и многословность

Цифры индекса выше получены на максимальном effort, а на нём Luna медленно начинает отвечать. Artificial Analysis зафиксировал 104 секунды до первого токена. Кроме того, по всему индексу модель выдала 150M выходных токенов при медиане 84M, что Artificial Analysis описывает как умеренную многословность. Эта многословность уже учтена в $0.07 за задачу, так что цифра стоимости остаётся верной, но ожидание не подходит для чата с пользователями.

Для интерактивного трафика запускайте Luna на none, low или на значении по умолчанию medium и измеряйте точность на своих промптах. Баллы на этой странице относятся только к максимальному effort, так что точность на более низких настройках нужно проверять, а не искать в таблицах. Максимальный effort оставьте для пакетных задач, где задержка не важна, а пакетная цена снижает счёт ещё вдвое.

Лимиты запросов масштабируются дальше, чем у Sol

Luna стартует с 500K токенов в минуту на Tier 1, как и Sol, но на Tier 5 достигает 180M токенов в минуту (у Sol потолок 40M), при этом до 30,000 запросов в минуту. Для массовых пайплайнов этот запас важен не меньше цены.

Как использовать Luna

Источники: страница модели GPT-6 Luna на сайте OpenAI, Artificial Analysis: GPT-6 Luna, Artificial Analysis: GPT-5.6 Luna, TechCrunch. Цены сняты 23 сентября 2026 года.

По теме


Хотите применить это к своему стеку? Принесите счета провайдеров, логи шлюза и ключевые рабочие процессы — мы определим драйверы затрат и пути экономии. Заказать бесплатный аудит →

Вернуться на finopsllm.com