Перейти к содержанию

Уровни усилия Opus 5.5 определяют реальную цену

Обновлено September 22, 2026 · впервые опубликовано September 22, 2026

Claude Opus 5.5 стоит $4 за миллион входных токенов и $20 за миллион выходных токенов. Это на 20% ниже, чем у Opus 5. Прайс-лист — меньшая часть истории стоимости. Большая часть — настройка effort, которая определяет, сколько токенов модель тратит на размышления перед ответом.

Одна модель, пять цен

Opus 5.5 предлагает уровни усилия от low до medium, high, xhigh и max. Каждый уровень — та же модель по той же цене за токен, но она генерирует очень разное количество токенов. Независимое тестирование, о котором сообщил The Decoder, показало, что четыре из пяти уровней лежат на границе Парето «стоимость — качество». Также выяснилось, что на максимальном усилии Opus 5.5 использовал около 119,000 выходных токенов на задачу, что намного больше, чем конкурирующие модели на их максимальных настройках.

При $20 за миллион 119,200 выходных токенов стоят $2.38 за задачу без учета входа. На medium Artificial Analysis зафиксировал 25,700 выходных токенов, то есть $0.51. С учетом входа max стоит $5.98 за задачу, а medium — $1.34: одна и та же модель стоит примерно в 4.5 раза дороже за задачу в зависимости от одного параметра запроса.

Измерено по Artificial Analysis Intelligence Index v4.3.2 (десять оценок), данные на 22 сентября 2026 года. Все строки используют один и тот же набор тестов, поэтому их можно сравнивать напрямую.

Модель и усилиеIntelligence IndexСтоимость за задачуВыходные токены за задачуНа границе стоимость–качество
Opus 5.5 · low42.3$0.5510,200Нет
Opus 5.5 · medium51.2$1.3425,700Да
Opus 5.5 · high53.6$1.8235,600Да
Opus 5.5 · xhigh56.0$3.4665,700Да
Opus 5.5 · max57.6$5.98119,200Да
Opus 5 · high (эталон)48.1$3.6146,200Нет

Источник: Artificial Analysis. «На границе» означает, что ни одна настройка GPT-6 Sol, GPT-6 Astra, Opus 5, Opus 5.5 или Fable 5.1 не получает более высокий балл при меньших затратах. Opus 5.5 low вне границы, потому что GPT-6 Sol на xhigh набирает 44.1 за $0.53. Переход с xhigh на max добавляет 1.6 балла при росте стоимости на 73%.

Medium — настройка, с которой Anthropic сравнивает модель

Главное сравнение Anthropic проводится на усилии по умолчанию, то есть medium. В нем говорится, что Opus 5.5 на medium обходит GPT-6 Astra на max в задачах с знаниями примерно при одной пятой стоимости за задачу. Таким образом, вывод Anthropic в пользу модели опирается на medium, а max — исключение. Команда, которая ставит max везде «на всякий случай», платит за токены, которые стартовые тесты не требовали.

Как задать усилие без догадок

  1. По умолчанию — medium. Задайте это явным значением в коде, а не значением SDK по умолчанию, которое может измениться.
  2. Повышайте усилие для каждого маршрута, а не глобально. Сложная отладка, долгосрочное планирование и финальная проверка могут оправдать high или max. Классификация, извлечение данных и рутинные правки почти никогда.
  3. Логируйте усилие с каждым запросом. Без этого стоимость запроса не интерпретируется. Скачок расходов при неизменном числе запросов обычно означает изменение усилия.
  4. Сравнивайте уровни усилия на одних и тех же воспроизведенных задачах. Фиксируйте долю успешных выполнений и выходные токены на завершенную задачу на каждом уровне и прекращайте повышать усилие, когда успешность перестает расти.
  5. Ограничивайте вывод там, где это позволяет продукт. Лимит максимальных токенов ограничивает худший случай. На максимальном усилии этот лимит — единственное, что отделяет одну вышедшую из-под контроля задачу от запроса в несколько долларов.

Снижение с $25 до $20 за миллион выходных токенов дает экономию 20%. Перевод нагрузки с max на medium может сэкономить гораздо больше. Относитесь к усилию как к статье бюджета, за которую отвечают и которую проверяют, как за любую другую.

По теме


Хотите применить это к своему стеку? Принесите счета провайдеров, логи шлюза и ключевые рабочие процессы — мы определим драйверы затрат и пути экономии. Заказать бесплатный аудит →

Вернуться на finopsllm.com