Opus 5.5의 노력 수준이 실제 가격입니다

Updated September 22, 2026 · first published September 22, 2026

Claude Opus 5.5는 입력 토큰 백만 개당 $4, 출력 토큰 백만 개당 $20입니다. 이는 Opus 5보다 20% 저렴합니다. 요금은 비용 이야기의 작은 절반일 뿐입니다. 큰 절반은 effort 설정으로, 모델이 답하기 전에 생각하는 데 소비하는 토큰 수를 결정합니다.

하나의 모델, 다섯 가지 가격

Opus 5.5는 low에서 medium, high, xhigh, max까지의 노력을 제공합니다. 각 수준은 동일한 토큰 단가의 동일한 모델이지만 매우 다른 수의 토큰을 생성합니다. The Decoder가 보고한 독립적 벤치마킹에 따르면 5개 수준 중 4개가 비용-성능 파레토 경계에 있습니다. 또한 최대 노력에서 Opus 5.5는 작업당 약 119,000개의 출력 토큰을 사용하여 경쟁 모델의 최고 설정보다 훨씬 많다는 것을 발견했습니다.

100만 토큰당 20달러면 출력 119,200토큰은 입력을 빼고도 작업당 2.38달러입니다. medium에서 Artificial Analysis가 측정한 출력은 25,700토큰, 즉 0.51달러였습니다. 입력까지 포함하면 max는 작업당 5.98달러, medium은 1.34달러로, 요청 파라미터 하나로 같은 모델의 작업당 비용이 약 4.5배 달라집니다.

Artificial Analysis Intelligence Index v4.3.2(평가 10종)에서 측정, 2026년 9월 22일 기준. 모든 행이 같은 벤치마크 묶음을 쓰므로 바로 비교할 수 있습니다.

모델 및 effortIntelligence Index작업당 비용작업당 출력 토큰비용-성능 프런티어 여부
Opus 5.5 · low42.3$0.5510,200아니요
Opus 5.5 · medium51.2$1.3425,700
Opus 5.5 · high53.6$1.8235,600
Opus 5.5 · xhigh56.0$3.4665,700
Opus 5.5 · max57.6$5.98119,200
Opus 5 · high (참고)48.1$3.6146,200아니요

출처: Artificial Analysis. 프런티어에 있다는 것은 GPT-6 Sol, GPT-6 Astra, Opus 5, Opus 5.5, Fable 5.1의 어떤 설정도 더 적은 비용으로 더 높은 점수를 내지 못한다는 뜻입니다. Opus 5.5 low는 GPT-6 Sol xhigh가 0.53달러에 44.1점을 내므로 제외됩니다. xhigh에서 max로 올리면 비용이 73% 늘고 점수는 1.6점 오릅니다.

중간이 Anthropic이 벤치마킹하는 설정입니다

Anthropic의 주요 비교는 기본 노력인 중간에서 수행됩니다. Opus 5.5는 중간에서 최대 노력의 GPT-6 Astra를 지식 작업에서 약 5분의 1의 작업당 비용으로 능가한다고 말합니다. 따라서 Anthropic 자체의 모델에 대한 사례는 중간에 기반하며 최대는 예외입니다. 모든 곳에 최대를 설정하는 팀은 "안전을 위해" 출시 벤치마크가 필요하지 않은 토큰에 대해 비용을 지불합니다.

추측 없이 노력을 설정하는 방법

  1. 기본적으로 중간으로 설정하세요. SDK 기본값이 변경되지 않도록 코드에서 명시적 값으로 만드세요.
  2. 전체적으로가 아니라 경로마다 노력을 높이세요. 어려운 디버깅, 장기 계획, 최종 검토 단계는 높음 또는 최대를 정당화할 수 있습니다. 분류, 추출 및 일상적인 편집은 거의 그렇지 않습니다.
  3. 각 요청으로 노력을 기록하세요. 요청당 비용은 이 없이는 해석할 수 없습니다. 요청 수가 평탄한 상태에서의 지출 급증은 일반적으로 노력 변경입니다.
  4. 동일하게 재생된 작업에서 노력 수준을 비교하세요. 각 수준에서 완료된 작업당 성공률과 출력 토큰을 기록하고 성공 개선이 멈출 때 노력 상향을 중단하세요.
  5. 제품이 허용하는 경우 출력을 제한하세요. 최대 토큰 제한은 최악의 경우를 제한합니다. 최대 노력에서는 그 제한이 폭주 작업과 여러 달러 요청 사이의 유일한 것입니다.

$25에서 $20으로의 인하는 20%를 절약합니다. 워크로드를 최대에서 중간 노력으로 옮기면 그보다 훨씬 더 절약할 수 있습니다. 노력을 다른 항목과 마찬가지로 소유하고 검토하는 예산 항목으로 취급하세요.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research