Claude Opus 5.5 비용 모델
Updated September 22, 2026 · first published September 22, 2026
Anthropic은 2026년 9월 22일에 Claude Opus 5.5(claude-opus-5-5)를 출시했습니다. 헤드라인 가격은 백만 입력 토큰당 $4, 백만 출력 토큰당 $20로 Opus 5의 $5와 $25에서 인하했습니다. 이는 20% 인하입니다. 대부분의 프로덕션 워크로드의 경우 헤드라인이 제외한 레이트가 가장 많이 움직였기 때문에 실제 인하가 더 큽니다.
중요한 요금
| 토큰 유형 | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| 입력(캐시되지 않음) | $4.00 / MTok | $5.00 / MTok | $10.00 / MTok |
| 출력 | $20.00 / MTok | $25.00 / MTok | $50.00 / MTok |
| 캐시 쓰기(5분) | $5.00 / MTok | $6.25 / MTok | $12.50 / MTok |
| 캐시 읽기 | $0.20 / MTok | $0.50 / MTok | $0.25 / MTok |
| 빠른 모드(입력/출력) | $8 / $40 | — | — |
모든 행은 20% 낮지만 캐시 읽기는 60% 낮습니다. $0.20에서는 이제 Fable 5.1의 $0.25보다 저렴합니다. 이는 Fable이 예전에 이긴 한 행을 뒤집습니다. Fable 5.1 비용 모델에서 캐시가 많은 워크로드는 Opus 5보다 Fable에서 더 저렴할 수 있었습니다. Opus 5.5에 대해서는 더 이상 그렇지 않습니다. Fable은 모든 토큰 유형에서 더 많은 비용이 듭니다.
일반적인 작업이 약 40% 저렴한 이유
Anthropic의 주장은 일반적인 작업의 비용이 40% 감소한다는 것이지 20%가 아닙니다. 추가는 토큰 효율에서 비롯됩니다. Anthropic은 Opus 5.5가 약 20% 적은 입출력 토큰으로 동일한 결과에 도달하고 약 40% 덜 자세한 출력을 기록한다고 말합니다. 낮은 요금 곱하기 적은 토큰의 합계: 0.8 × 0.8 = 0.64, 이는 혼합에 따라 대략 36-40% 할인입니다.
여기 에이전트 단계 하나가 있습니다: 200,000 입력 토큰, 캐시에서 제공되는 90%, 20,000 출력 토큰.
| 라인 | Opus 5 | Opus 5.5(동일 토큰) | Fable 5.1 |
|---|---|---|---|
| 20K 캐시되지 않은 입력 | $0.100 | $0.080 | $0.200 |
| 180K 캐시 입력 | $0.090 | $0.036 | $0.045 |
| 20K 출력 | $0.500 | $0.400 | $1.000 |
| 합계 | $0.690 | $0.516 | $1.245 |
동일한 토큰에서 Opus 5.5는 캐시 할인으로 인해 Opus 5보다 25% 저렴하며 20%가 아닙니다. 워크로드에 20% 토큰 감소가 적용되면 단계는 약 $0.41로 떨어지며, 이는 Opus 5 아래 40%, Fable 비용의 3분의 1입니다. 출력은 여전히 이 예제에서 청구서의 약 80%입니다. 이것이 자세한 정도 감소가 보상되는 곳입니다.
GPT-6 Sol, GPT-6 Astra, Fable 5.1 대비 작업당 비용
100만 토큰당 정가와, 위와 같은 에이전트 단계(입력 200K, 90% 캐시, 출력 20K)를 각 모델로 계산한 값입니다.
| 모델 | 입력 $/MTok | 출력 $/MTok | 캐시 읽기 $/MTok | 동일 에이전트 단계 |
|---|---|---|---|---|
| GPT-6 Sol | $2.00 | $10.00 | $0.20 | $0.276 |
| Claude Opus 5.5 | $4.00 | $20.00 | $0.20 | $0.516 |
| Claude Opus 5 | $5.00 | $25.00 | $0.50 | $0.690 |
| Claude Fable 5.1 | $10.00 | $50.00 | $0.25 | $1.245 |
| GPT-6 Astra | $10.00 | $50.00 | $1.00 | $1.380 |
Artificial Analysis Intelligence Index v4.3.2에서 측정한 작업당 비용(2026년 9월 22일 기준, 점수순). 47.5점까지는 GPT-6 Sol이 가장 저렴합니다. 그 이상에서는 모든 수준에서 Opus 5.5가 가장 저렴합니다. Opus 5.5 high는 1.82달러에 53.6점, GPT-6 Astra max는 3.26달러에 52.7점, Fable 5.1 max는 7.63달러에 53.4점입니다.
| 모델 | Intelligence Index | 작업당 비용 | 작업당 출력 토큰 |
|---|---|---|---|
| GPT-6 Sol · medium | 39.8 | $0.25 | 6,500 |
| GPT-6 Sol · xhigh | 44.1 | $0.53 | 16,000 |
| GPT-6 Astra · low | 45.8 | $0.82 | 4,400 |
| GPT-6 Sol · max | 47.5 | $1.06 | 31,200 |
| Claude Opus 5 · high | 48.1 | $3.61 | 46,200 |
| Claude Opus 5 · max | 50.8 | $5.86 | 72,500 |
| Claude Opus 5.5 · medium | 51.2 | $1.34 | 25,700 |
| Claude Fable 5.1 · high | 51.2 | $3.91 | 38,100 |
| GPT-6 Astra · max | 52.7 | $3.26 | 27,200 |
| Claude Fable 5.1 · max | 53.4 | $7.63 | 78,100 |
| Claude Opus 5.5 · high | 53.6 | $1.82 | 35,600 |
| Claude Opus 5.5 · max | 57.6 | $5.98 | 119,200 |
GPT-6 Astra의 low 초과 설정, Opus 5의 모든 설정, Fable 5.1의 모든 설정은 같거나 더 높은 점수를 내는 Sol 또는 Opus 5.5 설정보다 비쌉니다. 작업당 비용은 벤치마크의 작업 구성에 따라 달라집니다. 모델을 바꾸기 전에 자체 트래픽으로 재현해 보세요.
Fable을 대체할 만큼 충분합니까?
Anthropic은 Opus 5.5를 대부분의 작업에서 Fable 5.1과 일치하는 것으로 위치합니다. 게시된 숫자는 코딩 및 에이전트 작업을 지원합니다:
- Terminal-Bench 4.0: 66.4%, Opus 5 52.3%, Fable 5.1 55.8% 대비.
- FrontierCode v1.1: 54.4%, Opus 5 48.0%, Fable 5.1 50.3% 대비.
- CursorBench 4.0: 57.8%, Opus 5 46.6% 대비.
- GDPval-AA v2.1: 1846 Elo, Opus 5 1708 대비.
Artificial Analysis는 출시 당일 Intelligence Index에서 1위로 순위를 매겼습니다. Anthropic은 또한 기본(중간) 노력에서 작업당 비용의 약 5분의 1로 GPT-6 Astra를 최대 노력으로 지식 작업에서 능가한다고 말합니다. 이는 공급업체 비교이므로 테스트할 가설로 취급하십시오. 위의 비용 수학은 직접 확인할 수 있는 부분입니다.
빠른 모드 비용 2×
빠른 모드는 $8 입력 및 $40 출력 비용이 정확히 표준 요금의 2배이며 최대 2.5× 속도입니다. 표준 모델도 Opus 5보다 약 30% 빠릅니다. 사용자가 대기 중인 지연 바운드 인터랙티브 경로에 빠른 모드를 사용하십시오. 배치 작업, 백그라운드 에이전트 및 eval에서 유지하십시오. 빠른 모드가 기본적으로 활성화되면 단가가 2배가 되고 청구서가 도착할 때까지 대시보드에 비정상은 표시되지 않습니다.
이번 주 할 일
- 모델 ID를 고정합니다. 프로덕션을
claude-opus-5-5로 명시적으로 지정하고 모든 요청에 ID를 기록하여 마이그레이션 후 요청당 비용을 모델별로 분할할 수 있습니다. - 자신의 트래픽에서 재설정합니다. 두 모델에서 실제 요청 샘플을 재생하고 호출당이 아닌 완료된 작업당 토큰을 비교합니다. 20% 토큰 효율 주장은 워크로드에 따라 가장 변할 가능성이 있는 부분입니다.
- 노력 설정을 다시 확인합니다. 워크로드가 품질을 위해 Fable 또는 최대 노력으로 이동한 경우 먼저 중간에서 Opus 5.5를 테스트하십시오. 그것은 Anthropic이 벤치마킹하는 설정입니다.
- Fable 라우팅 결정을 다시 실행합니다. 더 저렴한 캐시 읽기를 얻기 위해 캐시가 많은 트래픽을 Fable로 보낸 경로는 재평가해야 합니다. 해당 비용 이점은 사라졌습니다.
- 캐시 히트 비율을 주시합니다. $4.00에 대해 $0.20에서 캐시 미스는 이제 히트의 20배 비용이 듭니다. 접두사를 끊는 프롬프트 템플릿 변경은 Opus 5에서보다 더 많은 비용이 듭니다.
Anthropic은 Sonnet 5.5와 Haiku 5.5가 앞으로 몇 주 안에 나올 것이라고 말합니다. 단계 2에서 재생 하네스를 유지하여 각 릴리스를 오후에 다시 설정할 수 있습니다.
Related
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →