Claude Sonnet 5.5 가격: 바뀌는 것과 바뀌지 않는 것
업데이트 September 28, 2026 · 최초 게시 September 27, 2026
Claude Sonnet 5.5는 Anthropic API에서 백만 입력 토큰당 $2, 백만 출력 토큰당 $10입니다. Sonnet 5와 같은 정가입니다. 경제성의 변화는 효율에서 옵니다. Anthropic은 Sonnet 5.5가 토큰을 덜 사용해 작업당 비용을 최대 30% 낮출 수 있고, 출력 생성도 30% 넘게 빠르다고 말합니다. 이는 벤더가 밝힌 최대치이며, 모든 워크로드에 보장되는 할인이 아닙니다.
예산 예측에서는 토큰 단가를 고정하고, 토큰 수와 에이전트 단계의 가능한 감소분은 따로 모델링하세요. 절감 가정을 적용하기 전에 자신의 작업 구성을 먼저 측정하세요.
Sonnet 5.5 API 가격
| 토큰 유형 | 백만 토큰당 가격 |
|---|---|
| 입력 | $2.00 |
| 출력 | $10.00 |
| 5분 캐시 쓰기 | $2.50 |
| 1시간 캐시 쓰기 | $4.00 |
| 캐시 읽기 | $0.20 |
Anthropic은 이 요금을 Sonnet 5.5 출시 발표에 공개합니다. “작업당 최대 30% 저렴”을 토큰 단가가 30% 내려간 것으로 해석하지 마세요. 입력과 출력 가격은 Sonnet 5와 동일합니다. Anthropic이 예정했던 9월 인상을 취소한 뒤로 Sonnet 5의 $2/$10 가격이 이제 표준이기도 합니다.
예시: 토큰 효율 대 요금 변화
캐싱 없이 입력 100,000 토큰과 출력 10,000 토큰을 쓰는 작업을 생각해 봅시다. Sonnet 5.5의 공개 요금에서 입력 $0.20과 출력 $0.10을 합치면 작업당 $0.30입니다. 같은 작업이 두 항목 모두 30% 적은 토큰을 쓴다면 모델링 비용은 $0.21이 됩니다. 이는 산술의 예시일 뿐, 모든 작업이 토큰을 30% 덜 쓴다는 약속이 아닙니다.
월 10,000개 이런 작업이라면 기준선은 $3,000입니다. 토큰량이 30% 줄면 $900이 절감되어, 모델링한 월 청구액은 $2,100이 됩니다. 실제 결과는 프롬프트 길이, 캐시 재사용, 출력 길이, 추론 노력, 재시도, 도구 호출에 따라 달라집니다.
출시 벤치마크가 보여 주는 것과 보여 주지 않는 것
Anthropic은 Terminal-Bench 4.0과 CursorBench를 포함한 코딩 및 지식 노동 평가에서 개선을 보고합니다. 또한 Sonnet 5.5가 Sonnet 5보다 30% 넘게 빠르게 출력을 생성하며, 여러 벤치마크 비교에서 작업당 비용의 일부만으로 이전 Sonnet 5 점수에 도달한다고 밝힙니다. 이 결과는 평가 계획을 세울 때 유용한 가설이지만, 벤더가 발표한 측정치이지 독립적인 실제 운영 비용 데이터는 아닙니다.
실용적인 주의점이 하나 있습니다. 더 빠른 모델이 토큰 과금 청구서를 자동으로 줄이지는 않습니다. 청구서는 완료된 작업당 사용량이 줄거나, 재시도나 에스컬레이션이 필요한 작업이 줄어들 때 내려갑니다. 빠른 생성은 처리량을 높이거나 지연 시간을 줄이지만, 토큰 지출은 그대로일 수 있습니다.
도입을 예측하는 안전한 방법
- 요금표를 고정하세요. Sonnet 5와 5.5의 출발점으로 백만 입력/출력 토큰당 $2/$10을 사용하세요.
- 완료된 작업을 측정하세요. 요청당 토큰만이 아니라 승인된 작업당 비용을 비교하세요. 가능하면 재시도, 도구 호출, 사람의 재작업을 포함하세요.
- 워크로드별로 나누세요. 코딩, 지원, 추출, 장문 컨텍스트 작업을 따로 평가하세요. 하나의 혼합 절감률은 회귀를 가릴 수 있습니다.
- 범위로 잡으세요. 내부 테스트가 근거를 제시하기 전까지는 절감 0%로 예산을 세우고, 그 뒤에 측정된 시나리오를 추가하세요. Anthropic의 “최대 30%”는 예측이 아니라 상한 주장으로 다루세요.
- 품질과 지연 시간을 다시 확인하세요. 승인율이 떨어지거나 더 비싼 대체 모델이 필요해지면 토큰 청구서가 낮아져도 절감이 아닙니다.
FAQ
Sonnet 5.5는 토큰당 더 저렴해졌나요?
아닙니다. Anthropic은 Sonnet 5와 같은 백만 입력 토큰당 $2, 출력 토큰당 $10 요금을 공개합니다. 작업당 비용 주장은 비슷한 일을 더 적은 토큰으로 처리하는 데서 나옵니다.
30% 절감은 보장되나요?
아닙니다. Anthropic은 출시 자료에서 대부분의 작업에 대해 작업당 최대 30% 절감을 설명합니다. 결과는 워크로드, 프롬프트 캐싱, 노력 설정, 작업 완료 품질에 따라 달라집니다.
캐시된 요청은 얼마인가요?
Anthropic은 캐시 읽기를 백만 토큰당 $0.20, 5분 쓰기를 $2.50, 1시간 쓰기를 $4.00으로 공개합니다. 예측을 확정하기 전에 최신 Claude API 가격 문서를 확인하세요.
운영 트래픽을 바로 전환해야 할까요?
먼저 대표성 있는 평가를 돌리세요. 모델을 섀도 또는 카나리로 운영하며 승인된 결과당 비용과 지연 시간을 비교하고, 성능이 떨어지는 워크로드를 위해 롤백 경로를 유지하세요.
출처 및 관련 읽을거리
관련 글
이 내용을 현재 스택에 적용하고 싶으신가요? 공급업체 청구서, 게이트웨이 로그, 주요 워크플로를 가져오시면 비용 요인과 절감 경로를 정리해드립니다. 무료 감사 예약 →