Claude Sonnet 5.5: 비용을 고려한 모델 라우팅 가이드
업데이트 September 28, 2026 · 최초 게시 September 28, 2026
Claude Sonnet 5.5가 2026년 9월 28일 Sonnet 5의 API 요율로 출시됐습니다. 입력은 100만 토큰당 $2, 출력은 100만 토큰당 $10입니다. Anthropic은 명확하게 범위가 정해진 일상 업무, 버그 수정, 코딩, 다듬어진 문서 작업에 맞춘 모델이라고 설명하며, 신중한 판단이 필요한 복잡한 작업에는 Opus 5.5를 겨냥합니다. 팀에게 중요한 질문은 어느 모델이 벤치마크에서 이기느냐가 아니라, 각 작업의 품질과 지연 목표를 가장 낮은 비용으로 통과시키는 모델이 무엇이냐입니다.
Anthropic은 Sonnet 5.5가 Sonnet 5보다 30% 이상 빠르고 작업당 비용을 최대 30% 낮출 수 있다고 밝혔습니다. 이는 출시 시점의 주장입니다. 평가할 대상을 고르는 근거로 쓰고, 예산을 자동으로 줄이는 근거로 쓰지는 마세요.
Anthropic의 발표 내용
- Sonnet 5.5는 Sonnet 5의 API 공개 가격을 그대로 유지합니다. 입력 $2/MTok, 출력 $10/MTok, 5분 캐시 쓰기 $2.50/MTok, 1시간 캐시 쓰기 $4/MTok, 캐시 읽기 $0.20/MTok입니다.
- Anthropic은 출력 생성이 Sonnet 5보다 30% 이상 빠르고, 토큰 효율 덕분에 대부분의 작업에서 작업당 비용이 최대 30% 낮다고 보고합니다.
- 회사는 Sonnet을 명확히 범위가 정해진 일상 작업에 가장 강한 모델로, Opus는 신중한 판단이 필요한 복잡한 작업용으로 설명합니다.
- Anthropic은 Haiku 5.5가 앞으로 몇 주 안에 나올 것으로 예상하며, 오늘의 출시에는 포함되지 않았다고 밝혔습니다.
전체 벤치마크 설명과 유의 사항은 Anthropic의 출시 발표를 참고하세요.
검증할 라우팅 정책
| 작업 유형 | 시작 후보 | 측정할 항목 |
|---|---|---|
| 일상적인 코드 변경, 버그 수정, 문서 편집 | Sonnet 5.5 | 수락된 변경 비율, 재시도 횟수, 출력 토큰, 소요 시간 |
| 모호하고 장기간이 걸리며 판단 요구가 높은 작업 | Sonnet 5.5와 Opus 5.5 비교 | 각 effort 설정에서의 품질, 상향 전환 빈도, 전체 종단 간 비용 |
| 대량의 단순 분류나 추출 | 스택에 이미 있는 저비용 모델과 Sonnet 비교 | 품질 기준선, 유효 레코드당 비용, 예외 처리 |
| 지연에 민감한 대화형 작업 | 품질 기준을 충족하는 effort 설정에서 Sonnet 5.5 테스트 | 꼬리 지연 시간, 완료율, 완료된 작업당 비용 |
이것은 측정 계획이지, 특정 작업 범주에서 한 모델이 항상 옳다는 주장이 아닙니다. 프롬프트 구조, 컨텍스트 길이, 도구 환경, 평가 기준에 따라 결과가 달라질 수 있습니다.
목록 가격 비교만으로는 부족한 이유
Sonnet 5.5의 토큰당 가격은 출시에서 내려가지 않았습니다. 잠재적인 절감은 작업을 끝내기 위해 필요한 토큰 수와 에이전트 단계 수에 있습니다. 답변은 짧지만 도구 호출이 더 많이 생기는 모델은 전체 비용이 더 나올 수 있고, 더 빨리 끝나지만 같은 토큰을 쓰는 모델은 토큰 청구서는 그대로 두고 응답성만 높일 수 있습니다.
에이전트의 작업 총비용은 입력 토큰 × 입력 요율 + 출력 토큰 × 출력 요율 + 캐시 쓰기/읽기 + 별도로 청구되는 도구나 인프라로 계산하세요. 두 모델이 같은 수락 기준을 통과했다는 것을 확인한 뒤에만 총비용을 비교하세요.
예산을 바꾸기 전에 전환을 측정하세요
- 실패 사례와 예외 사례를 포함해 수백 개의 대표 작업을 고르세요.
- 가능하면 같은 도구, 프롬프트, 컨텍스트 한도, effort 설정으로 Sonnet 5와 5.5를 실행하세요.
- 토큰 청구액, 재시도, 도구 호출, 완료까지 걸린 시간, 사람의 수락 여부를 기록하세요.
- 전체 평균만 보지 말고 작업 계열별로 수락된 작업당 비용을 비교하세요.
- 기준을 통과한 워크로드만 카나리 방식으로 전환하세요. 품질과 지출을 모니터링하면서 이전 모델로 돌아갈 경로를 남겨 두세요.
예측은 절감액 가정을 0으로 시작하세요. 평가에서 증거가 나오면 그 가정을 측정된 차이로 바꾸세요. API 요율과 캐시 가격은 Anthropic 가격 문서에서 확인하세요.
FAQ
Sonnet 5.5는 Sonnet 5보다 저렴한가요?
표준 토큰 요율은 같습니다. Anthropic은 토큰을 더 적게 쓰기 때문에 작업당 비용을 최대 30% 낮출 수 있다고 말하지만, 결과는 워크로드에 따라 다릅니다.
Sonnet 5.5가 Opus 5.5를 대체하나요?
아니요. Anthropic은 두 모델을 서로 다른 작업 특성에 맞춘 모델로 소개합니다. 작업 난이도, 실패 비용, 품질 요구가 비교를 정당화하는 경우에 두 모델을 모두 평가하세요.
AWS에서도 쓸 수 있나요?
AWS는 2026년 9월 28일부터 Amazon Bedrock과 AWS의 Claude Platform을 통해 제공된다고 발표했습니다. 배포를 계획하기 전에 서비스별 현재 리전, 모델 접근 권한, 가격 세부 사항을 확인하세요.
출처와 관련 읽을거리
- Anthropic: Claude Sonnet 5.5 소개
- AWS: AWS에서 Claude Sonnet 5.5 제공 시작
- Sonnet 5.5 가격과 작업 비용 모델
- Claude Opus 5.5 비용 모델
관련 글
이 내용을 현재 스택에 적용하고 싶으신가요? 공급업체 청구서, 게이트웨이 로그, 주요 워크플로를 가져오시면 비용 요인과 절감 경로를 정리해드립니다. 무료 감사 예약 →