Claude Sonnet 5.5의 '최대 30% 저렴'은 절차를 요하는 작업에서만 재현됨
요약
Claude Sonnet 5.5가 출시되었으며, 단가는 이전 버전과 동일하지만 '절차를 요하는 작업'에서 최대 30%까지 비용 절감이 확인되었습니다. 이는 토큰 및 도구 호출 감소 덕분이며, 특히 복잡한 다단계 추론 과정(Task A)에서 큰 효율성을 보였습니다.
핵심 포인트
- Sonnet 5.5는 단가 유지에도 불구하고 작업당 비용이 최대 30%까지 절감됨.
- 비용 절감의 핵심은 토큰 및 도구 호출 감소에 있으며, 이는 복잡한 절차적 과제에서 두드러짐.
- 절차가 없는 단순 과제(Task B)에서는 Sonnet 5.5가 이전 버전보다 느린 경향을 보임.
- 실험 결과, Sonnet 5.5는 Sonnet 5 대비 평균적으로 턴 수와 비용 모두 크게 감소함.
Claude Sonnet 5.5가 2026-09-28에 출시되었습니다. 단가는 Sonnet 5와 동일한 $2 / $10입니다.
공식에서는 다음과 같이 언급하고 있습니다.
In our testing, it costs up to 30% less per task than its predecessor.
(태스크당 최대 30% 저렴)
단가가 같은데도 저렴해지는 이유는 공식에서 토큰과 도구 호출의 감소에 있다고 설명합니다.
showed a third fewer tool calls and roughly half the shell runs to finish a task
절차가 필요한 과제와 그렇지 않은 과제를 각각 하나씩 준비하여 측정했습니다.
절차가 있는 과제(각 5회) 비용은 평균 -31%. 공식의 '최대 30%'와 거의 일치합니다.
다만, 1회당 편차가 커서 신뢰하기는 어렵습니다.
절차가 없는 과제(각 3회) Sonnet 5.5가 25% 느립니다.
...
검증 환경: Windows 10 / Claude Code 2.1.285를 격리 도입 /
claude -p --model <ID>
/
--permission-mode acceptEdits
/ 전체 랜덤 설정 디렉토리 일회용(콜드) / 측정은 2026-09-30
과제는 두 가지입니다. 둘 다 정답이 하나로 정해져 있고, 도구를 사용하지 않으면 풀 수 없습니다.
과제 A (절차가 필요한 작업). orders/
하위 5개 파일에 USER=<id> AMOUNT=<수>가 나열되어 있으며,
blocklist.txt
에 제외할 사용자가 있습니다. 블록 외의 AMOUNT를 합산하여 답을 작성합니다.
정답은 4500입니다. 목록 가져오기 → 각 파일 읽기 → 제외 → 합산 → 쓰기,와 같은 절차가 필요합니다.
과제 B (절차가 없는 작업). 20줄의 로그를 읽고, ERROR
을 포함하는 줄 수를 작성합니다. 정답은 7입니다.
read → 세기 → write의 2~3단계로 끝납니다.
과제 A는 각 5회, 과제 B는 각 3회. **매번 콜드(프로젝트도 설정 디렉토리도 일회용)**합니다.
판정은 작성된 파일 내용입니다. modelUsage로 지정 모델이 실제로 사용되었는지도 확인했습니다.
(40회 모두 정답, 다른 모델에 떨어진 횟수는 0회. 총 $4.33).
각 5회의 중앙값입니다.
| 모델 | 턴 (중앙) | API 초 | 비용 (중앙) | 비용 (평균) |
|---|---|---|---|---|
| Sonnet 5.5 | 5 | 10.0 | $0.0696 | $0.0793 |
| Sonnet 5 | 10 | 16.0 | $0.1108 | $0.1142 |
| Opus 5.5 | 11 | 19.8 | $0.1457 | $0.1432 |
| Opus 5 | 10 | 22.7 | $0.2168 | $0.2270 |
| Haiku 4.5 | 10 | 14.2 | $0.0424 | $0.0413 |
Sonnet 5에서 5.5로의 변화입니다.
| 중앙값 | 평균 | |
|---|---|---|
| 턴 | -50% | -35% |
| 비용 | -37% | -31% |
| API 시간 | -38% | -28% |
| 출력 토큰 | -29% | -17% |
평균 -31%는 공식의 '최대 30%'와 거의 일치합니다. 단가는 유지되므로,
차이는 수고(절차)의 적음에서 나옵니다.
턴 수를 5회분으로 나열하면 다음과 같습니다.
Sonnet 5.5 5, 8, 5, 5, 12
Sonnet 5 12, 10, 10, 9, 13
5번째 Sonnet 5.5는 12턴이 걸리며, Sonnet 5의 최저 9보다 많습니다.
시간도 일치하지 않습니다 (5.5의 최대 22.6초 > Sonnet 5의 최소 11.4초).
비용만은 겹치지 않지만, 5.5의 최대 $0.0964와 Sonnet 5의 최소 $0.0965의 차이는 $0.0001로,
닿아 있는 것과 다름없습니다.
'다음 1회가 3할 저렴해진다'라고 말할 수는 없습니다. 말할 수 있는 것은 모아서 수십 번 돌렸을 때의 평균입니다.
3회에서 끊었다면, 중앙값은 -39%, 평균은 -29%가 나왔습니다.
횟수를 5회로 늘리자 중앙값은 -37%, 평균은 -31%로 움직였습니다. 그 정도까지는 변동합니다.
각 3회에 대한 중앙값입니다.
| 모델 | 턴 | API 초 | 비용 | 출력 토큰 |
|---|---|---|---|---|
| Sonnet 5.5 | 3, 3, 3 | 5.8 | $0.0527 | 493 |
| Sonnet 5 | 10, 2, 2 | 4.6 | $0.0631 | 169 |
Sonnet 5.5가 25% 느리고 출력 토큰도 많습니다. 비용은 16% 저렴할 뿐이며,
그 차이는 출력이 아니라 캐시 생성 토큰의 차이(5.5가 적음)에서 나왔습니다.
절차를 줄일 수 있는 과정이 없으면, Sonnet 5.5의 강점은 나오지 않습니다. 순순히 2턴으로 끝나는 Sonnet 5에 속도 면에서는 밀립니다.
공식 주장은 **'작업당(タスクあたり)'**이라고 쓰여 있으며, 그 '작업'에 수고가 필요하다는 조건부였습니다.
과제는 두 가지, 각각 5회와 3회입니다. 벤치마크가 아닙니다. 순위는 과제에 따라 바뀝니다 -
중앙값과 평균이 벌어집니다. 과제 A의 비용은 중앙값 -37% / 평균 -31%입니다.
둘 중 어느 한쪽만 보면 오해입니다 -
측정한 것은 2026-09-30의 하루였습니다. 혼잡도에 따라 시간은 변합니다 -
모든 실행을 콜드(cold)로 했습니다. 실제 작업은 캐시에 올라가므로 비용은 이보다 낮습니다.
여기서 보고 있는 것은 버전 간 비교일 뿐, 실제 청구액이 아닙니다. 비용은 \--output-format json의 total_cost_usd입니다. 플랜에 따라 청구는 다릅니다 -
Opus 5.5도 과제 A에서 **Opus 5 대비 비용 중앙 -33% / 평균 -37%**였습니다. 경향은 같았습니다.
단가는 Sonnet 5와 동일합니다 ($2 / $10). 저렴해지는지는 수고가 줄어드는지에 따라 결정됩니다 -
절차를 거치는 과제에서는 비용이 평균 -31%입니다. 공식의 '최대 30%'는 거의 재현되었습니다 -
한 번 한 번으로는 기대할 수 없습니다. 턴도 시간도, 두 모델의 폭은 겹칩니다.
효과가 있는 것은 횟수를 모았을 때 -
절차 없는 과제에서는 오히려 25% 느리고, 비용 차이는 16%에 머뭅니다. 차이는 출력이 아니라 캐시 생성 토큰에서 나옵니다.
'새로 나왔으니까 빠르고 싸다'는 것이 아니었습니다. Sonnet 5.5의 가치는
절차를 줄일 수 있는 부분에 있습니다. 자신이 자주 하는 일에서 줄일 수 있는 수고가 있는지에 따라, 교체 효과는 달라집니다.
Claude Code에서 선택 가능한 12개 모델에게 같은 일을 시켰다. 1년 동안 속도는 2.7배, 가격은 1%밖에 변하지 않았다 — 이 기사와 같은 측정 방식의 1년치 버전
- Claude Opus 5.5의 '40% 저렴'은 캐시 적중 여부에 따라 24%일 수도 있고 59%일 수도 있었다 — 동일한 '발표 수치'를 실측으로 무너뜨린 회
JQIT 엔지니어의 95% 이상은 미경험자 채용입니다.
괜찮으시면 법인 웹사이트에도 놀러 오세요.
엔지니어 채용도 진행하고 있습니다. 관심 있으시면 한번 둘러보세요.
▶ 채용 사이트
AI 자동 생성 콘텐츠
본 콘텐츠는 Qiita AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기