Opus 5.5와 Sonnet 5.5, 어떤 것을 사용해야 할까? 새로운 Sonnet 5.5를 수치로 비교
요약
Anthropic에서 새로운 Claude Sonnet 5.5 모델을 출시하여, 이전 버전 대비 속도와 비용 효율성을 크게 개선했습니다. 이 모델은 최상위 Opus 5.5에 근접한 성능을 제공하면서도, 작업당 토큰 사용량 감소로 인해 경제적인 선택지가 될 수 있습니다.
핵심 포인트
- Sonnet 5.5는 Sonnet 5 대비 속도가 30% 이상 빠르고 비용 효율적입니다.
- Opus 5.5에 근접한 성능을 보여 복잡하지 않은 작업에 적합합니다.
- Balyasny Asset Management 테스트 결과, 답변당 토큰 사용량이 크게 감소했습니다.
본문 소개
Claude Code의 첫 모델은 Opus 5.5입니다. 항상 최상위 모델을 써야 하는지, 아니면 더 빠르고 저렴하게 처리할 수 있는 방법이 없는지 고민해 본 적이 없으신가요?
9월 28일, Anthropic에서 'Claude Sonnet 5.5'를 출시했습니다. 이전 Sonnet 5보다 30% 이상 빠르며, 작업당 비용은 최대 30% 절감되었고, 성능은 최상위 Opus 5.5에 근접했다고 합니다.

사용처 가이드 (발표 설명 기반으로 작성)
이 글은 발표와 개발자 설명을 Claude에게 읽게 하고 수치를 비교한 내용입니다. Claude를 Claude Code나 API로 사용하면서 모델 선택에 어려움을 겪는 분들을 위해 작성되었습니다.
개요
| 항목 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 적합한 작업 | 명확하게 정해진 일상적인 작업 | 답이 정해지지 않은 복잡한 작업 |
| ... | /model sonnet으로 전환 가능 | 기본적으로 사용됨 |
구성
- 비용은 그대로, 사용량 감소
- 성능은 Opus 5.5에 근접
- 테스트를 진행한 회사 결과
- 사용처 구분
- 모델 전환 방법
- 보안 측면
1. 비용은 그대로, 사용량이 줄었다

요금표 가격은 Opus 5.5의 절반
Sonnet 5.5의 요금은 Sonnet 5와 동일합니다. 입력 100만 토큰당 2달러, 출력 10달러로, Opus 5.5의 절반 수준입니다. 여기서 토큰이란 AI가 글을 세는 단위입니다.
가격은 같지만, 작업당 비용은 줄었습니다. 하나의 작업을 처리하는 데 사용되는 토큰 자체가 많이 줄었기 때문입니다.

Balyasny Asset Management의 결과. 답변당 토큰이 약 4분의 1로 감소
핵심 포인트
- 투자 회사인 Balyasny Asset Management가 금융 관련 작업 2,441건을 테스트한 결과, 답변당 토큰은 약 12만 1천 토큰이었습니다. Sonnet 5는 약 49만 7천 토큰이었습니다.
- 글을 작성하는 속도는 Sonnet 5보다 30% 이상 빨라졌습니다. 지금까지의 Sonnet 중 가장 빠르다고 합니다.
2. 성능은 Opus 5.5에 근접하다

Anthropic이 공개한 시험 점수. 높을수록 좋음
| 시험 내용 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| 명령어 작업이 포함된 프로그래밍 (Terminal-Bench 4.0) | 70.6% | 10.3% | 66.4% |
| ... |
핵심 포인트
- Sonnet 5 대비 크게 향상되어, Opus 5.5와 많은 시험에서 몇 점 차이입니다.
- 명령어 작업이 포함된 프로그래밍에서는 Opus 5.5를 능가했습니다. 이 시험의 Opus 5.5 점수는 사고의 깊이를 크게 높인 'Xhigh' 설정에서의 값입니다.
- 스크린샷만 보고 게임 '포켓몬스터 아빨(赤)'을 클리어한, 최초의 Sonnet이라고 합니다.
3. 테스트를 진행한 회사 결과
| 회사 | 결과 |
|---|---|
| Base44 (앱 제작 서비스) | 실제 앱 만들기 118건에서 성능은 Opus 5와 동일. 완성까지 수정 과정은 평균 3.6회 (Opus 5는 7.7회) |
| ... |
4. 사용처 구분
Sonnet 5.5에 적합한 작업
명확하게 정해진 일상적인 작업입니다. 버그 수정이나 문서/슬라이드/표 작성, 디자인 수정 등이 해당됩니다. 빠르기 때문에 간단한 작업을 여러 번 주고받으며 완성도를 높여가는 용도로도 적합하다고 발표에는 나와 있습니다.
Opus 5.5에 적합한 작업
답이 정해지지 않은 복잡한 업무나, 판단을 길게 쌓아 올리는 작업입니다. 전체적인 설계를 결정하는 상황에도 이 모델이 적합합니다.
핵심 포인트
- 사고의 깊이를 최대로 설정하면 Sonnet 5.5도 몇몇 시험에서 Opus 5.5와 견줄 만합니다. 그럼에도 불구하고, 판단을 오랫동안 이어가야 하는 업무에서는 Opus 5.5가 확실히 우위에 있다는 것이 Anthropic의 관점입니다.
- 조합해서 사용하는 방법도 있습니다. 게임 제작에 사용한 사람들은
생각의 깊이 초기 설정은 Claude Code와 앱에서는 'Medium'이며, API에서는 'High'입니다. 한 번에 출력할 수 있는 양은 12만 8천 토큰이며, 제공 종료는 빠르면 2027년 9월 28일 이후로 예정되어 있습니다.
6. 안전성 (Safety)
위험도가 높은 사이버 보안 관련 요청의 경우, Sonnet 5가 사용자에게 이해할 수 있는 형태로 전환하여 답변합니다. 평소의 버그 찾기나 수정 작업은 계속해서 Sonnet 5.5가 담당합니다.
Claude의 생각 내용을 추출하는 행위를 막는 장치도 Sonnet에서 처음 도입되었습니다. 이로 인해 대화를 다른 계정으로 옮기는 것에 제한이 걸립니다. Claude Code로 작업 도중에 계정을 전환할 경우에도 해당됩니다.
Anthropic은 약 1,850가지 시나리오에서 동작을 조사했으며, 사용자의 의도에 반하는 목표를 추구했다는 증거는 발견하지 못했다고 밝혔습니다.
사용처 가이드라인 (Usage Guide)
| 하고 싶은 일 | 추천 모델 |
|---|---|
| 매일의 버그 수정, 자료 제작 | Sonnet 5.5 |
| ... |
참고
홍보: 다음 내용을 다른 모델로 전달하려면 session-relay
session-relay는 새로운 채팅에서 '계속'이라고 입력하기만 하면 이전 대화를 이어받을 수 있는 도구입니다. 새로운 AI가 이전 대화를 스스로 읽어와서 계속부터 시작합니다. 9월 업데이트를 통해, 다음 내용을 전달할 AI의 종류(모델)를 지정할 수 있게 되었습니다.
설치 방법은 터미널에서 다음 두 줄입니다.
npm install -g @shoujiki-panman/session-relay
relay install
자세한 내용은 이전에 작성된 글에 모아두었습니다.
토론 (Discussion)

AI 자동 생성 콘텐츠
본 콘텐츠는 Zenn AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기