Claude Sonnet 5.5의 단가와 Opus 5.5의 effort 설정에 대한 분석
요약
Anthropic의 Claude Sonnet 5.5 및 Opus 5.5 활용법에 대한 분석입니다. Sonnet 5.5는 토큰 사용량 감소로 비용 효율성이 높아졌으며, Opus 5.5는 기본 effort 설정 변경으로 인해 이전 설정을 그대로 사용할 경우 답변이 길어지고 비용이 증가할 수 있어 주의가 필요합니다.
핵심 포인트
- Sonnet 5.5의 비용 절감은 단가 하락보다 토큰 사용량 감소에 기인함.
- Opus 5.5는 기본 effort 값이 medium으로 변경되어, 이전 high 설정을 그대로 쓰면 과도한 비용 발생 가능.
- 모델 전환 시에는 반드시 Sonnet 5와 비교하여 토큰 수 및 결과를 단계적으로 테스트해야 함.
이번 주(9/28~10/4) Anthropic 관련 기사는 총 12건이 있었습니다. 핵심 내용은 9월 28일에 공개된 Claude Sonnet 5.5와 Opus 5.5를 활용하는 방법을 설명한 공식 문서입니다.
Sonnet 5.5의 '건당 최대 3할 저렴'하다는 것은 단가 자체가 낮아진 것이 아닙니다. 사용되는 토큰이 줄어든 만큼 비용이 절감된다는 의미입니다. Opus 5.5는 effort의 기본값이 변경되어, Opus 5 시절의 설정을 그대로 적용하면 답변이 길어지고 비용이 높아집니다.
이번 주 동향: 활용할 만한 정보 2가지
자세히 살펴볼 내용은 Sonnet 5.5와 Opus 5.5를 활용하는 방법 두 가지입니다. 활용법 기사(claude.dev)는 9월 22일에 공개되었지만, 이번 주 Hacker News 상위에 올라와 다루고 있습니다.
먼저 확인해야 할 것은 9월 29일의 장애 건입니다. 공식 장애 페이지에 따르면, 14:00~14:59 UTC(한국 시간으로는 23시경)에 claude.ai, Claude Code, Claude Cowork, Claude API에서 오류가 증가했습니다. 이 사이에 보낸 메시지는 저장되지 않았을 수 있습니다. 밤에 자동 처리를 돌리는 분들은 해당 시간대의 결과가 남아있는지 확인하는 것이 안전합니다.
Sonnet 5.5: 단가는 같고 줄어드는 것은 사용량
릴리스 노트에 따르면, Sonnet 5.5는 Opus 5.5보다 빠르고 저렴한 파트너라는 포지셔닝입니다. 단가는 Sonnet 5와 동일하며, 100만 토큰당 입력 $2, 출력 $10입니다. 캐시 읽기 비용인 $0.20도 같습니다.
그럼에도 불구하고 건당 비용이 저렴해지는 이유는 같은 작업을 더 적은 토큰으로 완료할 수 있기 때문입니다. 공식 페이지의 설명 방식은 '자사 테스트에서 최대 3할'이므로, 모든 작업에서 3할 저렴해진다는 의미는 아닙니다. 출력 속도는 Sonnet 5보다 3할 이상 빠르다고도 명시되어 있습니다.
성능 면에서 가장 큰 향상은 터미널 조작 시험입니다. Terminal-Bench 4.0은 10.3%에서 70.6%로 증가했습니다. 다만, 이는 공식 페이지의 자체 신고이며, 이전 모델과 테스트 조건이 동일했는지는 이번에 확인되지 않았습니다. OSWorld 2.1(부분 점수)는 57.0%에서 80.1%, CursorBench 4.0은 34.1%에서 55.5%로 다른 시험에서도 향상을 보였습니다.
전환하기 전에 공식 페이지에 두 가지 주의사항이 있습니다.
- 공개 이전 버전에서는 구조화 출력 응답이 저하되는 버그가 발견되었습니다. JSON 형태를 지정하여 사용하고 있다면, 본인의 데이터로 결과 형태를 비교해 보세요.
- 미생물이나 바이러스 관련 질문이 잘못 차단될 수 있습니다.
테스트 절차는 다음 3단계입니다.
- 현재 Sonnet 5로 처리하는 작업 하나를 선택합니다.
- 동일한 입력 상태에서 모델 지정만 claude-sonnet-5-5로 변경합니다.
- 건당 토큰 수와 결과를 나란히 비교합니다.
결과가 불안정하면, 설정을 Sonnet 5로 되돌립니다. 먼저 하나부터 단계적으로 옮기는 것이 안전합니다.
Opus 5.5: 느리고 비싼 3가지 원인
공식 문서(Prompting Claude Opus 5.5)와 claude.dev 기사는 Opus 5.5로 변경했는데도 느리고 비용이 많이 드는 경우의 원인을 다음 세 가지로 정리했습니다.
원인 1: effort 기본값이 변경됨
effort는 얼마나 깊게 생각할지 결정하는 다이얼입니다. Opus 5.5의 기본값은 medium이었고, Opus 5의 기본값은 high였습니다. Anthropic의 테스트에서는 5.5의 medium이 Opus 5의 high와 비슷하거나 능가합니다. 따라서 Opus 5 시절의 high를 그대로 사용하면 너무 깊게 생각하여 답변이 길어지고 비용이 높아집니다.
절차는 medium을 명시한 후, low와 high를 본인이 평가하여 비교하는 것입니다. 주의할 점이 두 가지 있습니다. 대화 도중에 effort를 변경하면 캐시가 작동하지 않습니다. 한 번만 바꾸고 싶다면 메시지 단위 지정(베타)을 사용합니다. xhigh나 max는 품질 향상이 측정된 작업에만 사용하는 것이 안전합니다.
원인 2: '깊이 생각하게' 지시어
Opus 5.5는 항상 생각한 후에 답변합니다. 따라서 '깊이 생각해 주세요', '순서대로 생각해서'와 같은 지시는 삭제해야 합니다. 이 지시어를 제거하면 답변 시작 속도가 빨라졌다는 것이 공식 테스트 결과에 나와 있습니다.
API에서 thinking을 비활성화했던 분들은 주의해야 합니다. Opus 5.5에서는 비활성화할 수 없습니다. 공식적으로는 effort의 low부터 측정하는 것을 권장하고 있습니다.
원인 3: 긴 작업이 도중에 멈추는 경우
Opus 5.5는 작업 진행 상황을 중간에 보고합니다. 이 보고를 완료로 간주하는 시스템 구조 때문에 그 지점에서 멈춥니다. 대책은 할 일 목록(to-do list)을 파일에 담아두고, 남은 부분이 있으면 계속 진행하도록 유도하는 것입니다.
다만, 자동 알림은 2~3회 정도로 제한해야 합니다. 그래도 움직이지 않는다면 사람이 살펴봐야 하는 막힘 지점입니다. 작성 내용은 작업 폴더로 한정하고, 실행 로그도 남겨두면 나중에 추적할 수 있습니다.
fast 모드에도 주의가 필요합니다. 품질은 같지만 빨라지며, API에서는 Opus 5.5의 단가가 입력 $8, 출력 $40으로 일반 가격의 2배가 됩니다(공식 가격표). Claude Code의 /fast는 추가적인 사용량 할당(usage quota) 활성화가 필요하며, 토큰 비용이 올라갑니다(claude.dev).
Sonnet 5 / Sonnet 5.5 / Opus 5.5를 같은 표로 비교하기
2026년 10월 기준 공식 가격표와 공식 페이지의 자체 신고 점수를 나열합니다.
- 입출력 단가: Sonnet 5는 $2 / $10, Sonnet 5.5는 $2 / $10, Opus 5.5는 $4 / $20
- 캐시 읽기(Cache Read): 세 모델 모두 $0.20
- GDPval-AA (광범위한 실무): 1449 / 1844 / 1846
- FrontierCode 1.1 (코드 난이도 문제): 42.4% / 46.2%(effort 최대) / 54.4%
GDPval-AA에서는 Sonnet 5.5와 Opus 5.5가 2점 차이지만, FrontierCode에서는 8.2 포인트나 벌어집니다. 게다가 Sonnet 측의 46.2%는 effort를 최대로 설정했을 때의 수치입니다. '반값으로 2점 차이'라는 제목은 광범위한 실무에 한정됩니다.
가격 차이도 항상 2배가 아닐 수 있습니다. 다음은 자체 추산입니다.
- 입력 1,000만 토큰・출력 50만 토큰, 캐시 없음: Opus 5.5는 $50, Sonnet 5.5는 $25로 정확히 반값입니다.
- 입력 중 900만 토큰이 캐시 읽기인 경우: Opus 5.5는 $15.8, Sonnet 5.5는 $8.8로 약 44% 저렴합니다.
캐시 읽기가 동일하기 때문에, 캐시를 많이 사용하는 처리일수록 차이는 줄어듭니다. 공식에서도 Opus는 신중한 판단이 필요한 복잡한 작업에, Sonnet은 범위가 정해진 일상적인 작업에 적합하다고 설명하고 있습니다. 여기부터는 영상의 화자(speaker) 읽기인데, 일상의 주력으로는 Sonnet 5.5를 사용하고 막히는 난제만 Opus 5.5로 돌리는 방식이 합리적으로 보입니다.
나머지 뉴스 및 제목만 확인된 내용
- 기술자 양성 (Claude Frontier Academy, 10/2): 1억 달러를 투자하여 2027년 말까지 도입을 담당할 기술자를 1만 명 육성하는 계획입니다. 추천제로 개인은 지원할 수 없습니다.
- 연구 '로봇이 할 수 있는 일' (9/30): 신체 활동의 74%는 기술적으로 가능하지만, 비용 면에서 사람과 맞먹는 것은 0.3%입니다. 할 수 있는 것과 현재 대체되는 것은 별개의 문제입니다.
- Barclays의 활용 확대 (10/1): 1만 6,000명 이상이 사내 검색에 사용하고 있으며, 하루 약 12만 통의 이메일을 분류하고 있다고 합니다.
- FTC가 AI 각사를 조사 중이라는 CNBC 보도: 이번에는 제목까지만 확인되었습니다. 내용은 미확인이라 후속 보도를 기다립니다.
본문 내용을 확인할 수 없거나 설정 변경이 필요 없는 연구 읽기 자료 등은 제외했습니다.
출처
- Claude Sonnet 5.5 출시 노트 (2026-09-28): https://support.claude.com/en/articles/12138966-release-notes
- Claude Sonnet 5.5 (공식 페이지): https://www.anthropic.com/claude-sonnet-5-5
- Claude 가격 페이지 (공식): https://platform.claude.com/docs/en/about-claude/pricing
- Prompting Claude Opus 5.5 (공식 문서): https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5
- Claude와 Claude Code에서 Opus 5.5를 최대한 활용하는 방법 (claude.dev): https://claude.dev/blog/getting-the-most-out-of-opus-5-5
- Claude Frontier Academy (공식 발표, 2026-10-02): https://www.anthropic.com/news/claude-frontier-academy
- Barclays가 Claude를 확장하다 (공식 발표, 2026-10-01): https://www.anthropic.com/news/barclays-scales-claude
- 로봇은 어떤 일을 할 수 있을까? (공식 연구 페이지, 2026-09-30): https://www.anthropic.com/research/what-work-can-robots-do
- claude.ai, Claude Code, Claude Cowork 및 Claude API의 오류 증가 (공식 장애 페이지, 2026-09-29): https://status.claude.com/incidents/4xvtc2gnq73l
- FTC가 제품 위험 문제로 OpenAI, Anthropic 등 AI 기업 조사 중 (CNBC 보도, 2026-09-30): https://www.cnbc.com/2026/09/30/ftc-ai-probe-openai-anthropic.html
자세한 내용은 영상에서 확인하세요
숫자의 출처 구분이나 슬라이드 비교표는 영상에 정리되어 있습니다. 매주 업데이트되는 내용을 추적하고 싶으신 분은 영상 페이지에서 팔로우해 주세요.
토론
AI 자동 생성 콘텐츠
본 콘텐츠는 Zenn AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기