
Claude Opus 5 요점 정리: 요금 동결 및 상위 모델의 절반 가격, 5단계 effort 설정, 이전 시 400 에러 주의
요약
Anthropic이 새로운 모델 Claude Opus 5를 공개했습니다. 이전 세대와 동일한 가격을 유지하면서도 성능은 대폭 향상되었으며, 지능과 비용을 조절할 수 있는 5단계 effort 설정이 도입되었습니다.
핵심 포인트
- Opus 5는 이전 세대와 동일한 요금으로 최상위 모델 대비 높은 가성비 제공
- effort 파라미터를 통해 5단계(low~max)로 지능 및 토큰 사용량 조절 가능
- Opus 5의 지식 컷오프는 2026년 5월로 상위 모델보다 최신 정보 반영에 유리
- Opus 4.1 모델은 2026년 8월 5일 서비스 종료 예정
2026년 7월 24일, Anthropic이 Claude Opus 5를 공개했습니다. 요금은 이전 세대인 Opus 4.8과 동일한 수준을 유지하며, 최상위 모델인 Fable 5의 정확히 절반 가격이라는 위치를 차지하고 있습니다.
같은 날 effort라는 5단계 설정과 이전 가이드(migration guide)도 함께 공개되었으며, 이는 단순한 신규 모델 추가가 아니라 "같은 예산으로 사용할 수 있는 모델이 교체되었다"는 발표가 되었습니다.
이 기사에서는 요금과 사양, effort의 사용법, 이전에 문제가 될 수 있는 3가지 비호환 사항, 그리고 4개 모델의 용도별 구분까지 영상을 보지 않은 분들도 이해할 수 있는 형태로 정리합니다.
7월 24일에 발표된 3종 세트
공개된 것은 모델 본체만이 아닙니다. 첫 번째는 모델 본체, 두 번째는 effort 파라미터의 공식 문서, 세 번째는 이전 가이드로, 이 세 가지가 같은 날 모두 나왔습니다. 이전 가이드에는 후술할 3가지 비호환 사항이 정리되어 있습니다. 세 가지가 같은 날 발표된 것은 이전까지의 경로를 한 번에 보여주고 싶었기 때문이라고 생각됩니다.
기한도 하나 설정되어 있습니다. 2세대 전 모델인 Opus 4.1이 2026년 8월 5일에 서비스 종료될 예정입니다. 이전 세대인 4.8은 계속 유지되므로, 급하게 대응이 필요한 경우는 4.1을 운영 환경(production)에서 사용하고 있는 케이스뿐입니다.
가격은 그대로인데 내용물이 바뀌었다
요금은 공식 요금표에서 확인할 수 있습니다. 입력은 100만 토큰당 5달러, 출력은 25달러입니다. Opus 4.8과 동일한 금액이며, 최상위 모델인 Fable 5(입력 10달러 / 출력 50달러)의 정확히 절반입니다. 컨텍스트(context)는 100만 토큰, 최대 출력은 12만 8천 토큰입니다.
위치 선정의 변화가 이번 발표의 핵심입니다. 공식 문서는 "복잡한 코딩과 기업 업무는 우선 Opus 5부터"라고 안내하고 있으며, 최상위 모델이 아닌 절반 가격의 모델이 사실상의 권장 기본값(default)이 되었습니다.
성능에 대해서는 사내 벤치마크에서 4.8의 2배 이상, 코딩 테스트에서는 max 설정 시 최상위 모델과의 차이가 0.5% 이내라고 합니다. 다만, 이 수치들은 모두 Anthropic 자체 측정값이라고 공식적으로 명시되어 있습니다. 중립적인 제3자에 의한 측정이 아니라는 점은 유의할 필요가 있습니다.
간과하기 쉬운 점은 지식의 최신성입니다. 공식 비교표에 따르면, Opus 5의 지식 컷오프(knowledge cutoff)는 2026년 5월입니다. 상위 모델인 Fable 5는 2026년 1월로, 역전되어 있습니다. 최신 라이브러리를 다루는 작업이라면, 더 저렴한 모델이 정답을 맞힐 가능성이 있습니다.
참고로, SWE-bench Verified에서 96~97%라는 수치나 파라미터 수의 오픈 웨이트(open weights) 공개에 관한 이야기도 돌고 있으나, 공식 발표나 문서에서 관련 내용을 찾을 수 없었습니다. 이 기사에서도 사실로 다루지 않습니다.
effort — 지능과 요금을 5단계로 결정
effort는 한 번의 응답에 토큰을 얼마나 사용할지를 지정하는 설정입니다. 공식 문서에서는 low / medium / high / xhigh / max의 5단계로 나뉘며, Opus 5는 이 모든 단계에 대응합니다. 기본값은 high이며, high라고 명시하는 것과 생략하는 것은 동일하게 동작합니다.
효과가 나타나는 방식에는 특징이 있습니다. 효과가 적용되는 것은 사고(thinking) 부분뿐만 아니라, 응답 문장과 도구 호출(tool calling) 횟수를 포함한 모든 토큰입니다. 즉, effort를 낮추면 단순히 생각하는 양이 줄어들 뿐만 아니라, 작업 방식 자체도 변하게 됩니다.
공식 권장 사항은 코딩과 에이전트 용도는 xhigh부터, 그 외의 지적 작업은 high부터 사용하는 것입니다. low와 medium은 이전 세대인 Opus보다 성능이 강화되었기 때문에, 요금과 시간 조절을 위해 적극적으로 사용해도 좋다고 합니다.
주의사항도 같은 페이지에 기재되어 있습니다.
- 이전 모델에서 정한 설정을 그대로 가져오지 말고, 평가 세트(evaluation set)에서 다시 조정할 것
- 대화 도중에 effort를 전환하면 프롬프트 캐시(prompt cache)가 작동하지 않음
- xhigh / max 사용 시에는 max_tokens를 6만 4천 토큰 이상 확보할 것
Claude Code에서도 사용할 수 있습니다. 현재 보유 중인 버전 2.1.219에서는 실행 시 claude --effort xhigh와 같이 지정할 수 있으며, 설정 파일의 effortLevel을 통해 기본값으로 설정할 수도 있습니다. 또한, 메뉴에 있는 ultracode는 6번째 단계가 아니라, xhigh에 여러 에이전트의 상시 허용을 추가한 것이라고 공식 문서에 기재되어 있습니다.
이전 시의 3가지 비호환 사항과 400 에러
모델 이름만 바꾸는 것으로는 이전할 수 없습니다. 이전 가이드에는 3가지 비호환 사항이 나열되어 있습니다.
첫 번째, 사고 (thinking) 기능이 기본적으로 활성화되었습니다. 여기서 중요한 점은 max_tokens의 의미가 변화했다는 것인데, 이제는 사고(thinking)와 응답문의 합계에 대한 상한선이 됩니다. 사고 과정이 없다는 전제로 토큰을 제한하면, 에러는 발생하지 않지만 답변이 중간에 끊기게 됩니다.
두 번째, thinking을 비활성화할 수 있는 조건이 생겼습니다. effort가 high 이하인 경우에는 기존처럼 끊기지만, xhigh 또는 max와 조합하면 400 에러와 함께 거부됩니다.
세 번째, budget_tokens가 지원되지 않게 되었습니다. 사고량을 토큰 수로 직접 지정하는 방식은 사용할 수 없으며, effort로 일원화되었습니다. 이 설정이 남아 있으면 400 에러가 발생합니다.
프롬프트 측면의 변경 사항도 두 가지 안내되었습니다. Opus 5는 4.8보다 설명이 길어지는 경향이 있으므로, 간결함이 필요하다면 명시적으로 지시해야 합니다. 그리고 "검증하고 답해줘"라는 지시는 삭제할 것을 권장합니다. 모델 스스로 검증하도록 바뀌었기 때문입니다.
안전 측면의 동작도 변경되었습니다. 위험한 요청을 거절할 때는 stop_reason에 refusal가 반환되며, cyber나 bio와 같은 분류가 붙습니다. fallbacks를 default로 설정해 두면, 거절된 요청을 다른 모델로 자동 재실행할 수 있습니다 (베타 기능).
이 외에도 Priority Tier와 프리필(prefill)이 지원되지 않으며, 토크나이저(tokenizer)는 4.8과 동일하다는 등의 세부적인 차이점도 있습니다. 8월 5일 Opus 4.1 종료를 앞두고 있다면, 이번 주가 설정을 점검할 적기입니다.
4개 모델 비교: 무엇을 어떻게 사용할 것인가
| Opus 5 | Fable 5 | Opus 4.8 | Mythos 5 | |
|---|---|---|---|---|
| 요금 (입력/출력 100만 토큰) | $5 / $25 | $10 / $50 | $5 / $25 | Fable 5와 동일 |
| ... |
Mythos 5만 성격이 다르며, 방어 보안용 초대제 모델로 공식 문서에 신청 창구가 없다고 명시되어 있습니다. 보안 측면에서는 취약점을 찾아내는 능력은 동등하지만, 공격 코드를 구성하는 능력은 크게 떨어진다고 공식 발표 자체에서 밝히고 있습니다.
단계 지정 메커니즘은 Anthropic만의 것이 아닙니다. OpenAI에는 reasoning effort가 none부터 max까지 7단계가 있으며, Google의 Gemini 3계열에도 thinking_level이 있습니다. 다만 단계의 수와 기본값(default)이 일치하지 않기 때문에, 타사로 이식할 때는 이름이 아니라 평가 세트(evaluation set)에서의 동작을 기준으로 맞춰야 합니다.
가격이 절반인 모델을 기본으로 삼은 이유는 에이전트(agent)를 장시간 구동하는 것을 전제로 하기 때문이라고 생각됩니다. 오래 구동할수록 토큰은 쌓이게 되므로, 단가가 절반이라면 같은 예산으로 두 배의 시간을 구동할 수 있습니다 (이 부분은 영상에서의 해석입니다).
흔한 오해 5가지와 향후 전망
- "절반 가격이니 상위 모델의 하위 호환이다" — 지식 컷오프(knowledge cutoff)는 Opus 5가 더 최신이며, 역전되었습니다.
- "effort는 3단계다" — 공식 문서는 5단계입니다. xhigh와 max를 모르면 성능을 완전히 끌어낼 수 없습니다.
- "모델명만 바꾸면 이전 완료" — budget_tokens가 남아 있으면 400 에러가 발생합니다.
- "effort를 낮추면 단순히 저렴해진다" — 도구 호출(tool call) 횟수도 줄어들며, 진행 방식 자체가 바뀝니다.
- "단계 지정은 Anthropic만의 신기능이다" — 3사 모두 공식 문서에 유사한 설정이 있습니다.
향후 전망도 한 가지 있습니다. 3사 모두 단계 지정을 가지고 있는 이상, 다음 경쟁은 "사용자가 단계를 선택하는 것"에서 "태스크의 난이도를 보고 모델 측이 자동으로 결정하는 것"으로 옮겨갈 것으로 보고 있습니다. 2026년 말까지 어떤 주요 벤더도 자동 선택 기능을 내놓지 않는다면, 이 예측은 틀린 것이 됩니다.
전체를 관통하는 관점은 하나입니다. 오늘은 모델을 다시 고르는 날이 아니라, effort를 결정하고 이전하는 날입니다.
출처
- Claude Opus 5 공식 발표
- 모델 목록·비교표 (요금 / 지식 컷오프)
- effort 파라미터
- 이전 가이드 (비호환 3점 / fallbacks)
- OpenAI reasoning effort
- Google Gemini thinking_level
이전 체크리스트와 effort 결정 방법은 영상에서 도해와 함께 순차적으로 확인할 수 있습니다.
이 채널에서는 평일과 토요일에 각 테마의 주간 요약을, 큰 발표가 있는 날에는 이러한 특집을 게시하고 있습니다. 괜찮으시다면 영상도 확인해 주세요.
Discussion

AI 자동 생성 콘텐츠
본 콘텐츠는 Zenn AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기