
Claude Opus 5 출시 — Fable 5에 육박하는 성능을 절반 가격으로, thinking 기본 ON 설정으로 파괴적 변경 포함
요약
Anthropic이 성능과 가격 경쟁력을 대폭 강화한 Claude Opus 5를 출시했습니다. Thinking 기능이 기본 활성화되는 파괴적 변경과 함께 미드 세션 도구 변경, 자동 폴백, 프롬프트 캐시 최소 길이 단축 등 주요 신기능이 포함되었습니다.
핵심 포인트
- Fable 5급 성능을 기존 Opus 4.8과 동일한 가격으로 제공
- Thinking 기능이 기본 ON으로 설정되어 파괴적 변경 포함
- 대화 중간에 도구 구성을 변경할 수 있는 미드 세션 도구 변경(beta) 지원
- 안전 분류기 거부 시 Anthropic 권장 모델로 자동 전환되는 Fallbacks 기능 추가
- 프롬프트 캐시 최소 길이를 1,024에서 512 토큰으로 단축
- 2026년 7월 24일, Anthropic이 Claude Opus 5 (모델 ID:
claude-opus-5)를 출시했다. 가격은 Opus 4.8과 동일한 $5 / $25 per MTok을 유지하면서, Fable 5($10/$50)에 육박하는 성능을 절반 가격으로 제공한다는 포지셔닝이다. - thinking이 기본적으로 ON 설정되었다 (Opus 4.8은 명시하지 않으면 OFF). 또한
thinking: {type: "disabled"}는 effort가high이하일 때만 허용되며,xhigh/max와 조합하면 400 에러가 발생하는 새로운 제약이 추가되었다. 신기능은 3가지다. 대화 도중에 캐시를 깨뜨리지 않고 도구 구성을 변경할 수 있는 미드 세션 도구 변경 (mid-session tool change) (beta), 안전 분류기에 걸린 요청을 자동으로 다른 모델로 넘기는 Automatic Fallbacks, 프롬프트 캐시(prompt cache)의 최소 길이 단축 (1024→512 토큰) `
대화 턴(turn) 사이에서 프롬프트 캐시(prompt cache)를 무효화하지 않고 도구(tool)를 추가하거나 삭제할 수 있습니다. 기존에는 세션 시작 시 고정된 도구 리스트를 마지막까지 계속 사용해야 했으나, 베타 헤더 mid-conversation-tool-changes-2026-07-01을 추가함으로써 중간 변경이 가능해졌습니다. 이는 장시간의 에이전틱 (agentic) 세션에서 도구 세트를 동적으로 좁히고 싶을 때 효과적입니다.
fallbacks 파라미터에 새로운 "default" 모드가 추가되었습니다. 기존(server-side-fallback-2026-06-01 헤더)에는 폴백(fallback) 대상 모델 리스트를 직접 명시해야 했지만, server-side-fallback-2026-07-01 헤더를 사용하면 거부 카테고리별로 Anthropic이 권장하는 폴백 모델을 자동으로 적용할 수 있습니다. API 이용 시, 안전 분류기(safety classifier)에 걸린 요청이 에러로 끝나는 대신 기능적인 응답을 반환할 수 있게 됩니다.
캐시 가능한 최소 프롬프트 길이가 Opus 4.8의 1,024 토큰에서 512 토큰으로 낮아졌습니다. 지금까지 캐시 대상이 되지 않았던 짧은 프롬프트도 코드 변경 없이 캐시 엔트리(cache entry)를 생성할 수 있게 됩니다.
이번 릴리스에서 실무에 가장 유용하게 작용하는 부분은 바로 여기입니다.
Opus 4.8에서는 thinking 필드를 지정하지 않으면 사고(thinking) 없이 작동했지만, Opus 5에서는 동일한 요청이 thinking이 활성화된 상태로 작동합니다. 와이어(wire) 상의 값은 변하지 않았으며, thinking: {type: "adaptive"}는 계속해서 유효하며 기본값과 동일한 지정으로 사용할 수 있습니다.
max_tokens는 사고 토큰과 응답 텍스트의 합계에 대한 상한선이므로, Opus 4.8에서 thinking이 없음을 전제로 아슬아슬하게 max_tokens를 설정했던 워크로드(workload)는 사고 과정에서 토큰을 소모하여 응답이 중간에 끊길 가능성이 있습니다.
이것은 공식적인 파괴적 변경(breaking change)으로 명시되어 있습니다. thinking: {type: "disabled"}는 effort가 high 이하일 때만 허용되며, xhigh 또는 max와 조합하면 400 에러가 발생합니다. Opus 4.8에서는 thinking의 활성화 여부와 effort 레벨이 독립적이었으나, Opus 5에서는 이 조합에 제약이 생겼습니다.
# Opus 5에서는 400 에러 발생
client.messages.create(
model="claude-opus-5",
...
문서에 명시된 바에 따르면, thinking을 비활성화한 상태에서는 Opus 5가 도구 호출(tool call)을 tool_use 블록이 아닌 텍스트 출력 내에 작성하거나, 내부용 XML 태그가 응답에 섞여 나올 수 있습니다. 기본적으로는 thinking을 활성화한 상태에서 effort로 조정하는 것이 권장되며, 반드시 비활성화해야 하는 통합 환경에서는 프롬프트 측면의 완화책이 필요합니다.
응답이 길어지는 경향: 기본적으로 사용자 대상 응답 및 결과물이 전반적으로 길어집니다.
진행 상황 내러티브(narrative) 증가: 에이전틱 (agentic) 세션 중 중간 과정 보고가 증가합니다.
서브 에이전트로의 위임이 더욱 적극적으로 변합니다.
지시하지 않아도 스스로 검증하게 되었습니다: "마지막에 검증 단계를 넣어줘", "서브 에이전트로 확인시켜줘"와 같은 구모델 대상 지시가 Opus 5에서는 과잉 검증을 유발하는 요인이 됩니다. 마이그레이션 시에는 이러한 종류의 프롬프트를 점검하고 덜어낼 가치가 있습니다.
low / medium / high / xhigh / max의 전체 단계(ladder)를 사용할 수 있으며, 기본값은 high입니다. 문서에서는 "그 어떤 Opus 모델보다 확실하게 추가적인 effort를 결과로 변환한다"라고 설명하고 있어, effort 선택이 이전보다 더욱 중요해졌습니다. xhigh나 max로 실행할 경우에는 max_tokens를 넉넉하게 확보해 두어야 합니다.
공식 발표에서 제시된 주요 수치들입니다.
- Frontier-Bench v0.1: 모든 모델 중 최고, Opus 4.8의 2배 이상
- ARC-AGI 3: 차점 모델의 3배 점수
- Zapier AutomationBench: 차점 대비 1.5배의 통과율 (Pass rate)
- 유기 화학 태스크 (Organic chemistry tasks): Opus 4.8 대비 +10.2포인트
- 단백질 관련 태스크 (Protein-related tasks): Opus 4.8 대비 +7.7포인트
안전성 측면에서는 ASL-3(화학·생물학적 리스크 기인)는 Opus 4.8과 동일하게 유지되지만, 안전성 분류기 (Safety classifier)의 발화 빈도는 Fable 5 대비 85% 적을 것으로 예상된다.
Opus 4.8의 API를 이용 중인 경우, 모델 ID를 교체하기 전에 확인해야 할 항목들:
- 모델 문자열을
claude-opus-4-8에서claude-opus-5로 변경 - 만약
effort를thinking: {type: "disabled"}와effort: xhigh또는max를 병용하고 있다면, 이를high이하로 낮추거나thinking을 활성화된 상태로 유지할 것.thinking이 기본 ON(Default ON)으로 바뀐 만큼, 사고 토큰 (Thinking tokens)에 의해 소비될 여지를 고려하여max_tokens를 재검토할 것 - "검증 단계를 넣어줘" 계열의 프롬프트를 정리할 것. Opus 5는 지시 없이도 자기 검증 (Self-verification)을 수행하므로, 과도한 검증의 원인이 되기 쉽다
- Fast mode를 사용 중이라면 플랫폼을 확인할 것. 현재는 Claude API로 한정되며, Bedrock, Google Cloud, Microsoft Foundry는 지원되지 않는다
Claude Code나 claude.ai 측은 특별히 조치하지 않아도 새 모델의 혜택을 받을 수 있지만, API를 직접 호출하고 있다면 이 체크리스트를 한 번쯤 확인해 두는 것이 좋다.
Opus 5를 한마디로 요약하자면, **"가격은 유지하면서 Fable 5에 육박하는 성능을 가져온 대신, thinking 관련 동작과 effort의 제약을 변경한 릴리스"**이다.
- 가격은 Opus 4.8과 동일($5/$25 per MTok)하게 유지되면서 성능은 대폭 향상
thinking이 기본 ON으로 변경.disabled설정은effort: high이하로 제한되는 새로운 제약 사항 적용- 미드 세션 툴 변경 (Mid-session tool changes), 자동 폴백 (Automatic Fallbacks), 캐시 최소 길이 하향 조정의 3가지 신기능 도입
주시해야 할 점은, thinking: disabled와 xhigh/max 조합을 사용하는 코드가 있는지라는 단 한 가지 포인트에 집중된다. 이를 간과하면 Opus 4.8 시절에 잘 작동하던 요청이 Opus 5로 전환하는 것만으로 400 에러를 발생시킬 수 있다.
이 기사는 Zenn에도 동일한 내용으로 게시되어 있습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Qiita AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기