
CLAUDE OPUS 5 출시. Anthropic이 만드는 가장 똑똑한 모델은 아니지만, 그것이 바로 핵심입니다.
요약
Anthropic이 새로운 모델인 Claude Opus 5를 출시했습니다. 이 모델은 최고 지능을 지향하기보다 비용 효율성과 작업 완수 능력에 초점을 맞추어, 이전 모델 대비 다양한 산업 분야에서 성능 향상을 보였습니다.
핵심 포인트
- Opus 4.8 대비 실사, 생명과학, 기술 등 전 분야 성능 향상
- 단순 지능 향상이 아닌 누락 없는 작업 완수 능력 강화
- 노력 토글(effort toggle) 기능을 통한 지능과 비용의 유연한 조절
- 사용자 개입 없는 자가 검증 및 오류 복구 기능 탑재
CLAUDE OPUS 5가 출시되었습니다. Anthropic이 만드는 가장 똑똑한 모델은 아니지만, 그것이 바로 핵심입니다.
이 모델은 절반의 가격으로 Fable 5의 지능에 근접합니다.
Box가 자사의 기업용 에이전트 벤치마크 (enterprise agent benchmark)를 통해 테스트를 진행했습니다. Opus 4.8 대비 보고된 성능 향상은 다음과 같습니다:
→ 실사 (Due diligence): +17%
→ 생명 과학 (Life sciences): +30%
→ 기술 (Technology): +19%
→ 헬스케어 (Healthcare): +13%
→ 법률 (Legal): +12%
모든 항목에서 나타나는 패턴은 동일합니다. "더 똑똑한 답변"이 아니라, 누락되는 사항이 줄어든 것입니다.
실사 (due-diligence) 체크리스트에서 Opus 4.8은 명백한 항목들만 잡아내고 멈췄습니다. 반면 Opus 5는 전체 리스트를 완수했습니다.
여기 주목할 부분이 있습니다.
이 모델은 저(low), 중(medium), 고(high)로 설정 가능한 노력 토글 (effort toggle) 기능을 탑재하여, 필요에 따라 지능과 비용을 맞교환할 수 있습니다. Anthropic은 이 모델이 사용자의 개입 없이 스스로 작업 내용을 검증하고 오류를 복구한다고 밝히고 있습니다.
이것은 벤치마크를 위한 기능이 아닙니다. 청구서 (bill)를 위한 기능입니다.
Fable 5는 토큰 예산 (token budgets)을 과도하게 소모한다는 비판을 받았습니다. Opus 5는 그 불만에 대한 해답입니다.
모두가 여전히 가장 똑똑한 모델을 쫓고 있습니다.
이제 진짜 싸움은 어떤 모델이 당신의 계좌를 바닥내지 않고 업무를 완수하느냐에 달려 있습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 X @thewhizzai (자동 발견)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기