
각 모델군별 최고 모델 비교: 순 개선 점수 및 작업당 중앙 비용 기준
요약
본 기사는 주요 모델군(GPT, Claude 등)의 최고 성능 모델들을 '순 개선 점수'와 '작업당 중앙 비용'을 기준으로 비교 분석했습니다. GPT-6 Astra와 Claude Fable 5.1이 높은 성능 향상과 함께 상대적으로 높은 운영 비용을 보이는 것이 특징입니다.
핵심 포인트
- 모델군별 최고 모델의 성능 개선 점수 및 비용 구조를 비교함.
- GPT-6 Astra는 +11.7% 개선점수와 $3.94/task 비용을 가짐.
- Claude Fable 5.1은 +13.7% 개선점수와 $4.40/task 비용으로 가장 높음.
우리는 각 모델군(family)의 최고 모델들을 순 개선 점수(net improvement score)와 작업당 중앙 비용(median cost per task)을 기준으로 비교했습니다. 여기서 모델군은 동일한 모델 기본 이름 내의 변형들로 정의됩니다.
GPT-6 Astra와 Claude Fable 5.1이 두드러집니다: 이들은 상대적으로 근접한 성능에도 불구하고 각 연구소의 다른 모델들보다 훨씬 높은 비용을 차지합니다.
@OpenAI에 의해:
- GPT-6 Astra (Max): +11.7% | $3.94/task
- GPT-5.6 Sol (xHigh): +7.0% | $1.03/task
@AnthropicAI에 의해:
- Claude Fable 5.1 (Max): +13.7% | $4.40/task
- Claude Opus 5 (High): +10.2% | $2.07/task
AI 자동 생성 콘텐츠
본 콘텐츠는 X 토픽: Claude/Anthropic의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기