
단 두 개의 연구소만이 작업당 시간 (Time per Task) 파레토 프런티어를 점유하고 있습니다: 2분 미만의 모든 프런티어 모델은
요약
Artificial Analysis의 지표를 통해 모델의 지능 지수와 작업당 소요 시간(Time per Task) 사이의 트레이드오프를 분석합니다. 현재 파레토 프런티어는 OpenAI와 Anthropic 두 연구소가 주도하고 있습니다.
핵심 포인트
- 작업당 2분 미만 구간의 프런티어 모델은 모두 OpenAI 제품임
- 2분 이상의 구간에서는 Anthropic 모델이 6개 중 4개를 차지함
- 작업당 시간은 출력 속도, 추론 최적화, 모델 아키텍처의 영향을 받음
- 지능 지수 25점 이상의 모델만을 대상으로 분석함
단 두 개의 연구소만이 작업당 시간 (Time per Task) 파레토 프런티어 (Pareto frontier)를 점유하고 있습니다: 2분 미만의 모든 프런티어 모델은 OpenAI 제품이며, 6개 중 4개는 Anthropic 제품입니다.
우리는 Artificial Analysis 지능 지수 (Intelligence Index)와 해당 지수 내의 대표적인 작업을 완료하는 데 모델이 소요되는 시간 사이의 트레이드오프 (tradeoff)를 보여줍니다. 우리는 작업당 시간 (Time per Task)을 출력 토큰 (output tokens) 수를 출력 (디코딩) 속도 (output (decode) speed)로 나누어 계산합니다. 작업당 시간 (Time per Task)에 기여하는 요소에는 투기적 디코딩 (speculative decoding)과 같은 추론 최적화 (inference optimizations) 및 모델 아키텍처 (model architecture) 요인 (활성 파라미터 수, 추론량)이 포함됩니다.
작업당 2분 미만인 프런티어 상의 모든 모델은 OpenAI 제품이지만, 그 이상의 구간에서는 6개 중 4개가 Anthropic 모델입니다. Kimi K3 (max)는 Moonshot AI의 자체 API에서의 낮은 출력 속도로 인해 작업당 약 11분이라는 눈에 띄게 높은 시간을 기록했습니다.
참고: 차트는 Artificial Analysis 지능 지수 (Intelligence Index)에서 25점 이상을 기록한 모델만 보여줍니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 X 토픽: Claude/Anthropic의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기