
GOOGLE, 기존 모델보다 2배 빠르고 18% 저렴하며 성능은 동일한 모델 출시
요약
Google이 기존 모델과 동일한 성능을 유지하면서 속도는 2배 빠르고 비용은 18% 저렴한 신규 모델을 출시했습니다. 이번 모델은 추론 능력을 측정하는 에이전트형 지식 노동 벤치마크에서 큰 폭의 성능 향상을 보였습니다.
핵심 포인트
- 기존 모델 대비 처리 속도 2배 향상 및 비용 18% 절감
- 종합 점수는 동일하나 에이전트형 벤치마크 점수 95포인트 상승
- 단순 지능을 넘어 긴 단계의 추론 과정을 수행하는 능력 강화
GOOGLE이 기존 모델과 똑같이 똑똑하면서도 2배 더 빠르고 18% 더 저렴한 모델을 출시했습니다.
동일한 점수. 이전 모델과 동일한 50점을 기록했습니다.
Reddit에서는 이를 실패라고 부르고 있습니다. 잘못된 판단입니다.
작업 시간은 2.7분에서 1.3분으로 단축되었습니다. 작업당 비용은 18% 감소했습니다.
지능은 동일하지만, 대기 시간은 절반으로 줄었고, 비용은 더 적게 듭니다.
여기서 주목해야 할 부분이 있습니다.
에이전트형 지식 노동 벤치마크 (agentic knowledge-work benchmark)에서 점수가 95포인트 상승했습니다. 이 수치는 종합 점수 (composite score)에는 영향을 주지 않습니다.
이 지표는 추론 (reasoning) 능력을 측정합니다. 모델이 무너지지 않고 긴 단계의 과정을 완료할 수 있는지 여부를 측정하는 것이 아닙니다.
모두가 여전히 모델이 얼마나 똑똑하게 들리는지로 순위를 매기고 있습니다.
이제 중요한 것은 모델이 무너지기 전까지 얼마나 많은 단계를 완료할 수 있느냐입니다.
[IMG:1]
AI 자동 생성 콘텐츠
본 콘텐츠는 X @thewhizzai (자동 발견)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기