Artificial Analysis의 Task Success Rate 리더보드에서 Grok Voice가 1위를 차지하다
요약
Grok Voice가 Artificial Analysis의 Task Success Rate 리더보드에서 1위를 차지했습니다. Grok Voice Think Fast 2.0 (High)는 94.6%라는 높은 성공률을 기록하며, GPT-Live/Astra, Gemini Live 등 다른 주요 모델들을 능가하는 성과를 보였습니다.
핵심 포인트
- Grok Voice가 Task Success Rate 리더보드에서 1위를 차지함.
- 성능 측정은 단순 음성이 아닌, 최종 도구 호출을 포함한 과제 성공 여부를 측정함.
- 94.6%의 높은 성공률로 경쟁 모델들을 능가하는 성과를 보임.
Grok Voice가 Artificial Analysis의 Task Success Rate 리더보드에서 1위를 차지했습니다.
Grok Voice Think Fast 2.0 (High)는 94.6%를 기록하며,
GPT-Live/Astra, Gemini Live, GPT-Realtime 및 리더보드의 모든 다른 모델들을 능가했습니다.
이 벤치마크는 단순히 음성이 얼마나 좋은지를 측정하는 것이 아니라, 음성 에이전트가 올바른 최종 도구 호출(tool call)과 함께 과제를 성공적으로 완료했는지 여부를 실제로 측정합니다.
Grok이 1위로 선두를 달리고 있습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 X 토픽: Benchmark의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기