이번 주 Claude Sonnet 5.5, GPT-6.1 Sol, Gemini 4 Argon이 Coding Agent Index 리더보드
요약
최근 출시된 Claude Sonnet 5.5, GPT-6.1 Sol, Gemini 4 Argon 세 가지 코딩 에이전트가 Coding Agent Index 리더보드 상위권을 차지했습니다. 각 모델은 성능과 비용 효율성 측면에서 서로 다른 강점을 보였습니다.
핵심 포인트
- Claude Sonnet 5.5는 최고 점수(68점)를 기록했으나, 가장 높은 비용($14.19/태스크)이 발생했습니다.
- Gemini 4 Argon은 낮은 비용($5.84/태스크)으로 준수한 성능(64점)을 보여주었습니다.
- GPT-6.1 Sol은 매우 저렴한 비용($1.04/태스크)으로 경쟁력 있는 점수(63점)를 기록했습니다.
이번 주에는 Claude Sonnet 5.5, GPT-6.1 Sol, Gemini 4 Argon 모두 Coding Agent Index 리더보드의 상단 근처에서 출시되었지만, 각각은 성능과 비용 면에서 다른 균형을 가지고 있습니다.
Artificial Analysis Coding Agent Index는 세 가지 에이전트 코딩 평가를 통해 에이전트(모델과 하네스 조합)를 측정합니다.
➤ Claude Sonnet 5.5 (max)가 Claude Code에서 68점으로 최고 순위를 차지했지만, 태스크당 가장 높은 비용을 기록했습니다: $14.19
➤ Gemini 4 Argon (high)이 Antigravity CLI에서 64점을 $5.84/태스크로 기록했는데, 이는 Sonnet 5.5 비용의 절반에도 미치지 못합니다. 참고로, 이 가격은 Google의 프로모션 가격을 사용한 것이며, Argon은 아직 공개적으로 사용할 수 없습니다.
➤ GPT-6.1 Sol (xhigh)이 Codex에서 63점을 $1.04로 기록했는데, 이는 Argon 비용의 약 6분의 1 수준입니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 X 토픽: OpenAI/GPT/Codex의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기