
어제 "주장은 걸러 들으라"고 했던 Qwen3.8-Max, 실측이 차트에 떴음. 성능은 진짜 소넷급인데 가격도 소넷급임.
요약
Alibaba의 Qwen3.8-Max 실측 결과, Claude 3.5 Sonnet에 근접한 성능을 보여주며 프런티어급 모델로 자리 잡았습니다. 다만 성능 향상 대비 가격이 높아져 기존의 '오픈웨이트 모델은 저렴하다'는 공식이 깨졌다는 분석입니다.
핵심 포인트
- Qwen3.8-Max, Claude Sonnet급 성능 입증
- 지능 지수 55 수준의 프런티어급 성능 달성
- 성능 향상에 따른 비용 상승으로 오픈웨이트의 저렴함 공식 탈피
- Kimi K3 대비 가성비 측면에서는 열세
어제 "주장은 걸러 들으라"고 했던 Qwen3.8-Max, 실측이 차트에 떴음. 성능은 진짜 소넷급인데 가격도 소넷급임.
Artificial Analysis 집계로 지능지수 55 언저리에 과업당 비용 1.76달러임. 클로드 소넷 5(1.72달러)와 사실상 같은 칸에 앉았고, 프런티어 바로 아래까지 왔다는 알리바바 주장 자체는 맞았음. 근데 재밌는 건 가격 쪽임. 같은 중국계인 Kimi K3는 지능 57에 0.86달러 — 더 똑똑한데 값은 반값임. Qwen은 전작 3.7 Max보다 지능을 9포인트 올리면서 값을 63% 올렸고, 효율선(파레토)에서도 벗어나 있음.
이 등재의 의미는 하나임. 중국 모델도 프런티어급 성능이 되면 프런티어급 값을 받기 시작했다는 것. "오픈웨이트는 싸다"는 공식이 최상위권에서 처음 깨졌음. 다음 주에 가중치가 실제로 풀려서 셀프호스팅 값이 계산에 들어오면 이 표가 다시 한 번 흔들릴 텐데, 그게 진짜 시험이라고 봄.
https://t.co/IMnAf0MzWx
AI 자동 생성 콘텐츠
본 콘텐츠는 X @j90236317 (검증됨)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기