Mistral의 최신 모델 성능 및 시장 경쟁력 분석
요약
Mistral AI가 최신 모델의 성능과 시장 경쟁력을 분석하며, 지능당 달러 효율성 및 여러 전문 분야에서 뛰어난 기술력을 입증했습니다. 특히 오픈 가중치(open weights) 모델로서 유럽 또는 미국 최고의 오픈 모델임을 강조합니다. 법률, 사이버 보안 등 특정 영역에서 현존 최고 수준을 보여주며 주권 AI 시장에서의 강세를 보이고 있습니다.
핵심 포인트
- 지능당 달러 효율성 측면에서 높은 성능 개선을 기록했습니다.
- 오픈 가중치 모델로서 유럽/미국 최고의 경쟁력을 갖추고 있습니다.
- 법률 및 사이버 보안 등 전문 분야에서 최고 수준의 기술력을 입증했습니다.
- 주권 AI 시장에서 강세를 보이며, 210억 달러의 기업 가치를 보유하고 있습니다.
Mistral이 돌아왔습니다:
- 지능당 달러(dollar per intelligence) 측면에서 첨단 기술을 선보입니다 (38. mimo v2.6 pro가 0.13달러에 46점을 기록하여, 이전 대비 개선).
- 유럽 또는 미국에서 가장 뛰어난 오픈 모델입니다 (경쟁 모델: nemotron 3 ultra 23, gemma 4 17, gpt-oss 12).
- gpt 6 luna와 동일한 점수를 받았습니다. luna는 작업당 0.07달러가 소요됩니다. 16배 개선.
-#64/225의 인공 분석(artificial analysis) 분야에서 첨단 기술을 보여줍니다. - GLM 5.3 flash (320B, 0.25달러)보다 3점을 낮은 수준으로 끌어내리는 데 필요한 1조 개의 파라미터 규모를 제시합니다.
- 오픈 가중치(open weights) 모델입니다 (AA는 이를 독점적이라고 분류함. 가중치 공개일: 10월 27일).
- 현재까지 가장 개방적인 라이선스를 보유하고 있습니다 (large 3은 apache 2.0, medium은 3.5 modified mit, 이 모델은 'custom mistral license').
- 최고의 중국 오픈 모델과 단지 8점 차이, opus 5.5와는 20점 차이입니다.
- deepswe에서 glm 5.3을 능가했습니다 (mistral의 차트 기준 62점에서 61점으로 상승. 실시간 리더보드에서는 glm 5.3이 약 69점을 기록 중).
- 법률 분야에서 현존 최고 수준(state of the art)입니다 (15%).
- 모든 모델 중 가장 높은 사이버 점수(82%)를 받았습니다 (opus 5.5와 astra는 해당 작업을 거부하며 점수가 거의 제로에 가까움).
- 동일한 블로그 게시물에서 다른 어떤 오픈 모델보다 더 많은 사이버 프롬프트를 거부한다고 자랑합니다.
- 인덱싱을 실행하는 데 200M의 출력 토큰이 필요하며, 중앙값은 81M입니다. le chonk가 이야기함
-+29점 상승 (large 3은 9점을 기록했음) - 주권 AI(sovereign ai) 분야에서 강세를 보이고 있습니다 (그들은 glm 5.3을 지난 8월부터 재판매해 왔으며, 오늘까지 mistral 자체 플랫폼에서 가장 스마트한 모델은 중국산이었음).
- 30억 유로를 모금했으며, 기업 가치는 210억 달러입니다. 첫 번째 출시된 모델: 38.
-"포화 징후 없음" (RL(강화학습) 실행이 끝나지 않았지만, 어쨌든 출하함). - 밈에서 약속했던 30조 개의 파라미터는커녕, 실제로는 1개만 확보했습니다 (49B 활성).
- mensch가 아부다비에서 말하기를 유럽도 경쟁할 수 있다고 했습니다.
- 자체 블라인드 평가에서 5개 중 2위입니다. opus 5.5보다 낮습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 X 토픽: Benchmark의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기