
Frontis-MA1 (35B), MLE-Bench Lite에서 GPT-5.5 + Codex를 능가하다
요약
Frontis-MA1 (35B) 모델이 MLE-Bench Lite 벤치마크에서 GPT-5.5와 Codex의 성능을 능가했습니다. 이 모델은 OpenMLE 시스템을 통해 학습된 메타 진화 에이전트로, 머신러닝 엔지니어링을 위한 재귀적 자기 개선 능력을 갖추고 있습니다.
핵심 포인트
- Frontis-MA1 (35B)가 MLE-Bench Lite에서 GPT-5.5 + Codex를 능가함
- OpenMLE 시스템을 통해 학습된 메타 진화 에이전트 모델
- 35B 파라미터 버전이 71.21%의 메달 평균 달성
- 재귀적 자기 개선을 위한 오픈 풀스택 시스템 기반
Frontis-MA1 (35B)가 MLE-Bench Lite에서 GPT-5.5 + Codex를 능가했습니다.
Frontis-MA1은 머신러닝 엔지니어링 (Machine Learning Engineering)의 재귀적 자기 개선 (Recursive Self-improvement)을 위한 오픈 풀스택 시스템인 OpenMLE에서 학습된 메타 진화 에이전트 (Meta-evolution Agent)입니다. 이 모델의 35B 파라미터 버전은 71.21%의 메달 평균 (Medal Average)에 도달하며, 조 단위 규모 (Trillion-scale)의 시스템에 근접하고 있습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 X @huggingpapers (검증됨)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기