NEAR AI가 Lean Eval v1에서 1위를 차지하다
요약
NEAR AI가 형식화 문제 활성 벤치마크인 Lean Eval v1에서 최고 성능을 기록했습니다. 이 시스템은 오픈 웨이트 DeepSeek V4.1 Flash를 기반으로 구동되어 비용 효율적이며, NEAR Protocol의 핵심 계약 검증 도구로 활용될 예정입니다.
핵심 포인트
- NEAR AI가 형식화 벤치마크 Lean Eval v1에서 1위를 달성했습니다.
- 오픈 웨이트 DeepSeek V4.1 Flash를 사용하여 비용 효율성을 확보했습니다.
- NEAR Protocol의 코드 검증 기반을 마련하는 데 기여할 것입니다.
NEAR AI는 극도로 어려운 형식화 문제의 활성 벤치마크인 Lean FRO의 Lean Eval v1에서 현재 1위를 기록했습니다.
이 시스템은 거의 전적으로 오픈 웨이트 DeepSeek V4.1 Flash로 구동되므로, 비용이 낮고 제3자 모델에 대한 의존성이 없습니다.
본 연구는 NEAR Protocol과 핵심 계약을 형식적으로 검증하기 위한 기반을 마련하며, 모든 팀이 자신들의 코드를 검증하는 데 사용할 수 있는 도구의 역할을 할 것입니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 X 토픽: 오픈소스 LLM의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기