
Prime Agent - Codex/CC/PI를 능가하는 새로운 코딩 하네스 (harness)
요약
Prime Agent는 코딩 및 장기적 자율 작업을 위해 설계된 오픈 소스 자기 개선형 RLM 하네스입니다. 도구 호출과 멀티 에이전트 메시징을 통해 토큰 효율성을 높였으며, ARC-AGI-3 벤치마크에서 인간 전문가 수준의 성능을 입증했습니다.
핵심 포인트
- 코딩 및 장기적 작업을 위한 오픈 소스 에이전트
- 도구 호출 및 멀티 에이전트 메시징을 통한 토큰 효율성 확보
- ARC-AGI-3에서 95.5%를 기록하며 인간 전문가 기준선 돌파
- 자기 수정 가능한 하네스 상태를 통한 성능 개선
Prime Agent는 일반적이고 장기적인 작업을 위한 오픈 소스 코딩 및 연구 에이전트입니다. 코딩 및 장기적인 자율 작업을 위한 자기 개선형 RLM 하네스 (harness)입니다. 프로그래밍 방식의 도구 호출 (tool calling), 변수로서의 컨텍스트 (context), 멀티 에이전트 메시징 (multi-agent messaging), 그리고 자기 수정 가능한 하네스 상태 (harness state)를 통해 토큰 효율성과 표현력을 모두 갖추도록 설계되었습니다. ARC-AGI-3에서 95.5%의 점수를 기록하며 인간 전문가 기준선 (human-expert baseline)을 넘어섰으나, 이러한 이점은 특정 벤치마크에 국한되지 않습니다. 우리는 독점적 하네스 (proprietary harnesses)와 비교했을 때 모델 전반에 걸쳐 주요한 개선 사항을 확인했습니다. Prime Agent는 pi를 기반으로 구축되었으며, 오픈 라이선스를 가진 완전한 오픈 소스입니다. GitHub: https://github.com/PrimeIntellect-ai/prime-agent Blog: https://www.primeintellect.ai/blog/prime-agent X post: https://x.com/primeintellect/status/2085086999267144083?s=46 submitted by /u/ResearchCrafty1804 [link] [comments]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/LocalLLaMA의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기