올해 AI 에이전트에 관한 가장 유용한 논문일 수 있습니다.
요약
Wavestone AI Lab은 다양한 에이전트들을 분석하여, 모든 좋은 에이전트가 공통적으로 갖는 7가지 핵심 구성 요소의 청사진을 제시했습니다. 이 구조는 모델(model)과 하네스(harness)로 정의되며, 각 부품의 역할과 구현 방식을 상세히 설명합니다.
핵심 포인트
- 에이전트는 '모델'과 이를 감싸는 '하네스'로 구성됩니다.
- 핵심 7가지 요소: Loop, LLM layer, Tools, Memory, Safety, Orchestration, Extensions입니다.
- 제시된 청사진은 90줄짜리 하네스로, 에이전트 구축의 견고한 출발점을 제공합니다.
- 각 부품별로 구체적인 구현 예시와 설계 권장 사항을 담고 있습니다.
Wavestone AI Lab의 팀이 Claude Code, Codex 및 9가지 이상의 모델을 분석하여 모든 좋은 에이전트가 구축되는 7가지 부분으로 이루어진 청사진을 발견했습니다.
그들의 정의는 다음과 같습니다: 에이전트는 모델(model)과 하네스(harness)입니다. 이 11개의 모든 에이전트는 동일한 7가지 부품으로 하네스를 구축합니다. 크기만 다를 뿐입니다.
Loop: Mini-SWE-Agent는 단순한 while loop입니다. OpenHands는 모든 이벤트를 기록하여 실행을 재현할 수 있게 합니다.
LLM layer: 한쪽에는 프롬프트 템플릿(prompt template)이, 다른 쪽에는 29개의 제공자 프로필(provider profiles)이 있습니다.
Tools: 일부 에이전트는 bash만 가지고 있지만, 가장 큰 것은 43개의 타입 지정 도구(typed tools)를 온디맨드(on demand)로 로드합니다.
Memory: 전체 기록을 유지하는 것부터 세션 전반에 걸쳐 에이전트가 유지하는 메모까지 다양합니다.
Safety: 간단한 단계 제한에서 정책 규칙(policy rules), 검토자 모델(reviewer model), OS 샌드박스(OS sandbox)를 포함할 수 있습니다.
Orchestration: Aider는 의도적으로 서브 에이전트(sub-agents)를 건너뛰고, 다른 에이전트들은 자체 컨텍스트로 이를 포크합니다.
Extensions: hooks, skills 및 MCP. SKILL.md는 11개 중 9개에서, MCP는 8개에서 발견됩니다.
논문은 이 7가지 부분을 모두 다루는 90줄짜리 하네스로 끝나며, 이는 자신만의 것을 만들기 위한 견고한 출발점입니다.
주요 페이지:
p.4: 7가지 부분 지도(the 7-part map)
p.12: Claude Code와 Codex를 예시로 든 3가지 loop 유형
p.53: 왜 이들 중 어느 것도 프레임워크나 임베딩을 사용하지 않는지
p.67: 18가지 설계 권장 사항(design recommendations)
p.71: 복사할 수 있는 90줄짜리 하네스()
AI 자동 생성 콘텐츠
본 콘텐츠는 X 토픽: AI Agents/MCP의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기