Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
문서 기반 AI 어시스턴트를 위한 RAG와 Long-Context 아키텍처의 성능 및 비용 효율성을 비교 분석합니다. 롱 컨텍스트 방식이 정확도는 높지만, 토큰 소비로 인한 비용 부담이 매우 크다는 '토큰 세금' 개념을 제시합니다.
VADAOrchestra는 LLM의 유연성과 심볼릭 엔진의 결정론적 특성을 결합한 뉴로심볼릭 프레임워크입니다. Datalog+/-를 활용해 워크플로우를 논리 프로그램으로 인코딩함으로써, 에이전트 시스템의 고질적인 문제인 불투명성과 확장성 제약을 해결합니다.
로컬 7B 모델을 활용하여 Agentic RAG의 구성 요소가 Multi-Hop QA 성능에 미치는 영향을 분석한 절제 연구입니다. 실험 결과, 복잡한 적응형 라우팅보다 단순한 하이브리드 검색과 적절한 검색 반복 횟수가 성능에 더 효과적임을 확인했습니다.
감성 분석의 한계를 극복하기 위해 LLM을 활용하여 고객 지원 대화의 만족도와 구체적인 문제를 측정하는 새로운 방법을 제안합니다. 7만 건의 데이터를 분석한 결과, LLM 기반의 분석이 기존 감성 분석보다 고객 평점과 더 높은 상관관계를 보였습니다.
시맨틱 캐싱 평가 시 PR-AUC가 실제 운영 성능과 불일치하는 문제를 지적합니다. 이를 해결하기 위해 P-CHR AUC와 CRR이라는 새로운 지표를 제안하며, 모델 선택이 순위 매기기가 아닌 캘리브레이션의 문제임을 강조합니다.
AtomMem은 LLM 에이전트의 장기 기억 문제를 해결하기 위해 원자적 사실(Atomic Facts)을 추출하고 관리하는 새로운 메모리 시스템입니다. 계층적 구조와 연상 메모리 그래프를 통해 효율적이고 일관된 에피소드 컨텍스트를 제공합니다.
LLM 에이전트의 검색과 추론을 분리하여 제어력을 높이는 '분리된 검색 그라운딩(DSG)' 아키텍처를 제안합니다. MCP 호환 게이트웨이를 통해 검색 정책과 모델을 분리함으로써 비용 절감, 지연 시간 단축, 그리고 높은 정확도를 동시에 달성할 수 있습니다.
MCP 기반 LLM 에이전트가 답변 시 출처를 잘못 지정하는 '교차 출처 혼동' 문제를 해결하기 위한 ProvenanceGuard를 제안합니다. 이 시스템은 MCP 트레이스를 분석하여 주장을 원자 단위로 분해하고, NLI와 토큰 정렬을 통해 각 주장의 출처 적합성을 검증합니다.
복잡한 작업을 수행하기 위해 여러 기술을 조합하는 '구성적 기술 라우팅' 문제를 해결하기 위한 SkillWeaver 프레임워크를 제안합니다. 작업 분해, 기술 검색, 계획 구성을 결합하여 LLM 에이전트의 도구 활용 능력을 극대화합니다.
합성 데이터 기반의 프롬프트 주입 방어 기제가 실제 기업 문서에서 효과가 낮음을 지적하며, 새로운 정화 파이프라인인 PARSE를 제안합니다. PARSE는 문장별 주입 가능성 분류와 사실 보존 검증을 통해 유용성을 유지하면서 공격 성공률을 낮춥니다.
엔터프라이즈 환경에서 에이전트와 도구 카탈로그가 확장됨에 따라 발생하는 라우팅 성능 저하 문제를 분석합니다. 연구 결과, 정보가 불충분한 요청에서 성능이 크게 하락하며, 임베딩 기반 숏리스트 방식이 이를 효과적으로 보완함을 입증했습니다.
LLM 게임 에이전트의 프롬프트를 환경 보상을 기반으로 자동 최적화하는 프레임워크를 제안합니다. 관찰-행동 파이프라인을 분해하고 진화 루프를 통해 모델 가중치 업데이트 없이도 성능을 크게 향상시킵니다.
TokenPilot은 LLM 에이전트의 장기 세션에서 발생하는 컨텍스트 축적과 추론 비용 문제를 해결하기 위한 이중 입도 컨텍스트 관리 프레임워크입니다. 프롬프트 캐시 연속성을 유지하면서도 효율적인 데이터 압축과 제거를 통해 비용을 획기적으로 절감합니다.
SkillWiki는 에이전트 기술(agent skills)의 대규모 생산, 거버넌스, 진화를 지원하기 위한 살아있는 지식 인프라입니다. 이질적인 지식을 재사용 가능한 기술 자산으로 변환하여 지식의 그라운딩과 지속적인 진화를 가능하게 합니다.
LLM 코딩 에이전트의 시계열 데이터 분석 능력을 세 가지 접근 방식으로 비교 연구했습니다. 코딩 에이전트 방식이 수치 데이터 직접 제공 방식보다 성능이 높지만, 여전히 추론 격차와 통계적 뉘앙스를 놓치는 한계가 있음을 확인했습니다.
에이전트의 추론 과정을 Git 저장소처럼 버전 관리할 수 있는 GitOfThoughts 프레임워크를 제안합니다. 연구 결과, 메모리 기질 자체는 정확도 향상에 큰 도움이 되지 않으며, 높은 유사도를 가진 사례의 정답 검색(Answer retrieval) 시에만 효과가 있음을 밝혀냈습니다.
LLM 에이전트의 성능 저하 원인을 정확히 파악하기 위해 계층별로 격리하여 평가하는 '계층 격리 평가' 방법론을 제안합니다. No-LLM 방식의 결정론적 테스트 하네스를 통해 각 구성 요소의 결함을 빠르게 국지화하고 CI 환경에서 검증할 수 있습니다.
무인 상태로 실행되는 장기 계획 LLM 에이전트의 신뢰성 문제를 해결하기 위한 'Autopilot' 실행 모델을 제안합니다. 에이전트가 검증되지 않은 성공을 허위로 보고하는 것을 방지하기 위해 유한 상태 머신(FSM)을 활용하여 작업 상태를 구조적으로 관리합니다.
TimeLens는 대형 박물관을 위한 온디바이스 AI 기반 모바일 가이드입니다. 이 시스템은 유물을 실시간으로 인식하고, 사용자가 후속 질문을 할 수 있도록 검색 증강 생성(RAG) 기능을 결합했습니다. 연구진은 데이터 품질 주도 반복 과정을 거쳐 고성능의 경량화된 유물 감지기(YOLOv8n)를 개발했으며, 지연 시간을 획기적으로 줄인 RAG 시스템을 구축하여 현장 적용 가능성을 높였습니다.
이 글은 장문맥 추론을 위한 새로운 에이전트 프레임워크인 Recursive Agent Harness (RAH)를 소개합니다. RAH는 모델 재귀 개념을 코드 우선으로 확장하여, 상위 에이전트가 서브에이전트를 생성하고 실행하는 구조입니다. 테스트 결과, RAH는 기존 코딩 에이전트 대비 성능 향상을 입증했습니다.