Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 기존 LLM 에이전트가 겪는 '실행 정밀도 불일치' 문제를 해결하기 위해 HyperTool이라는 새로운 도구 인터페이스를 제안합니다. HyperTool은 여러 단계의 도구 호출 및 데이터 처리를 단일 외부 호출로 접어 넣어 모델에게 더 간결하고 효율적인 추론 과정을 제공합니다. 이를 통해 다단계 도구 사용 능력을 크게 향상시켰습니다.
SkillChain은 이커머스 이미지 기반 AI 어시스턴트의 다양한 사용자 의도를 처리하기 위해 기술(Skill) 진화 과정을 자동화하는 프레임워크입니다. Skill Creator, Route Optimizer, Body Refiner의 3단계 루프를 통해 도구 호출과 응답 품질을 최적화합니다.
WebChallenger는 모델 규모 대신 아키텍처 설계를 통해 효율적인 웹 탐색을 구현하는 에이전트 프레임워크입니다. PageMem을 기반으로 선택적 주의, 지속적 기억, 절차적 유창성을 모방하여 오픈 웨이트 모델로도 높은 성능을 냅니다.
Didact는 파편화된 국방 관련 문서와 연구 데이터를 통합하여 역량 발견을 돕는 시스템입니다. 맞춤형 지식 그래프와 RAG 파이프라인을 활용하며, 대화형 증거 시각화 기능을 통해 정책 결정 지원을 목표로 합니다.
이커머스 플랫폼의 검색 품질을 높이기 위해 인간과 LLM이 협업하는 BEATS 프레임워크를 제안합니다. 다단계 생성 파이프라인과 인간의 피드백을 반복적으로 적용하여 정교한 상품 속성 분류 체계를 구축합니다.
LLM 에이전트의 경험을 유형화된 컨텍스트 단위(ECU)로 관리하는 UCE 프레임워크를 소개합니다. 경험을 Memory, Strategy, Workflow, Skill로 분류하여 효율적으로 저장, 검색, 최적화함으로써 에이전트의 성능을 극대화합니다.
RAG 시스템의 핵심 요소인 청킹(chunking) 방법론의 효과성을 체계적으로 평가한 연구입니다. 기존의 고정 크기 및 의미론적 청킹 방식의 한계를 분석하고, 다양한 시나리오에서의 성능과 계산 비용 문제를 다룹니다.
EU 규제 협의 데이터를 분석하기 위해 LLM 기반의 엔드 투 엔드 파이프라인과 대시보드를 제안합니다. 이 시스템은 PDF와 웹 양식 데이터를 처리하여 축자적 인용구에 근거한 주제 주석을 생성하며, 높은 투명성과 추적성을 제공합니다.
LLM 에이전트가 파일 읽기/쓰기 및 도구 호출을 수행할 때 발생하는 다단계 트로이 목마 공격 위협을 분석합니다. 새로운 벤치마크 ClawTrojan을 통해 공격 성공률을 입증하고, 이를 방어하기 위한 동적 방어 체계인 DASGuard를 제안합니다.
금융 RAG 시스템에서 LLM을 동결한 상태로 외부 베이지안 소스 메모리를 활용해 검색 성능을 최적화하는 연구를 소개합니다. 시장 피드백을 통해 검색 계층을 적응시킴으로써 뉴스 및 공시 데이터 기반의 수익률 예측 성능과 샤프 지수를 크게 향상시켰습니다.
RAG 시스템에서 합성 데이터와 실제 프로덕션 쿼리 간의 검색 커버리지 격차인 '커버리지 환상' 문제를 분석합니다. 사전 라우팅 대신 비용 효율적인 사후 검색 연쇄(post-retrieval cascade) 방식을 제안하여 품질 향상과 지연 시간 단축을 동시에 달성했습니다.
PolyGnosis 2.0은 Polymarket의 정서와 GDELT의 OSINT 데이터를 결합하여 예측 지능을 추출하는 멀티 에이전트 아키텍처입니다. 성찰 루프와 CoT 등 하네스 엔지니어링 기술을 통해 금융 도메인의 노이즈를 극복하고 고수익 트레이딩 신호를 포착합니다.
기업 신용 심사 시 발생하는 '유사성-유용성 격차' 문제를 해결하기 위해, 의미적 유사성 대신 분석적 유용성에 집중하는 2단계 비매개변수적 검색 워크플로우를 제안합니다. 이 시스템은 어휘 및 밀집 검색을 통한 후보 추출 후, LLM-as-a-Judge를 활용해 유용성 기반의 순위를 산정하며, 실제 운영 환경에서 문서 검토 시간을 수 시간에서 3분으로 단축하는 성과를 거두었습니다.
기존의 Text-to-SQL 방식이 가진 보안 및 비즈니스 로직 처리의 한계를 극복하기 위해, 관리형 API를 사용하는 에이전트 기반 LLM 시스템인 'Analytic Agent'를 제안합니다. 이 시스템은 다단계 추론과 정책 인식 오케스트레이션을 통해 사용자의 자연어 의도를 안전한 API 호출로 변환하며, 기업 환경에 필수적인 감사 가능성과 규정 준수를 보장합니다.
자기 진화형 스킬 라이브러리는 '라이브러리 드리프트'라는 침묵하는 실패 모드에 직면해 있습니다. 이는 결과 중심의 관리 없이 무제한적으로 스킬이 축적되면서 검색 성능 저하, 거짓 양성 주입 등을 유발합니다. 본 연구는 이 드리프트를 진단하기 위한 재현 가능한 트리거와 추적 수준의 전용 진단 도구를 제공하며, 최소한의 거버넌스 레시피(결과 중심 은퇴, 활성 상한 제한 등)를 통해 성능을 크게 개선하는 해결책을 제시합니다.