Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
이 리포지토리는 ICML 2024 논문의 보조 자료로, RAG 시스템을 평가하기 위한 자동화된 프레임워크를 제공합니다. 이 도구는 주어진 지식 코퍼스 기반으로 LLM을 활용하여 작업별 객관식 시험을 생성하고, 이를 통해 다양한 RaG 변형들을 체계적으로 평가하며 개선하는 방법을 제시합니다.
SemaClaw는 개인 AI 에이전트 구축을 위한 범용 오픈 소스 엔지니어링 프레임워크입니다. 재사용 가능한 런타임을 기반으로 권한, 메모리, 스케줄링 등 다양한 주변 장치를 제공합니다. 특히 세 계층의 컨텍스트 관리와 Human-in-the-Loop 권한 같은 고급 기능을 지원하며, DAG 오케스트레이션과 플러그인 마켓플레이스를 통해 확장성을 극대화했습니다.
Agent Alchemy는 Claude Code를 위한 오픈 소스 개발자 툴킷으로, 사양 정의부터 작업 실행까지 구조화된 워크플로우를 제공합니다. 이 툴킷은 여섯 가지 플러그인과 실시간 작업 관리자, VS Code 확장 기능을 통합하여 AI 엔지니어가 체계적인 개발을 할 수 있도록 지원합니다.
본 문서는 Long-context LLMs를 활용하여 검색 증강 생성(RAG)의 성능을 개선한 'LongRAG' 프레임워크를 소개합니다. 기존 RAG가 짧은 검색 단위에 의존해 리트리버와 리더 간의 비효율성을 가졌다면, LongRAG는 4K-token의 긴 검색 단위를 도입하여 이 문제를 해결했습니다.
본 문서는 AI 에이전트 개발 및 활용에 대한 심층 가이드라인을 제공합니다. 핵심 개념, 아키텍처 백서와 함께 즉시 적용 가능한 실용적인 팁들을 다룹니다. 특히 'Agents', 'Rules', 'Skills'의 차이를 명확히 설명하고, TRAE 생태계 내에서 프로덕션 레디 에이전트 및 스킬 저장소를 제공하여 개발자들의 효율적인 구현을 돕습니다.
본 논문은 검색 증강 생성(RAG)의 성능을 최적화하기 위해 미분 가능한 데이터 보상(Differentiable Data Rewards, DDR) 기법을 제안합니다. 이 방법론은 RAG 시스템의 생성 및 지식 정제 모듈에 적용되어 전반적인 정확도를 높이는 것을 목표로 합니다.
OxyJen은 그래프 스타일 실행, 컨텍스트 인식 메모리, 결정론적 재시도/폴백 기능을 갖춘 오픈 소스 Java 프레임워크입니다. 이 프레임워크는 LLM을 네이티브 노드로 취급하여, 개발자들이 기존 Java 코드와 통합되는 다단계 AI 파이프라인 구축을 지원합니다.
본 문서는 모범 사례를 따르는 RAG(Retrieval-Augmented Generation) 솔루션 설계 및 평가에 대한 가이드입니다. 이 저장소는 검색 엔진과 생성형 AI 모델을 결합하여, 외부 데이터 기반의 정확하고 관련성 높은 콘텐츠 생성을 목표로 합니다. Azure Open AI와 Azure AI Search 같은 클라우드 서비스를 활용한 엔드투엔드 구현 방법을 제공합니다.
본 논문은 Multi-modal Large Language Models (MLLMs)이 다중 모드 검색 문서를 활용하여 질문에 답하는 능력을 평가하는 $M^2RAG$ 벤치마크를 제안합니다. 이 벤치마크는 이미지 캡셔닝, multi-modal QA 등 네 가지 작업을 포함하며, Multi-Modal Retrieval Augmented Instruction Tuning (MM-RAIT) 방법을 통해 MLLMs의 지식 활용 효과를 높이는 방식을 제시합니다.
REX-RAG는 검색 증강 생성(RAG)을 위해 강화학습(RL) 기법을 적용한 프레임워크입니다. 이 시스템은 혼합 샘플링과 원칙적인 정책 교정 메커니즘을 통해 추론 막다른 길에서 벗어나 안정적이고 성능이 향상된 답변 생성을 가능하게 합니다. 다단계 추론 및 도메인 외 일반화에 강점을 보이며, 관련 코드를 GitHub에 공개했습니다.
GraphRAG-Bench는 그래프 검색 증강 생성(Graph RAG)의 성능을 평가하기 위해 개발된 도메인 특화 추론 과제 및 데이터셋입니다. 이 벤치마크는 16개 분야, 5가지 질문 유형, 그리고 7백만 단어 분량의 코퍼스를 포함합니다. 모델은 정확도와 더불어 골드 추론 과정과의 의미적 대응을 평가받습니다.
본 문서는 그래프 검색 증강 생성(GraphRAG)의 효과와 적용 시나리오를 체계적으로 분석하기 위해 'GraphRAG-Bench'라는 포괄적인 벤치마크를 제안합니다. GraphRAG는 전통적 RAG보다 복잡한 추론과 계층적 지식 모델링에 강점을 보이지만, 실제 작업에서는 성능이 떨어지는 경우도 있어 그 효과 검증이 필요합니다.
EigenFlux는 AI 에이전트들이 공유 네트워크 내에서 정보를 브로드캐스트하고 통신할 수 있게 하는 오픈 소스 프레임워크입니다. 이 시스템은 모든 에이전트를 브로드캐스터이자 리스너로 활용하며, 구조화되고 신호 대 잡음비가 높은 방식으로 정보 교환을 가능하게 합니다. 개발자들은 이를 통해 자신만의 에이전트 통신 허브를 배포하고, 데이터 처리 과정을 감사하며, 새로운 코디네이션 시스템을 구축할 수 있습니다.
Lux는 자율 개체(Agents)가 통신, 학습, 복잡한 워크플로우 실행을 할 수 있도록 설계된 언어 독립적인 다중 에이전트 시스템 프레임워크입니다. 이 프레임워크는 성찰 기능과 타입 안전 통신(Signals), 모듈식 컴포넌트(Prisms) 등을 통해 지능적이고 협업 가능한 AI 시스템 구축을 지원합니다.
OpusAgents는 AI 에이전트와 도구를 쉽게 구축할 수 있도록 설계된 오픈소스 Agentic AI 프레임워크입니다. 이 프레임워크는 기존의 MCP 서버 통합 방식보다 예측 가능하고 신뢰성 높은 방식으로 에이전트를 구성하는 것을 목표로 합니다. Custom tool, Higher order tool, Meta tool 등의 추상화를 통해 도구 선택 정확도를 높이고 생산성을 극대화합니다.
Agent Space는 태스크 요구사항에 맞춰 적절한 에이전트를 자동으로 선택하고, 작업을 실행하며 결과를 평가하여 최종 결과물을 반환하는 오픈 소스 프레임워크입니다. 이 시스템은 마스터 에이전트가 여러 개의 에이전트로 구성된 클러스터에서 필요한 에이전트를 동적으로 선택하고 출력값을 평가하는 방식으로 작동합니다.
Magnitude는 Vision AI를 활용하여 자연어 기반으로 브라우저를 제어하는 최신 에이전트입니다. 웹 탐색, 상호작용, 데이터 추출 등 다양한 기능을 제공하며, API 없이 앱 간 통합이나 웹 테스트 자동화에 사용될 수 있습니다. 특히 시각적으로 근거 있는(visually grounded) 아키텍처로 일반화 문제를 해결했습니다.
Q-ACE는 FastAPI와 최신 LLM Provider를 활용하여 구축된 모듈형 AI 에이전트 엔진입니다. 이 프레임워크는 QA 작업을 자동화하며, 브라우저, 데이터베이스, REST API 등 다양한 환경에 특화된 지능형 에이전트를 제공합니다. 또한, 여러 주요 LLM(Gemini, OpenAI, Ollama 등)을 지원하고 통합적인 툴 오케스트레이션을 가능하게 합니다.
PicoClaw는 리소스가 제한된 하드웨어(예: RISC-V 보드, 구형 Android 폰)에서 실행되도록 설계된 초경량 오픈 소스 AI 에이전트 프레임워크입니다. 이는 기존의 무거운 프레임워크에 대한 경량 대안을 제공합니다. 사용자는 Ubuntu 환경 설정과 함께 PicoClaw를 다운로드하고 구성하여 사용할 수 있습니다.
Salesforce 환경에 최적화된 오픈 소스 AI 에이전트 프레임워크인 Pluto를 소개합니다. LLM 기반의 지능형 에이전트를 구축하여 데이터 검색, 레코드 업데이트, 다단계 워크플로 실행 등을 안전하게 수행할 수 있습니다.