Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 연구는 기존의 JSON 기반 도구 호출 대신 프로그래밍 방식 도구 호출(PTC)의 성능을 BFCL v4 벤치마크를 통해 검증합니다. 실험 결과, PTC는 대다수의 모델에서 JSON 방식보다 우수하거나 대등한 성능을 보였으며 특히 병렬 처리와 컨텍스트 로트 상황에서도 높은 안정성을 입증했습니다.
기존 RAG의 Top-K 임베딩 방식이 복잡한 표와 수치가 포함된 문서에서 발생하는 한계를 지적합니다. 이를 해결하기 위해 임베딩 없이 에이전트가 직접 문서를 탐색하는 READ 프레임워크를 제안하며, 높은 정답률과 재현 가능한 감사 추적 성능을 입증했습니다.
NeSy-RAG는 RAG의 불투명한 추론 과정을 개선하기 위해 신경-기호학적(Neuro-Symbolic) 방식을 도입한 프레임워크입니다. 검색된 텍스트를 Prolog 모듈로 합성하여 추론 과정을 투명하게 공개하고, 누락된 사용자 정보를 감지하는 메커니즘을 제공합니다.
string2string Studio는 NLP, 생물학, 인문학 분야의 문자열 분석을 위한 인터랙티브 웹 플랫폼입니다. WebAssembly를 활용해 C++ 기반 알고리즘을 브라우저 로컬에서 실행하며, 높은 성능과 디버깅 가능한 인터페이스를 제공합니다.
RAG 시스템의 질의와 문서 간 스타일 간극을 해결하기 위해 인덱싱 단계에서 가설 프롬프트를 사전 계산하는 HyPE 프레임워크를 제안합니다. 이 방식은 런타임 오버헤드 없이 검색 정밀도와 재현율을 크게 향상시킵니다.
TokTier는 에이전트형 LLM 서빙 시 발생하는 재토큰화 비용을 줄이기 위한 상태 유지 토큰화(Stateful Tokenization) 기술입니다. 추가된 텍스트 주변의 안정적 경계를 확인하여 토큰을 결합함으로써, 기존 방식보다 훨씬 빠른 속도로 토큰화를 수행하고 첫 번째 토큰 생성 시간(TTFT)을 단축합니다.
SEC 공시 자료의 특수성을 고려하여 코퍼스 불일치 문제를 해결하는 멀티 에이전트 RAG 프레임워크 FinSAgent를 제안합니다. 데이터베이스 인식 쿼리 분해와 특징 게이트형 재순위화기를 통해 검색 정확도와 답변 품질을 높였습니다.
본 논문은 모바일 기기 환경에 최적화된 네이티브 온디바이스 에이전트 프레임워크인 PalmClaw를 소개합니다. 기존의 GUI 기반 제어 방식의 한계를 극복하고, 장치 기능을 명시적인 '장치 도구'로 노출하여 에이전트가 모바일 기능을 직접적이고 제어 가능하게 사용할 수 있도록 설계되었습니다.
Graph-RAG의 신뢰성을 확보하기 위해 추출, 구축, 추론 단계를 단계별로 계측하는 TRIAGE 프레임워크를 소개합니다. 이 프레임워크는 지식 그래프의 구현, 검증, 사용 단계를 독립적인 지표로 평가하여 실패 지점을 정확히 찾아냅니다.
학술 논문과 같은 구조화된 텍스트를 대상으로 다양한 RAG 청킹 전략의 성능을 RAGAs 프레임워크를 통해 비교 평가했습니다. 연구 결과, 클러스터 기반 의미론적 청킹이 기존의 고정 크기 및 재귀적 청킹보다 반드시 우수한 성능을 보이지는 않았습니다.
제한된 컨텍스트 예산 내에서 RAG 성능을 최적화하기 위한 새로운 진단 도구와 증거 패킹 기법을 제안합니다. 기존의 문서 재현율 대신 'answer-in-context' 지표를 사용하여 정답 품질을 더 정확히 예측하며, 서브모듈러 최적화를 통해 효율적인 증거 구성을 달성합니다.
장기적 작업 수행 시 발생하는 모바일 GUI 에이전트의 컨텍스트 부담과 환각 문제를 해결하기 위한 TSR 프레임워크를 제안합니다. TSR은 작업 상태를 감각 입력과 분리하여 에이전트의 추론을 효과적으로 가이드합니다.
펀드 공시 데이터와 시장 맥락을 활용하여 금융 자문가 페르소나를 구축하고 정교화하는 Fund2Persona 프레임워크를 제안합니다. actor-scorer-patcher 루프를 통해 전문적인 투자 관점을 LLM에 이식하며, 시장 시나리오 생성 및 맞춤형 자문 대화에서 우수한 성능을 입증했습니다.
TIGRAG는 토큰 공생 지식 그래프를 활용하여 멀티홉 추론 성능을 개선한 효율적인 RAG 프레임워크입니다. 기존 그래프 RAG의 높은 계산 비용과 LLM 의존성을 해결하며, 인덱싱 및 추론 지연 시간을 대폭 단축했습니다.
LAMP는 MCP와 온톨로지를 활용하여 Lean 4 기반의 수학적 증명을 생성하는 멀티 에이전트 프레임워크입니다. 단어 조합론(CoW) 분야에서 도메인 지식을 구조적으로 제공함으로써, 미세 조정 없이도 높은 정확도로 커널 검증된 증명을 합성합니다.
기업용 지식 그래프를 위한 데이터 중심 Text-to-Cypher 파이프라인인 KG2Cypher를 제안합니다. 그래프 사실로부터 쿼리와 자연어 질문 쌍을 생성하고, SFT를 통해 학습된 생성기가 높은 정확도와 실행률을 달성함을 입증했습니다.
RAG 시스템이 시간이 지남에 따라 변화하는 지식(API 변경 등)을 처리할 때 발생하는 '오래된 사실 오류' 문제를 해결하기 위한 MemStrata를 제안합니다. MemStrata는 이중 시간 원장 방식을 통해 LLM 호출 없이도 모순된 정보를 효과적으로 제거하며, 진화하는 지식 환경에서 RAG보다 월등한 정확도를 보여줍니다.
이커머스의 장기적 비즈니스 목표 달성을 위해 LLM 기반의 가격 책정 프레임워크인 AIGP를 제안합니다. 오프라인 강화학습과 DPO를 활용하여 GMV와 ROI를 최적화하며, 기존 모델 대비 높은 성과와 해석 가능성을 입증했습니다.
RAG 시스템의 보안 및 개인정보 보호 위협을 분석하고 신뢰할 수 있는 아키텍처 구축 방안을 제시합니다. 검색, 컨텍스트 구축, 생성 단계에서 발생할 수 있는 다양한 공격 유형과 방어 기법을 체계적으로 검토합니다.
SHERLOC은 코드 수정 에이전트의 효율성을 높이기 위해 결함 위치를 진단하고 맥락을 제공하는 훈련 불필요 프레임워크입니다. 별도의 미세 조정 없이도 높은 로컬라이제이션 성능을 보이며, 수정 에이전트의 해결률을 높이고 토큰 사용량을 절감합니다.