Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
에이전트 기반 이커머스 환경에서 신뢰할 수 있는 제품 정보를 확보하기 위한 마이크로 트랜잭션 시장 모델을 제안합니다. 자율 에이전트가 미세 결제를 통해 검증된 데이터를 구매함으로써, 단순 매칭을 넘어 정보의 신뢰성을 확보하는 새로운 아키텍처를 다룹니다.
코딩 에이전트의 도구 사용 결정을 비용 민감형 순차 가설 검정으로 공식화한 베이지안 제어 방식을 제안합니다. 이 방식은 불확실성을 고려하여 증거 수집, 후보 개선, 검증 여부를 동적으로 결정하며 높은 효율성을 보여줍니다.
RAG 시스템의 개인정보 유출 위험을 방지하기 위해 멀티 에이전트 기반의 의미론적 재작성 프레임워크를 제안합니다. 세 개의 특화된 에이전트가 협력하여 문맥적 충실도를 유지하면서도 민감한 식별자를 효과적으로 제거합니다.
코딩 에이전트의 성능 향상을 위해 구조적 코드베이스 인덱스를 도입하는 실험을 진행했습니다. 연구 결과, 인덱스 추가는 비용 페널티 없이 로컬라이제이션과 문제 해결 능력을 유의미하게 향상시켰습니다.
LLM 추론 속도를 높이는 KV 캐싱의 효율성을 개선하기 위해 최근성과 빈도수를 고려한 적응형 캐싱 기술을 제안합니다. 기존 LRU 방식의 한계를 극복하여 다양한 워크로드에서 캐시 적중률을 높이고 토큰 생성 시간을 단축했습니다.
자율 에이전트의 비결정론적 추론 과정에서 발생할 수 있는 권한 오남용을 방지하기 위한 Sovereign Execution Broker(SEB)를 제안합니다. SEB는 인증서 기반의 런타임 강제 경계를 통해 에이전트의 작업을 검증하고, 실행 권한을 수명이 짧고 감사 가능한 형태로 관리합니다.
LedgerAgent는 도구 호출 에이전트가 작업 상태를 명시적인 장부(ledger)로 관리하여 정책 준수 능력을 높이는 방법론입니다. 프롬프트에 의존하는 암시적 상태 관리의 한계를 극복하고, 도구 호출 전 정책 위반을 사전에 차단합니다.
자율 코딩 에이전트(ACA)를 활용하여 기업 데이터 워크플로우를 자동화하는 데이터 인텔리전스 에이전트(DIA) 시스템을 제안합니다. 데이터 해석기, 스키마 생성기, 쿼리 생성기 세 가지 에이전트가 공유 메모리를 통해 협업하며, SQL 벤치마크에서 기존 최고 성능을 능가하는 결과를 입증했습니다.
GUI 에이전트의 오프-궤적 상태 문제를 해결하기 위해 기술 가이드 기반 연속 증류(SGCD) 프레임워크를 제안합니다. SGCD는 전문가 궤적을 벗어난 상태에서도 성공적인 연속 실행을 생성하여 정책의 감독 격차를 해소합니다. OSWorld-Verified 벤치마크에서 모델의 성공률을 30%대에서 50% 이상으로 크게 향상시켰습니다.
DiT RL 사후 학습의 비용 문제를 해결하기 위해 스팟 GPU와 시드 탐색을 결합한 시스템 Spotlight를 제안합니다. 오래된 가중치를 활용한 탐색과 탄력적 시퀀스 병렬성(SP) 재구성을 통해 학습 효율을 극대화합니다.
StepGuard는 웹 내비게이션 에이전트의 단일 단계 오류와 보상 불일치 문제를 해결하기 위한 새로운 프레임워크입니다. DDPO와 CANR 메커니즘을 통해 내비게이션과 답변의 정확도를 높여 SOTA 성능을 달성했습니다.
PreAct는 컴퓨터 사용 에이전트의 반복 작업을 가속화하기 위해 실행 과정을 상태 머신 프로그램으로 컴파일하는 기술입니다. 언어 모델 호출 없이 프로그램을 직접 재생함으로써 기존 대비 8.5~13배 빠른 속도를 구현하며, 화면 상태를 검증하여 안정성을 확보합니다.
단일 모델 중심의 한계를 극복하기 위해 여러 모델과 도구를 오케스트레이션하는 복합 AI(Compound AI) 시스템 설계 방법론을 제안합니다. 워크플로 토폴로지와 구성 선택을 통해 정확도는 유지하면서 지연 시간과 비용을 획기적으로 절감하는 8가지 설계 패턴을 제시합니다.
LLM이 단순 챗봇을 넘어 추론, 메모리, 행동 능력을 갖춘 '디지털 동료'로 진화하는 패러다임 전환을 다룹니다. 사고형 LLM의 인지 능력 향상과 워크스테이션 시스템을 통한 도구 활용의 지속성 확보를 핵심으로 설명합니다.
커스텀 AI 에이전트를 기저층부터 프로덕션 단계까지 엔드 투 엔드로 구축하기 위한 'Agents All the Way Down' 방법론을 제시합니다. 특정 프레임워크에 의존하지 않고 LLM을 도구와 시스템으로 프레임화하여 지속 가능한 에이전트를 만드는 과정을 다룹니다.
본 연구는 안전 필수 공정인 콘크리트 방호벽 설계를 위해 '생성-평가-최적화' 폐쇄 루프 다중 에이전트 프레임워크를 제안합니다. 이 시스템은 AutoGen을 활용하여 설계 정확도 98% 이상을 달성하며, 대규모 모델보다 경량 모델의 효율성이 높음을 입증했습니다.
본 논문은 프로덕션 AI 에이전트가 기존의 보안 경계를 무너뜨리는 환경에서, 런타임 거버넌스를 위한 레퍼런스 아키텍처를 제시합니다. 이 아키텍처는 의도 판정 및 네 가지 강제 플레인(네트워크, ID, 엔드포인트, 데이터)을 포함하는 오프 플레인 분해 구조로 구성됩니다. 이를 통해 복합적인 권한 약화와 상태 기반 평가가 가능하며, 강력한 감사 기능을 제공합니다.
Brick은 기존 LLM 라우터의 한계를 극복하기 위해 제안된 멀티모달 라우터입니다. 이 시스템은 쿼리별 난이도 추정치와 모델의 여섯 가지 능력 차원 점수를 결합하여 비용 페널티가 적용된 기하학적 규칙으로 요청을 디스패치합니다. 테스트 결과, Brick은 최대 품질 설정에서 최고 성능을 달성했으며, 중립적인 프로파일에서도 높은 정확도를 유지하며 비용 효율성을 크게 개선했습니다.
AI 에이전트들이 동일한 문서를 읽을 때마다 매번 prefill 단계를 재실행하여 컴퓨팅 자원을 낭비하는 문제를 지적합니다. 이 글은 문서의 Key-Value (KV) 캐시를 미리 계산하고, 다른 에이전트가 이를 로드하여 prefill 과정을 건너뛰는 방식을 제안하며, 이는 정확도 손실 없이 비용 효율적인 대안임을 설명합니다.
자율 과학적 발견을 위해 에이전트의 행동을 최적화하는 '환경 공학(environment engineering)' 개념을 제안합니다. EurekAgent는 권한, 아티팩트, 예산, 인간 참여형 루프의 네 가지 차원을 설계하여 에이전트의 생산성을 극대화합니다.