Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 모바일 GUI 네비게이션을 위한 VLM 기반 에이전트의 데이터 스케일링, 벤치마킹 및 추론을 연구합니다. 대규모 데이터셋 HyperTrack과 오픈 소스 툴킷 GUIEvalKit을 통해 강화 학습 기반 미세 조정의 우수성과 데이터 규모의 시너지 효과를 입증합니다.
다회차 에이전트 강화학습의 신용 할당 문제를 해결하기 위해 단계 인식 온라인 선호도 증류(StepOPSD) 프레임워크를 제안합니다. 궤적을 행동 중심의 단계 단위로 분해하여 보상을 재분배함으로써 에이전트의 성능을 최적화합니다.
ICCU는 모델 파라미터를 수정하지 않고 추론 시점에 거절 규칙을 적용하여 특정 데이터를 망각시키는 인컨텍스트 지속적 언러닝 프레임워크입니다. 기존 미세 조정 방식의 비용 문제와 유틸리티 손실, 요청 간 간섭 문제를 해결하며 순차적인 언러닝 요청에 효과적으로 대응합니다.
VitaBench 2.0은 장기적 상호작용에서 에이전트의 개인화 및 주도적 능력을 평가하는 새로운 벤치마크를 제안합니다. 기존 벤치마크가 간과한 사용자 선호도 추론과 능동적 정보 획득 능력을 중점적으로 측정합니다.
안전 필수 영역의 객체 탐지기 성능을 테스트하기 위한 SemProbe 도구를 제안합니다. 확산 모델 기반의 인페인팅 기술을 사용하여 의미론적으로 유의미한 이미지 변형을 생성하고, 모델의 강건성을 체계적으로 평가합니다.
RAG 시스템에서 모델이 모순된 증거를 인지하더라도 이를 안전한 행동으로 연결하지 못하는 '모니터링-제어 간극' 문제를 분석했습니다. 단일 턴 평가가 RAG의 안전성을 과대평가할 수 있음을 입증하며, 다중 턴 환경에서의 새로운 평가 필요성을 제기합니다.
반구조화된 데이터에서 RAG의 한계를 극복하기 위해 기호적 질의와 의미론적 검색을 결합한 DualGraph 프레임워크를 제안합니다. 텍스트 지식 그래프와 기호 지식 그래프를 동시에 활용하여 정확한 필터링과 집계를 지원하며, 새로운 벤치마크인 SpecsQA를 통해 성능을 입증했습니다.
사운드 디자이너의 워크플로우와 AI 통합 사이의 격차를 조사한 연구입니다. 설문과 인터뷰를 통해 분석한 결과, 현재 AI는 미디어용으로는 적합하나 하이엔드 사운드 디자인의 서사적 정교함은 부족함을 확인했습니다.
지식 그래프(KG)가 과학적 가설 생성에 미치는 영향을 Mistral, Llama, Gemini 모델을 통해 연구했습니다. 연구 결과, 모델은 전체 KG가 아닌 압축된 서브그래프만으로도 유용한 정보를 복구할 수 있음을 확인했습니다.
실제 환경의 불확실성을 극복하기 위해 노이즈를 학습 과정에 통합하는 NoisyAgent 프레임워크를 제안합니다. 사용자 및 도구 실행에서 발생하는 노이즈를 시뮬레이션하여 에이전트의 강건성과 일반화 성능을 향상시킵니다.
TWIST는 무선 통신 환경에서 물리적 장면과 디지털 트윈 간의 효율적인 동기화를 위한 폐쇄 루프 토큰 동기화 프레임워크를 제안합니다. 시각적 재구성 대신 토큰 기반의 의미론적 상태를 전송하여 통신 자원을 최적화하고 교통 상태 추론 성능을 높입니다.
Microsoft의 QuantumKatas를 Qiskit 기반으로 재구성하여 LLM의 양자 컴퓨팅 능력을 평가하는 새로운 벤치마크를 제안합니다. 350개의 태스크를 통해 16개 모델을 분석한 결과, 모델 간 성능 격차와 문제 인코딩의 어려움을 확인했습니다.
본 논문은 고전적 고차 논리(HOL) 내에서 비고전 논리를 임베딩하는 지난 20년간의 연구를 검토합니다. LogiKEy 프레임워크를 통해 대상 논리 수준의 논리적 다원주의를 옹호하며, 단일 기초 논리만을 고집하는 논리적 제국주의의 위험성을 경고합니다.
FineVLA는 로봇의 행동을 세밀하게 제어할 수 있도록 미세 조정된 시각-언어-행동(VLA) 프레임워크입니다. 기존의 목표 중심 지침을 넘어 실행 방식에 대한 구체적인 지침을 학습시켜 로봇의 조종 가능성을 높였습니다.
PilotTTS는 미니멀리스트 아키텍처와 엄격한 데이터 엔지니어링을 통해 적은 데이터로도 고성능을 내는 경량 자기회귀 TTS 시스템입니다. Q-Former 기반 컨디셔닝을 통해 화자 정체성과 스타일을 분리하며, 제로샷 음성 복제 및 다양한 감정 합성을 지원합니다.
경쟁법 전문가를 위해 설계된 에이전트 기반 법률 조사 보조 도구 Maat를 제안합니다. ReAct 에이전트와 RAG 기술을 결합하여 환각 현상을 줄이고 공식 출처에 기반한 신뢰성 있는 분석을 제공합니다.
생성 모델의 정교해진 픽셀 조작을 탐지하기 위해 '사회적 시선 일관성'이라는 고수준 의미론적 단서를 제안합니다. 인물 간 시선 방향과 머리-눈 정렬의 일관성을 분석하여 기존 저수준 아티팩트 탐지의 한계를 극복합니다.
GENESIS는 6G RAN(무선 접속 망)의 합성, 연구 및 테스트를 자동화하기 위한 에이전트 기반 AI 프레임워크입니다. LLM의 환각 문제를 해결하기 위해 에이전트, 스킬, 훅 및 지식 계층인 SYNAPSE를 활용하여 무선 실험으로 검증된 솔루션을 생성합니다.
검색 에이전트의 비용과 정확도를 최적화하기 위해 자연어 질의 기반의 설정 최적화 프레임워크인 BRANE을 제안합니다. BRANE은 쿼리별 특성을 분석하여 추론 시점에 비용 대비 성능을 극대화하는 설정을 동적으로 선택합니다.
소수의 알고리즘 공급업체가 채용 시장을 독점하는 '알고리즘 단일 재배' 현상이 특정 인종 그룹에 불리한 결과를 초래함을 분석했습니다. 400만 건의 데이터를 통해 아시아인과 흑인 지원자가 겪는 인종적 불균형과 결과의 균질성을 입증했습니다.