Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
EMBGuard는 MLLM 기반 체화된 에이전트(Embodied Agents)의 물리적 위험을 식별하기 위한 안전 가드레일 프레임워크입니다. 에이전트 정책과 위험 추론을 분리하여 시각적 관찰과 행동 쌍을 평가하며, 소형 모델로도 고성능 모델에 필적하는 위험 인지 능력을 보여줍니다.
인간과 AI 사이의 암묵적 이해를 측정하기 위한 새로운 지표인 TUX를 제안합니다. Wavelength 게임에서 영감을 얻은 과업을 통해 인간의 주관적 판단과 AI의 판단 사이의 유사성을 정량화하고, 개인적 특성이 암묵적 정렬에 미치는 영향을 분석했습니다.
Minecraft 환경에서 MLLM 에이전트의 오픈 월드 탐사 능력을 평가하기 위한 새로운 벤치마크인 MineExplorer를 제안합니다. 멀티 에이전트 합성 워크플로를 통해 신뢰도 높은 멀티홉 과업을 생성하며, 기존 모델들이 긴 궤적의 복잡한 과업 수행에서 한계를 보임을 입증했습니다.
인문학적 연구의 특성인 증거 기반 해석과 정독을 지원하기 위한 멀티 에이전트 프레임워크 SPIRE를 제안합니다. SPIRE는 출처 발견부터 논증적 합성까지의 과정을 에이전트 역할로 분담하여 기존 RAG 방식보다 높은 신뢰도의 학술적 추론을 수행합니다.
LLM이 언어에 내재된 제도적 경험을 인코딩하여 도덕적 추론에 반영하는지 연구했습니다. 실험 결과, 명시적 프레이밍보다 제도적 모호성이 존재할 때 언어별 제도적 차이가 도덕적 판단의 차이로 더 뚜렷하게 나타남을 확인했습니다.
EvoGens는 LLM의 의미론적 수렴 문제를 해결하기 위해 진화적 탐색 메커니즘을 도입한 새로운 프레임워크입니다. 순위 기반 변이와 의미론적 인지 교차를 통해 과학적 아이디어의 참신함과 다양성을 획기적으로 높였습니다.
ImmersiveTTS는 멀티모달 Diffusion Transformer를 활용하여 환경 맥락에 자연스럽게 통합된 음성을 생성하는 모델입니다. 음성과 환경 오디오의 차이를 극복하기 위해 도메인 특화 표현 정렬 기술을 도입하여 자연스러움과 명료도를 높였습니다.
자기회귀 언어 모델의 생성 과정 중 발생하는 성능 저하 현상을 '인지적 피로(cognitive fatigue)'로 정의하고 이를 측정하는 Fatigue Index(FI)를 제안합니다. 연구 결과, FI는 모델의 성능 저하와 반복성을 높은 정확도로 예측하며 모델 크기에 따른 독특한 스케일링 특성을 보여줍니다.
기존 지식 그래프가 놓치던 문서 간의 입장(Stance)을 포착하기 위해 '유형화된 주장 네트워크(Typed Claim Network)'를 제안합니다. 인용 의도를 포함한 4개 클래스의 레이블을 통해 문서 간 관계를 구체화하며, RAG 성능 향상과 위상 분석에 효과적임을 입증했습니다.
3D 의료 영상 모델이 유창하지만 정확도가 낮은 템플릿을 반복하는 '템플릿 붕괴' 현상을 정의하고 이를 진단하는 체계적인 방법을 제시합니다. 이를 해결하기 위해 임상적 탐지와 언어 합성을 분리한 CLarGen 프레임워크를 제안하여 보고서의 정확도를 크게 향상시켰습니다.
EU 규제 협의 데이터를 분석하기 위해 LLM 기반의 엔드 투 엔드 파이프라인과 대시보드를 제안합니다. 이 시스템은 PDF와 웹 양식 데이터를 처리하여 축자적 인용구에 근거한 주제 주석을 생성하며, 높은 투명성과 추적성을 제공합니다.
MoG는 그래프 기반 RAG를 위해 MoE(Mixture of Experts) 방식을 도입한 새로운 프레임워크입니다. 허브 그래프와 도메인 특화 전문가 그래프를 활용하여 검색 범위를 최적화하고 추론 성능을 높입니다.
단일 벤치마킹의 한계를 극복하기 위해 다양한 인간의 관점을 반영하는 페르소나 기반 평가 프레임워크를 제안합니다. 합성 인지 프로필을 활용해 다원적 정렬을 시도하며, 평가 과정에서의 일관성 유지와 동적 규제 메커니즘의 필요성을 논합니다.
지속적 미세 조정 시 발생하는 치명적 망각 문제를 해결하기 위해, 적응 인식 프로빙을 통해 작업별 핵심 파라미터를 식별하는 TRACE 방법론을 제안합니다. 짧은 웜스타트 프로브를 활용해 각 작업에 필수적인 파라미터 서브셋을 찾아내어 이전 지식을 보존하면서도 효율적인 학습을 가능하게 합니다.
LLM 에이전트가 파일 읽기/쓰기 및 도구 호출을 수행할 때 발생하는 다단계 트로이 목마 공격 위협을 분석합니다. 새로운 벤치마크 ClawTrojan을 통해 공격 성공률을 입증하고, 이를 방어하기 위한 동적 방어 체계인 DASGuard를 제안합니다.
본 연구는 중국어의 영생략(Zero Pronouns) 현상에 대한 LLM의 처리 능력을 체계적으로 조사합니다. 식별부터 번역까지 다양한 언어학적 과제를 통해 평가한 결과, 최신 추론 중심 모델조차 영생략 처리에서 낮은 성능을 보임을 확인했습니다.
RLVR(검증 가능한 보상을 활용한 강화학습)의 확장성 문제를 해결하기 위해 ADR(원자적 분해 및 재결합) 프레임워크를 제안합니다. 코드를 원자적 요소로 분해하고 재결합하여 참신하고 도전적인 데이터셋을 생성함으로써 모델의 코딩 능력을 효과적으로 향상시킵니다.
AdaptR1은 멀티홉 질의응답 시 발생하는 과잉 사고 문제를 해결하기 위해 강화학습 기반의 적응형 인터리브 사고 프레임워크를 제안합니다. 각 단계마다 추론 예산을 동적으로 할당하여 성능을 유지하면서도 불필요한 사고 토큰을 획기적으로 줄입니다.
긴 영상의 복잡한 서사를 이해하고 미래 이벤트를 예측하기 위한 VISTA 프레임워크를 제안합니다. 캐릭터 중심의 시각적 프롬프트와 지식 강화 반복 검색 전략을 통해 세부 의미론과 서사적 일관성을 동시에 강화합니다.
기존 LLM 메모리 벤치마크의 정적이고 단조로운 한계를 극복하기 위해 새로운 벤치마크인 RHELM을 제안합니다. RHELM은 동적인 페르소나 진화와 이질적인 데이터 스트림을 통합하여 실제와 유사한 장기 기억 능력을 평가합니다.