Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
멀티모달 LLM의 추론 효율성을 높이기 위해 연산자 수준에서 시각적 토큰 업데이트를 선택적으로 건너뛰는 새로운 프레임워크를 제안합니다. 답변에 영향을 주지 않는 중복 연산을 식별하여 성능 저하를 최소화하면서 연산량을 크게 줄이는 것이 핵심입니다.
MVP-Nav는 깊이 정보가 없는 RGB 전용 환경에서 체화된 에이전트의 객체 탐색 성능을 높이는 프레임워크입니다. 3D 파운데이션 모델과 다층 가치 지도(MVM)를 통해 의미론적 추론과 물리적 제약 조건을 통합하여 안전하고 정확한 탐색을 가능하게 합니다.
비정형 작물 재배지에서 농업 로봇의 주행 성능을 높이기 위해 잠재 공간 계획(Latent Space Planning)을 활용하는 LeCropFollow 프레임워크를 제안합니다. 기하학적 모델링 대신 학습된 잠재 표현을 사용하여 의미론적 문맥을 보존함으로써, 불규칙한 지형에서도 안정적인 주행이 가능합니다.
멀티모달 에이전트의 체화된 환경 내 협업 능력을 평가하기 위한 새로운 벤치마크인 MECoBench를 제안합니다. 다양한 작업과 협업 모드를 통해 모델 간의 통신, 조정 복잡성, 그리고 강건성을 체계적으로 분석합니다.
전문가 결정 트리와 시각-언어 모델(VLM)을 결합한 멀티 에이전트 시스템인 TreeAgent를 제안합니다. 이 시스템은 임업 데이터의 편향 레이블링 작업을 자동화하며, 기존 지도 학습 모델보다 높은 성능과 낮은 주석 비용을 보여줍니다.
LUNA는 기존의 선형 블렌드 스키닝(LBS) 방식의 한계를 극복하기 위해 제안된 LBS-free 범용 3D 인간 애니메이션 모델입니다. 3D 가우시안 변형을 활용하여 이미지, 키포인트, 스케치 등 다양한 2D 신호로부터 실사 같은 3D 아바타를 생성합니다.
대규모 생성 모델의 데이터 암기 문제를 탐지하기 위해 연쇄적 재생을 활용하는 MADreMIA 프레임워크를 제안합니다. 반복적인 생성 과정을 통해 멤버십 추론 공격(MIA)의 신호를 증폭하여 낮은 허위 양성률로 학습 데이터 포함 여부를 판별합니다.
신경망의 암기-일반화 지연 현상을 은닉 표현의 방사형 팽창 관점에서 기하학적으로 분석한 연구입니다. 방사형 억제(Radial Suppression)를 통해 모델이 각도 업데이트에 집중하게 함으로써 그로킹(grokking) 현상을 가속화할 수 있음을 입증했습니다.
합성 QA 데이터를 활용한 언어 모델 학습 과정에서 발생하는 취약성을 분석합니다. 질문 생성 시 특정 구간에 집중되는 커버리지 편향과 답변 생성 시 텍스트 내 지시문에 과도하게 순응하는 문제를 지적합니다.
PolicyGuard는 LLM의 암시적 추론 한계를 극복하기 위해 뉴로-심볼릭(Neuro-Symbolic) 프레임워크를 제안합니다. 조직의 정책을 관계형 로직 규칙으로 변환하여, LLM의 문서 해석과 심볼릭 평가기를 결합해 명시적이고 테스트 가능한 준수 검토를 수행합니다.
Dafny 언어를 위한 에이전트 기반 코드 및 검증 증명 생성 프레임워크인 AxDafny를 제안합니다. 검증기 가이드 기반의 반복적 수정 과정을 통해 구현과 불변량 등을 생성하며, 새로운 벤치마크인 LCB-Pro-Dafny를 함께 소개합니다.
TRIAGE는 에이전트 강화학습에서 행동의 역할에 따라 신용을 할당하는 새로운 프레임워크를 제안합니다. 기존 GRPO의 한계를 극복하기 위해 구조화된 판사가 행동을 분류하고 세그먼트 수준의 프로세스 보상을 제공하여 학습 효율을 높입니다.
이질적인 LiDAR 데이터로부터 6가지 주요 산림 속성을 예측하는 딥러닝 프레임워크 FLORA를 제안합니다. 옥트리 기반 백본과 보조 변수를 결합하여 계절 및 센서 가변성에 대응하며, 프랑스 데이터를 통해 높은 예측 성능을 입증했습니다.
AdaJEPA는 테스트 시점의 분포 변화에 대응하기 위해 모델 예측 제어(MPC) 내에서 테스트 시점 적응을 수행하는 적응형 잠재 세계 모델입니다. 자기 지도 학습 신호를 활용해 추가적인 전문가 데이터 없이도 모델을 지속적으로 재보정하여 계획 성공률을 높입니다.
로봇의 장기 조작 작업을 위해 자연어 선호 축을 활용하는 자유 형식 선호 학습(FPL) 방법을 제안합니다. 기존의 이진 선호도 방식보다 정교한 보상 모델 학습이 가능하며, 다양한 환경에서 성능을 크게 향상시켰습니다.
LLM이 표 데이터를 처리할 때 발생하는 데이터 참조 오류(DREs)를 체계적으로 분석하고 평가한 연구입니다. 비판자(critic) 모델을 활용한 필터링과 거부 샘플링을 통해 답변 정확도를 높이는 방법론을 제시합니다.
LLM의 환각 문제를 해결하기 위해 메타인지적 피드백을 활용한 강화학습(RLMF) 방법론을 제안합니다. 모델이 자신의 성능을 스스로 판단하고 불확실성을 정확히 표현하도록 유도하여 신뢰성을 높이는 연구입니다.
장기적 관점의 LLM 에이전트를 위한 밀집 감독(Dense supervision) 신호를 훈련 없이 직접 평가할 수 있는 새로운 테스트베드 QVal을 소개합니다. QVal은 신호의 품질을 훈련 엔지니어링 변수와 분리하여 다양한 방법론을 공통된 기반 위에서 벤치마킹할 수 있게 합니다.
언어 모델이 자신의 행동을 충실히 설명하도록 만드는 자기 설명 학습(Self-Explanation Training) 연구를 소개합니다. 고정된 반사실적 설명을 사용하더라도 모델의 행동 변화를 추적하며 충실한 자기 성찰을 생성할 수 있음을 발견했습니다.
UniTac은 촉각 이해와 생성을 통합한 최초의 멀티모달 모델(UMM)입니다. 센서와 물체의 속성을 모두 인코딩하는 이중 수준 표현을 통해 비접촉에서 접촉으로의 물리적 상호작용을 효과적으로 모델링합니다.