Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
VLA 모델의 미세 조정 시 발생하는 불안정한 Q-함수와 낮은 샘플 효율성 문제를 해결하기 위한 3단계 프레임워크 FORCE를 제안합니다. 가치 보정 웜업과 자기 증류 기술을 통해 학습 안정성을 높이고 인간의 개입 없이도 높은 성공률을 달성했습니다.
표 형식 파운데이션 모델의 어텐션 메커니즘이 민감한 데이터를 유출하여 멤버십 추론 공격(MIA)을 가능하게 함을 입증했습니다. 이를 방어하기 위해 모델 재학습 없이도 유출을 줄이는 추론 시점 방어 기법을 제안합니다.
MLLM의 다중 뷰 구조적 추론 능력을 평가하기 위한 새로운 벤치마크인 TriViewBench를 소개합니다. 18개 모델을 평가한 결과, 복잡도가 높아질수록 성능이 급격히 저하되며 특히 전역적 복구 작업에서 심각한 성능 붕괴가 나타남을 확인했습니다.
AI 에이전트가 시스템 제어권을 탈취하는 '탈출 가능성' 문제를 해결하기 위해, 런타임 내부가 아닌 외부 아키텍처 수준에서 제어하는 'Unfireable Safety Kernel'을 제안합니다. Rust 기반의 이 커널은 프로세스 분리와 페일 클로즈 속성을 통해 에이전트의 권한 남용을 원천 차단합니다.
사전 학습 과정에서 특정 규칙이 학습되었다가 다시 사라지는 '자연스러운 언그로킹(Natural Ungrokking)' 현상을 분석한 연구입니다. 모델의 손실 곡선 변화 없이도 코퍼스의 통계적 빈도에 따라 규칙의 생존 여부가 결정됨을 밝혀냈습니다.
모델의 우려스러운 행동이 단순한 오류인지 아니면 악의적인 정렬 불량인지 조사하는 '모델 포렌식' 프로토콜을 제안합니다. CoT 분석과 환경 수정을 통해 행동의 원인을 가설화하고 검증하는 2단계 베이스라인을 제시합니다.
물리 정보 신경망(PINN)과 자기지도 학습을 결합한 SimPhysNet 알고리즘을 통해 레이저 용접의 용입을 예측하는 연구입니다. 적은 양의 라벨링 데이터만으로도 높은 정확도를 달성하여 산업 현장의 데이터 제약 문제를 해결합니다.
레이저 및 TIG 용접 공정 간의 도메인 변화 문제를 해결하기 위해 비지도 도메인 적응(UDA) 프레임워크를 제안합니다. GSDE 전략을 통해 재라벨링 비용 없이도 높은 예측 정확도를 달성하며 공정 간 전이 성능을 크게 향상시켰습니다.
LLM 에이전트를 위한 별도의 보상 모델 학습 없이, RL 사후 학습 과정에서 발생하는 '진전 우위(progress advantage)'를 활용하는 새로운 연구를 소개합니다. 이 방식은 주석이 필요 없고 도메인에 구애받지 않으며, 기존 보상 모델보다 뛰어난 성능을 보여줍니다.
온폴리시 자기 증류(On-policy self-distillation)가 모델의 출력 다양성을 감소시키고 pass@k 성능 향상을 저해하는 현상을 분석합니다. 샘플링된 데몬스트레이션 사용 시 발생하는 복합적인 편향이 모델의 분포를 특정 모드에 집중시켜 다양성을 해친다는 점을 이론적으로 규명했습니다.
VLA 모델의 행동 모듈이 물리적 움직임을 처음부터 학습해야 하는 한계를 극복하기 위해, 움직임 사전 지식(motion priors)을 활용한 2단계 학습 프레임워크를 제안합니다. 1단계에서 행동 궤적을 통해 시간적 움직임 구조를 먼저 학습한 후, 이를 VLA 학습으로 전이하여 수렴 속도와 성공률을 높였습니다.
브라질 이커머스 환경에서 제품 속성 값을 정확하게 추출하기 위한 LLM 기반 시스템인 AI-PAVE-Br을 제안합니다. 포르투갈어의 언어적 복잡성을 해결하기 위해 수동으로 주석을 단 'Golden Set' 데이터셋을 함께 공개합니다.
FlowPipe는 LLM의 논리적 사전 지식과 C-GFlowNets를 결합하여 데이터 준비 파이프라인을 자동으로 구축하는 통합 프레임워크입니다. 기존 Multi-DQN 방식의 한계를 극복하여 데이터셋 문맥을 반영하고 탐색 효율성을 높였습니다. 실험 결과, 기존 SOTA 대비 정확도 11.96% 향상 및 12.5배 빠른 학습 수렴을 달성했습니다.
LaGO는 LLM을 직접적인 컨트롤러로 사용하는 대신, 온라인 강화학습을 위한 잠재 행동 사전 정보(latent action prior)로 활용하는 새로운 프레임워크를 제안합니다. CLEVR-Robot 및 Meta-World 벤치마크 실험을 통해 기존 PPO 방식보다 높은 성공률과 보상을 달성하며 LLM의 계획 수립 능력을 입증했습니다.
확률적 분포 하에서 명제 공식 평가 비용을 최소화하는 결정론적 평가 전략을 연구합니다. 분기 한정 알고리즘을 통해 변수 선택, 가지치기, 캐싱을 활용한 실용적인 정확 알고리즘을 제시합니다.
시각 정보 없이 촉각만으로 물체의 위치를 파악하고 식별하는 로봇 탐색 프레임워크 TACTFUL을 제안합니다. 실제 하드웨어에서 학습된 단일 정책을 통해 전역 탐색과 국소 정밀화를 수행하며 높은 객체 식별 성능을 입증했습니다.
희소 오토인코더(SAE)의 해석 가능성을 정량적으로 평가하기 위한 새로운 인간 기반 프레임워크를 제안합니다. 사용자 연구 없이도 잠재 변수와 주석된 개념 간의 정렬을 측정하며, 합성 벤치마크와 새로운 매칭 절차를 통해 성능을 검증합니다.
Spheroid BlockTrain은 모델을 독립적인 블록으로 분할하여 학습하는 분산형 프로토콜을 제안합니다. 각 워커는 단일 블록만 학습하여 메모리 효율을 높이며, 추론 시에는 이를 결합하여 성능을 유지합니다. 실험 결과, 기존 Transformer 모델과 유사한 성능을 보이면서도 분산 환경에서의 효율성을 입증했습니다.
대규모 코퍼스에서 고품질 구조화 데이터를 수집할 때 발생하는 높은 비용과 추론 부하 문제를 해결하기 위한 연구입니다. 어노테이션 작업을 하위 작업으로 분해하여 전체적인 추론 부하를 줄이고 효율성을 높이는 방법론을 제안합니다.
Flow-Matching 기술을 활용하여 음성 향상(Speech Enhancement)의 효율성을 높이는 새로운 Skip-free 백본 구조를 제안합니다. U-Net의 스킵 연결 대신 잠재 표현 정렬(LRA)을 사용하여 적은 추론 단계만으로도 고품질의 음성 복원이 가능함을 입증했습니다.