Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
오프라인 Safe RL의 데이터 오염 공격 문제를 해결하기 위한 새로운 학습 패러다임인 Safe-RULE을 제안합니다. 재학습 없이 오염된 데이터의 영향을 제거하며, 작업 성능과 안전 제약 조건을 동시에 고려합니다.
CT-VAM은 소뇌-시상 구조에서 영감을 얻어 고수준 의도와 저수준 제어를 분리한 시각-행동 모델입니다. 68M의 경량 파라미터로도 대형 VLA 모델에 필적하는 성능을 내며, 클라우드-엣지 패러다임에 최적화된 로봇 제어를 제안합니다.
자기 적응형 및 자기 조직화 시스템의 복잡성 증가에 따른 '자기 설명 가능성(SX)'의 개념과 연구 현황을 분석한 논문입니다. 기존 접근 방식을 체계적으로 검토하여 통합 정의, 분류 체계, 그리고 SX 단계를 도입하는 프레임워크를 제안합니다.
이미지를 독립적인 추론 매체로 활용하는 '광학적 추론(Optical Reasoning)' 개념을 제안합니다. 타이포그래피와 그래픽 기반의 두 가지 방식을 통해 텍스트 기반 추론보다 높은 토큰 효율성과 우수한 성능을 입증했습니다.
AI 사용 증가로 인한 창의적 결과물의 동질화 문제를 해결하기 위해 '의미론적 반발 기술(SRT)'을 제안합니다. 연구 결과, SRT는 합의 문구를 대폭 줄이고 의미론적 다양성을 크게 높이면서도 높은 유용성과 일관성을 유지함을 입증했습니다.
AI 미니드라마가 귀여운 미학을 통해 젠더 편향성과 인종화된 서사를 은폐하는 '미학적 세탁' 기제로 작동함을 분석합니다. 페미니즘 및 비판적 인종 이론을 통해 생성형 AI 비디오의 이데올로기적 위험성을 고찰합니다.
본 연구는 다음 토큰 예측 방식을 활용하여 다중 모달 생체 신호를 학습하는 수면 파운데이션 모델 'Hypnos'를 제안합니다. RQ-Transformer를 통해 EEG, ECG 등 다양한 신호를 이산 토큰으로 변환하여 학습하며, 기존 모델 대비 뛰어난 성능과 일반화 능력을 입증했습니다.
어텐션 헤드 회로를 식별하기 위해 공동 활성화 통계를 활용하는 방식의 유효성을 검증합니다. 연구 결과, 통계적 클러스터링은 회로의 후보를 제안할 뿐이며, 인과적 절제를 통한 폐쇄 검증만이 실제 회로를 확정할 수 있음을 밝힙니다.
다중 에이전트 강화학습(MARL)을 활용하여 임의의 형상과 불균일한 질량을 가진 객체를 협동 운송하기 위한 로봇 형상 제어 연구를 제안합니다. 로봇들이 장애물을 피하며 객체를 안전하게 지지할 수 있는 자율적인 위치 선정 및 패턴 형성 정책을 다룹니다.
ATN3D는 극한의 희소성 환경에서 LiDAR와 Radar를 활용한 조기 3D 객체 탐지 프레임워크를 제안합니다. 밀도 인식 융합과 거리 인식 손실 함수를 통해 원거리 객체 탐지 성능을 크게 향상시켰습니다.
FMplex는 파운데이션 모델(FM)을 가상화 기질로 활용하여 효율적인 서빙을 지원하는 시스템입니다. 공유된 물리적 백본을 통해 논리적으로 격리된 가상 모델 인스턴스를 제공함으로써 메모리 낭비를 줄이고 배치 효율을 극대화합니다.
ReCoVLA는 VLA 정책이 실패했을 때 외부 VLM을 활용해 복구 단계를 추론하고 보상을 컴파일하는 프레임워크입니다. VLM이 직접 행동을 생성하는 대신 의미론적 보상 선택기로 작동하여, 잔차 정책 학습을 통해 시뮬레이션에서 실제 환경으로의 제로샷 전이를 지원합니다.
비디오 파운데이션 모델이 직관적 물리학 정보를 인코딩하는지 계층별 프로빙을 통해 분석한 연구입니다. V-JEPA가 가장 뛰어난 성능을 보였으며, 물리학 정보는 모델의 중간 및 후기 계층에서 가장 잘 나타남을 확인했습니다.
희소하고 불규칙한 종단적 데이터를 활용하여 알츠하이머병의 진행을 예측하는 개인 맞춤형 디지털 트윈 프레임워크를 제안합니다. 임상적 전이와 시간적 의존성을 통합하여 환자별 'what-if' 시나리오 분석과 예측 불확실성 정량화를 지원합니다.
객체의 크기, 시점, 조명 변화 등 실제 환경의 변동성에 취약한 기존 이상 탐지 모델의 한계를 극복하기 위한 새로운 방법론을 제안합니다. 시각적 프롬프팅, 교사 모델 동결 해제, 확산 모델 기반 데이터 증강을 결합하여 AeBAD 데이터셋에서 성능을 크게 향상시켰습니다.
Trellis는 자연어 증명을 Lean 형식으로 변환하는 자동 형식화(autoformalization) 시스템입니다. LLM 에이전트가 프로세스 의미론에 따라 증명을 반복적으로 정교화하여 엄밀성을 확보하는 워크플로를 제안합니다.
다채널 음성 분리 시 판별 모델의 낮은 청취 품질 문제를 해결하기 위해 MeanFlow 기반의 단일 단계 생성 교정기인 MeCo를 제안합니다. DSO 기법을 통해 신호 충실도와 인간의 청취 품질을 동시에 최적화하여 SOTA 성능을 달성했습니다.
Muon 옵티마이저가 Adam 및 SGD 대비 강건성과 전이 가능성 측면에서 우수한 특징 학습 능력을 갖추었음을 입증하는 연구입니다. Transformer와 CNN 아키텍처 전반에서 더 큰 로짓 마진과 은닉 상태의 높은 다양성을 보여줍니다.
AI가 스스로 시스템을 설계, 평가 및 개선하는 '재귀적 자기 설계(Recursive Self-Design)' 패러다임을 제안합니다. MetaAI는 네 가지 핵심 기준을 갖춘 프레임워크를 제시하며, DGM과 같은 시스템을 통해 성능 향상 가능성을 입증했습니다.
ArtiFact는 박물관 기록을 활용하여 테이블, 텍스트, 이미지를 결합한 대규모 멀티모달 문화유산 데이터셋입니다. 이 연구는 교차 모달 오류 탐지와 시맨틱 쿼리 처리 능력을 평가하는 벤치마크로서의 유용성을 입증합니다.