Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 연구는 다음 토큰 예측 방식을 활용하여 다중 모달 생체 신호를 학습하는 수면 파운데이션 모델 'Hypnos'를 제안합니다. RQ-Transformer를 통해 EEG, ECG 등 다양한 신호를 이산 토큰으로 변환하여 학습하며, 기존 모델 대비 뛰어난 성능과 일반화 능력을 입증했습니다.
어텐션 헤드 회로를 식별하기 위해 공동 활성화 통계를 활용하는 방식의 유효성을 검증합니다. 연구 결과, 통계적 클러스터링은 회로의 후보를 제안할 뿐이며, 인과적 절제를 통한 폐쇄 검증만이 실제 회로를 확정할 수 있음을 밝힙니다.
다중 에이전트 강화학습(MARL)을 활용하여 임의의 형상과 불균일한 질량을 가진 객체를 협동 운송하기 위한 로봇 형상 제어 연구를 제안합니다. 로봇들이 장애물을 피하며 객체를 안전하게 지지할 수 있는 자율적인 위치 선정 및 패턴 형성 정책을 다룹니다.
ATN3D는 극한의 희소성 환경에서 LiDAR와 Radar를 활용한 조기 3D 객체 탐지 프레임워크를 제안합니다. 밀도 인식 융합과 거리 인식 손실 함수를 통해 원거리 객체 탐지 성능을 크게 향상시켰습니다.
FMplex는 파운데이션 모델(FM)을 가상화 기질로 활용하여 효율적인 서빙을 지원하는 시스템입니다. 공유된 물리적 백본을 통해 논리적으로 격리된 가상 모델 인스턴스를 제공함으로써 메모리 낭비를 줄이고 배치 효율을 극대화합니다.
ReCoVLA는 VLA 정책이 실패했을 때 외부 VLM을 활용해 복구 단계를 추론하고 보상을 컴파일하는 프레임워크입니다. VLM이 직접 행동을 생성하는 대신 의미론적 보상 선택기로 작동하여, 잔차 정책 학습을 통해 시뮬레이션에서 실제 환경으로의 제로샷 전이를 지원합니다.
비디오 파운데이션 모델이 직관적 물리학 정보를 인코딩하는지 계층별 프로빙을 통해 분석한 연구입니다. V-JEPA가 가장 뛰어난 성능을 보였으며, 물리학 정보는 모델의 중간 및 후기 계층에서 가장 잘 나타남을 확인했습니다.
희소하고 불규칙한 종단적 데이터를 활용하여 알츠하이머병의 진행을 예측하는 개인 맞춤형 디지털 트윈 프레임워크를 제안합니다. 임상적 전이와 시간적 의존성을 통합하여 환자별 'what-if' 시나리오 분석과 예측 불확실성 정량화를 지원합니다.
객체의 크기, 시점, 조명 변화 등 실제 환경의 변동성에 취약한 기존 이상 탐지 모델의 한계를 극복하기 위한 새로운 방법론을 제안합니다. 시각적 프롬프팅, 교사 모델 동결 해제, 확산 모델 기반 데이터 증강을 결합하여 AeBAD 데이터셋에서 성능을 크게 향상시켰습니다.
Trellis는 자연어 증명을 Lean 형식으로 변환하는 자동 형식화(autoformalization) 시스템입니다. LLM 에이전트가 프로세스 의미론에 따라 증명을 반복적으로 정교화하여 엄밀성을 확보하는 워크플로를 제안합니다.
다채널 음성 분리 시 판별 모델의 낮은 청취 품질 문제를 해결하기 위해 MeanFlow 기반의 단일 단계 생성 교정기인 MeCo를 제안합니다. DSO 기법을 통해 신호 충실도와 인간의 청취 품질을 동시에 최적화하여 SOTA 성능을 달성했습니다.
Muon 옵티마이저가 Adam 및 SGD 대비 강건성과 전이 가능성 측면에서 우수한 특징 학습 능력을 갖추었음을 입증하는 연구입니다. Transformer와 CNN 아키텍처 전반에서 더 큰 로짓 마진과 은닉 상태의 높은 다양성을 보여줍니다.
AI가 스스로 시스템을 설계, 평가 및 개선하는 '재귀적 자기 설계(Recursive Self-Design)' 패러다임을 제안합니다. MetaAI는 네 가지 핵심 기준을 갖춘 프레임워크를 제시하며, DGM과 같은 시스템을 통해 성능 향상 가능성을 입증했습니다.
ArtiFact는 박물관 기록을 활용하여 테이블, 텍스트, 이미지를 결합한 대규모 멀티모달 문화유산 데이터셋입니다. 이 연구는 교차 모달 오류 탐지와 시맨틱 쿼리 처리 능력을 평가하는 벤치마크로서의 유용성을 입증합니다.
본 논문은 대규모 패턴 공간 탐색을 위해 구문 제약 조건이 포함된 구간 패턴을 샘플링하는 CFips 프레임워크를 제안합니다. CFips는 다단계 샘플링 방식을 통해 제약 조건을 구간 경계에 대한 기본 술어로 분해하여 정확한 샘플링을 보장합니다.
기존 LLM의 사후적(post-hoc) 설명 방식의 한계를 극복하기 위해, 베이지안 네트워크를 활용한 'Glassbox Framework'를 제안합니다. 이 프레임워크는 추론 과정에 확률적 매개 계층을 도입하여 투명하고 감사 가능한 구조적 추론을 가능하게 합니다.
LRM의 과도한 사고(overthinking) 문제를 해결하기 위해 추론 과정의 동적 난이도를 모델링하는 DyCon 프레임워크를 제안합니다. 별도의 학습 없이 단계별 임베딩을 활용해 추론 깊이를 동적으로 제어함으로써 효율성을 높입니다.
DIFFRACT는 미분 가능한 프로그래밍을 활용하여 차세대 무선 네트워크의 효용을 극대화하는 신경망 기반 프레임워크입니다. 알고리즘 언롤링을 통해 반복적인 간섭 관리 알고리즘을 신경망 구조로 매핑하여 실시간 적응형 자원 관리를 지원합니다.
기업 내 에이전트 배포 실패를 방지하기 위한 '3중 고리 아키텍처'를 제안합니다. 기존 프로덕션, 전략 기반 연합 계층, LLM 프런티어 지능 계층으로 구성되며, 특히 결정론적 통제가 가능한 연합 계층의 중요성을 강조합니다.
Native3D는 2D 중간 표현을 거치지 않는 최초의 엔드투엔드 3D 장면 생성 프레임워크입니다. Transformer 기반의 통합 메쉬-텍스처 표현과 3D REPA Loss를 통해 기하학적 왜곡을 방지하고 시각적 일관성을 높였습니다.