Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 대규모 희소 볼륨 데이터를 효율적으로 표현하고 렌더링하는 새로운 프레임워크 ESVR을 제안합니다. 기존의 3DGS 방식이 이미지 기반 학습으로 정보 손실 및 전이 함수 제어 한계를 가졌던 문제를 해결하고자 했습니다. ESVR은 타원체 프리미티브와 구조 인식 학습, 그리고 프리미티브별 레이 샘플링 전략을 결합하여 고품질 재구성 품질과 실시간 렌더링 성능을 동시에 달성합니다.
본 논문은 학술 논문의 핵심 내용을 시각화하는 그래픽 초록(GA) 생성의 한계를 극복하고자 합니다. 기존 방식이 편집 불가능한 래스터 형태로 출력되는 문제를 해결하기 위해, 벡터 형식으로 편집 가능한 GA를 생성하는 GenGA 프레임워크를 제안합니다. 이 프레임워크는 요소 단위 편집을 가능하게 하며, 구조적 독립 계수(SIC)라는 새로운 지표로 편집 용이성을 정량화했습니다.
기존의 차트 기반 채널 효과성 평가 방식에서 벗어나, 원시 시각 자극을 활용해 7가지 핵심 시각 채널의 다차원적 성능을 분석한 연구입니다. 정확도, 변별력, 분리 가능성, 팝아웃 등 다양한 지각 작업에 따라 채널의 우위가 달라짐을 입증했습니다.
현대 미술 애니메이션 생성 시 발생하는 텍text-to-video 모델의 불확실성 구조를 정량화하는 새로운 연구와 프로토콜을 제시합니다. 기존의 단순 분산 측정 방식을 넘어, 생성된 영상들의 다중 모드성, 이상치, 위상적 특징을 정밀하게 식별하는 방법을 다룹니다.
희소한 dToF 센서 데이터를 활용해 조밀한 미터법 깊이를 생성하는 일반화 가능한 프레임워크를 제안합니다. Vision Transformer와 마스크 결합 어텐션을 통해 RGB 이미지와 깊이 데이터를 효율적으로 융합하며, 시뮬레이션 파이프라인을 통해 뛰어난 제로샷 일반화 성능을 입증했습니다.
OutLangSplat은 UAV 실외 장면의 복잡한 환경에서도 텍스트 기반 3D 장면 이해가 가능하도록 설계된 새로운 3D 언어 가우시안 스플래팅 기술입니다. 2D-3D 이중 분기 표현과 신뢰도 기반 특징 집계 전략을 통해 기존 모델의 한계를 극복하고 SOTA 성능을 달성했습니다.
희소 뷰 환경에서 Splat 기반 CT 재구성 시 발생하는 아티팩트의 원인이 포즈 부정확성에 있음을 밝히고, 이를 해결하기 위한 경사 기반 프레임워크를 제안합니다. 기하학적 파라미터를 공동으로 정밀 조정하여 재구성 충실도를 높이는 연구입니다.
RORA는 단일 정적 객체 비디오를 통해 관절 구조를 가진 시뮬레이션용 에셋을 재구성하는 엔드투엔드 파이프라인을 제안합니다. 3DGS와 메쉬 기반 기하학을 결합한 하이브리드 표현을 사용하여 복잡한 운동학적 구조를 정밀하게 구현합니다.
프로젝션과 HMD를 결합한 하이브리드 몰입형 아트 환경에서 크로스 리얼리티(CR) 전환 시 발생하는 인지적 변화를 연구했습니다. 공간 정렬, 시각적 외형, 지연 시간의 불일치가 현존감과 작업 부하에 미치는 영향을 분석했습니다.
LLM 기반 CAD 에이전트의 수정 루프 문제를 해결하기 위해 TraceCAD를 제안합니다. TraceCAD는 지속적인 상태를 유지하는 복구 레이어를 통해 잘못된 연산을 진단하고, 국소적 편집과 기술 메모리를 활용하여 CAD 생성의 정확도와 효율성을 높입니다.
자연어 설명을 기반으로 Unreal Engine 5의 Niagara 시스템에서 파티클 효과를 생성하는 멀티 에이전트 프레임워크를 제안합니다. 계획과 파라미터화가 분리된 파이프라인을 통해 텍pts를 실행 가능한 절차적 로직으로 변환하고 시각적 피드백을 통해 반복 개선합니다.
StreamTalk은 실시간 Co-Speech 제스처 생성 시 발생하는 드리프트 현상을 해결하기 위해 제안된 폐쇄 루프(closed-loop) 프레임워크입니다. 키 포즈 앵커링과 생성-검색-정제 사이클을 통해 긴 시퀀스에서도 안정적인 3D 모션을 생성합니다.
자기회귀 리깅 모델을 식물 골격 재구성에 적용하기 위한 연구입니다. 기존 모델의 분지 구조 인식 한계를 분석하고, 합성 데이터셋을 활용한 미세 조정을 통해 다양한 식물 형태와 잎 구조에 대응하는 일반화 성능을 확보했습니다.
프티코그래피 재구성 과정에 검출기 정보 기반의 측정 일관성을 도입하여 광전자 SNR 한계를 극복하는 연구입니다. 픽셀 단위 센서 응답을 보정하여 신뢰도 맵을 구축함으로써, 노이즈가 심한 검출기 환경에서도 물리적으로 정확한 회절 정보를 보존합니다.
대규모 그래프 레이아웃 생성을 위해 희소 부정 샘플링(Sparse Negative Sampling)을 도입한 SNAP-tFDP 알고리즘을 제안합니다. 이 방식은 낮은 메모리 사용량과 $O(|E|)$의 시간 복잡도를 달성하며, 밀집된 클러스터를 효과적으로 분리합니다.
RL-Lock은 외부 연결 장치 없이 기하학적 배치만으로 연결되는 맞물림 조립품 생성을 위한 최초의 강화학습 프레임워크입니다. MCTS와 구조화된 액션 청킹을 결합하여 복잡한 조합론적 탐색 공간을 효율적으로 탐색하며 기존 방식보다 뛰어난 성능을 보입니다.
잔류 평균 곡률이 낮은 삼중 주기적 최소 곡면(TPMS)을 제어 가능한 방식으로 생성하는 확산 기반 프레임워크를 제안합니다. Fourier 잠재 공간과 트랜스포머 기반 확산 모델을 사용하여 대규모 데이터셋을 바탕으로 정교한 기하학적 구조를 생성합니다.
비정형 포인트 클라우드에서 효율적인 비등방성 표면 근사를 수행하는 HD-PEA 프레임워크를 제안합니다. 고차원 유클리드 포인트 임베딩과 패치 기반 메타 임베딩을 통해 대규모 데이터를 처리하며, 기존 방식보다 정밀하고 컴팩트한 3D 메쉬 재구성을 가능하게 합니다.
단일 이미지를 활용해 실사 같은 3D 헤드 아바타를 생성하는 S-Avatar 기술을 제안합니다. 확산 가이드 기반의 3D 가우시안 스플래팅과 FLAME 모델을 결합하여 시점 변화에도 일관된 고해상도 아바타를 실시간으로 구현합니다.
MeshFM은 2D 시각적 파운데이션 모델의 특징을 3D로 증류하여 3D 주석 없이도 풍부한 특징을 추출하는 피드포워드 프레임워크입니다. 최적화 과정 없이 3D 특징을 직접 예측하며, 다양한 3D 다운스트림 태스크에서 뛰어난 성능을 입증했습니다.