Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
포즈가 지정되지 않은 다중 뷰 이미지로부터 장면을 인스턴스 구조화된 3D 토큰 그룹으로 직접 분해하는 피드포워드 프레임워크를 제안합니다. 객체 중심의 토큰화를 통해 재구성, 세그멘테이션, 조작이 용이한 컴팩트한 표현 방식을 제공합니다.
여유 자유도 로봇을 이용한 다축 적층 제조(MAAM) 시 충돌을 방지하고 궤적을 최적화하는 새로운 계산 프레임워크를 제안합니다. 미분 가능한 SDF 기반 충돌 모델과 자기 운동 매니폴드 투영법을 통해 정밀한 적층과 부드러운 움직임을 구현했습니다.
SICAGE는 화자의 개별 스타일과 분리된 문화적 제스처를 생성하기 위한 모듈형 프레임워크입니다. TED4C-L 데이터셋을 활용하여 화자 독립적인 문화적 표현을 학습함으로써, 더욱 사실적이고 문화적으로 적절한 동시 발화 제스처 생성을 가능하게 합니다.
Meshtryoshka는 중첩된 메쉬 쉘 구조를 활용하여 대규모 경계 없는 장면을 재구성하는 새로운 미분 가능한 렌더링 프레임워크입니다. 기존의 객체 중심 한계를 넘어 기성품 래스터라이저와 호환되면서도 고품질의 3D 재구성을 가능하게 합니다.
과학적 도식 생성을 평가하기 위한 새로운 벤치마크인 SciDraw-Bench를 소개합니다. 기존 벤치마크가 놓친 텍스트 정확성, 구조적 품질, 학문적 관례 준수 등을 4차원 프로토콜로 측정하며, 도메인 특화 모델의 우수성을 입증했습니다.
KM-Speaker는 음성 기반 3D 얼굴 애니메이션의 품질과 제어력을 높이기 위한 새로운 키포인트 조건부 플로우 기반 생성 프레임워크를 제안합니다. 오디오 기반 입술 모션과 상안면 역학을 분리하여 정밀한 스타일 제어와 높은 입술 동기화 정확도를 달성합니다.
AEGIR은 Gaussian Splatting 환경에서 국부 면 광원(Area Emitters)을 명시적으로 모델링하여 실내 역렌더링 성능을 높이는 프레임워크입니다. 미분 가능한 지연 렌더링과 다중 중요도 샘플링을 통해 조명, 재질, 기하 구조를 정밀하게 분리하고 재조명 성능을 개선합니다.
3D 메쉬 생성 시 텍스처 정보가 손실되는 문제를 해결하기 위해, 외형을 기하학적 구조로 변환하는 GenMF 프레임워크를 제안합니다. 시각적 세부 사항을 보존하면서도 제작 시 응력 집중을 방지하는 미분 가능한 정규화 기술을 도입했습니다.
다중 뷰 이미지에서 복잡한 재질을 추출하는 미분 가능한 역 렌더링 방법론인 NeuMatEx를 제안합니다. 대규모 재질 재구성 모델(LMRM)을 통해 초기 재질 정보를 예측하고 불확실성을 가이드로 활용하여 정교한 재질 분해를 수행합니다.
3D 장면 그래프 생성(3DSGG) 시 시점 변화에 따른 관계 예측 오류를 해결하기 위한 TAD 프레임워크를 제안합니다. 방향성 술어와 안정적 술어를 분리하여 학습함으로써 시점 변화에 강건한 3D 공간 이해를 가능하게 합니다.
RGB 확산 알베도로부터 피부의 전체 스펙트럼 산란 파라미터를 예측하는 새로운 프레임워크를 제안합니다. 매질 혼합(Mixture-of-Media) 표현 방식과 신경 디코더를 사용하여 복잡한 피부의 생체물리학적 특성을 효율적으로 근사합니다.
Wan-Streamer는 실시간 시청각 상호작용을 위해 설계된 엔드투엔드 네이티브 스트리밍 파운데이션 모델입니다. 단일 Transformer 구조를 통해 언어, 오디오, 비디오를 통합 모델링하며, 기존 계층형 시스템의 지연 시간과 오류 누적 문제를 해결했습니다.
지속적인 주름을 구현하기 위해 소성(plasticity)을 모델링하는 최초의 자기지도 학습 기반 신경망 의류 시뮬레이터를 제안합니다. 물리 기반 커리큘럼 학습을 통해 탄성에서 탄소성으로 점진적으로 변화하며 학습의 안정성을 확보했습니다.
이 논문은 이분법적 데이터 시각화가 초래하는 정치적 양극화를 해결하기 위해 AI 기반의 다원적 데이터 스토리텔링 방식을 제안합니다. AI를 활용해 복잡한 의견 분포를 '의견 지형'으로 시각화함으로써 집단 간의 공통점을 발견하고 인식 격차를 해소하는 방안을 다룹니다.
저궤도(LEO) 위성 네트워크의 제한된 통신 자원을 극복하기 위해 임무 중심의 의미론적 전달 프레임워크인 SpaceRipple을 제안합니다. 픽셀 중심의 전송 대신 압축, 전달, 복원 및 추론을 조정하여 대역폭을 절감하고 임무 관련 정보를 효율적으로 전달합니다.
단색 재료로 제작 시 텍스처 정보가 손실되는 문제를 해결하기 위해, 시각적 세부 사항을 기하학적 구조로 변환하는 GenMF 프레임워크를 제안합니다. 이 기술은 외형 보존과 제작 시의 구조적 견고성 사이의 균형을 맞추는 데 집중합니다.
HiLSVA는 과학적 시각화를 위해 인간의 감독과 에이전트의 자율성을 결합한 인간 참여형(Human-in-the-Loop) 멀티 에이전트 시스템입니다. 계획 우선 아키텍처와 단계별 출처 추적을 통해 투명성을 높이고 사용자의 분석적 추론을 증강합니다.
HiPR은 인터랙티브 패스 트레이싱을 실시간처럼 구현하기 위한 동적 렌더링 스케줄링 알고리즘입니다. 광선 경로 의존성의 계층 구조를 활용해 변경된 부분의 픽셀만 우선순위에 따라 업데이트함으로써 렌더링 비용을 효율적으로 분산합니다.
다중 뷰 이미지에서 복잡한 재질을 추출하기 위한 미분 가능한 역 렌더링 방법인 NeuMatEx를 제안합니다. 대규모 재질 재구성 모델(LMRM)을 통해 재질 잠재 변수를 직접 예측하여 최적화의 어려움을 해결합니다.
3D Gaussian Splatting(3DGS)의 재구성 과정에서 발생하는 아티팩트를 진단하기 위한 시각적 분석 도구 Vis4GS를 제안합니다. Gaussian 속성, 학습 이력, 계보 등을 연결된 뷰로 제공하여 재구성 실패 원인을 정밀하게 분석할 수 있게 합니다.