Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Lossless-INR는 비트 평면 분해를 활용하여 3D 과학적 볼륨 데이터를 손실 없이 재구성하는 새로운 INR 프레임워크입니다. 옥트리 블록 분할과 삼진 특징 그리드 네트워크를 통해 제로 비트 오차율을 달성하며 정밀한 데이터 복구를 가능하게 합니다.
교육용 애니메이션 생성 시 발생하는 기하학적 충돌 문제를 해결하기 위한 SGA 모듈을 제안합니다. LLM이 생성한 코드를 분석하여 장면 그래프를 추출하고, 공간적 무결성을 검증하는 MVQS 지표를 통해 시각적 정확도를 높입니다.
사용자의 모호한 지침과 3D 도구의 정밀한 요구 사항 사이의 '의도 비대칭성'을 해결하기 위한 자기 진화형 에이전트 CLARE를 제안합니다. CLARE는 대화를 통해 지침을 명확화하며, 시뮬레이션된 상호작용을 통해 명확화 정책을 스스로 진화시켜 3D 생성 및 편집 작업의 성공률을 높입니다.
TopoGS는 3D Gaussian Splatting(3DGS)에 위상 제약 조건을 통합하여 일관된 평면 재구성을 수행하는 새로운 프레임워크입니다. 다중 뷰 이미지 세그멘테이션을 통해 전역적 위상 관계를 추출하고 가우시안 프리미티브를 고정함으로써, 파편화된 재구성 문제를 해결하고 구조화된 3D 모델을 생성합니다.
포인트 클라우드에서 임의의 해상도로 빠른 점별 부호 거리(Signed Distance)를 계산하는 새로운 방법을 제안합니다. 토러스(Tori)를 활용한 국소적 피팅 방식을 통해 전역 최적화 없이도 효율적인 형상 재구성과 거리 쿼리를 가능하게 합니다.
CNS-Edit++는 결합된 신경 형상(CNS) 표현과 신경 특징 볼륨 최적화를 활용하여 카테고리에 구애받지 않는 3D 형상 편집 프레임워크를 제안합니다. 파운데이션 모델을 통해 복사, 크기 조정, 삭제 등 다양한 편집 연산을 수행하며 높은 정밀도를 보여줍니다.
Text-to-motion 모델이 동작의 개별 획(stroke)을 정밀하게 제어할 수 있도록 Action Units(AUs) 개념을 도입한 연구입니다. 경량 게이트 어댑터와 훈련이 필요 없는 분류기 그래디언트를 통해 동작의 타이밍과 궤적을 획 단위로 정교하게 조절합니다.
본 연구는 자율주행 시뮬레이션의 핵심인 3D Gaussian Splatting (3DGS) 월드를 효율적으로 생성하는 Instant NuRec을 제안합니다. 이 모델은 짧은 다중 시점 주행 로그를 단일 순방향 패스로 변환하여, 기존 방법 대비 재구성 속도를 크게 향상시키고 PSNR 성능도 개선했습니다.
본 논문은 텍스트 안내 기반의 3D 메쉬 변형 과정에서 포즈 일관성을 유지하는 PoseAlign을 제안합니다. 이 방법은 전역 포즈 스케일링과 국소 디테일 조형 두 단계로 과정을 분해하여, 라플라시안 도입 및 새로운 포즈 정렬 SDS 손실을 사용합니다. 이를 통해 텍스트 프롬프트에 부합하면서도 원래의 포즈를 효과적으로 보존할 수 있습니다.
본 논문은 식물나무와 같이 복잡하게 변형되는 3D 나무 모양 객체를 분석하고 생성하기 위한 새로운 수학적 프레임워크를 제안합니다. 기존 연구의 한계를 넘어, 가지의 기하학적 형태와 상호 연결 구조를 모두 정확히 모델링하는 것이 특징입니다. 이를 위해 Square Root Normal Fields (SRNF) 표현을 일반화하고, 리만 계량이 장착된 새로운 나무 모양 공간을 정의했습니다.
본 논문은 3D 재구성의 난제인 실내 환경의 기하학적 이질성을 해결하기 위해 CASA-SDF 프레임워크를 제안합니다. 이는 커리큘럼 인식 공간 적응(Curriculum-Aware Spatial Adaptation)을 통해 감독과 표현 능력을 보완적으로 적응시킵니다. 특히, 곡률 기반 밀도 변환 및 불확실성 어닐링 전략으로 평면의 안정성과 얇은 구조물의 디테일 복구를 동시에 개선합니다.
ThinkBLOX는 기존 VLM 기반 3D 실내 장면 생성의 한계(원샷 패러다임, 전역 재최적화 필요)를 극복하기 위해 제안된 점진적 추론 프레임워크입니다. 이 프레임워크는 레이아웃 생성을 상태 조건부 단계별 추론 및 행동 과정으로 간주합니다. ThinkBLOX-Data-200K 데이터셋과 Tier-Decoupled GDPO라는 강화학습 방식을 도입하여 물리적/의미적 타당성이 높은 3D 장면 합성을 가능하게 합니다.
본 논문은 체적 역추론(Volumetric inverse rendering)을 위해 물리적으로 완전한 광 전달과 범용 신경 최적화를 통합하는 새로운 정식화를 제안합니다. 이 방법은 매질의 광학적 특성과 전체 광장을 신경 필드로 표현하고, 공동 최적화 과정을 통해 추정하여 전역 조명 하에서 정확한 재구성을 가능하게 합니다.
본 논문은 3D Gaussian Splatting(3DGS)의 계산 비용 문제를 해결하기 위해 새로운 분리형 복사 에너지 표현을 제안합니다. 저주파 기하학과 시점 의존적 외관 특징을 2D surfels로 모델링하고, 고주파 텍스처는 공간 해시 그리드에 압축하여 텍스처 아틀라스에 구워냅니다. 이 방법은 희소성 최적화를 통해 속도와 시각적 충실도를 동시에 크게 향상시켜 실시간 4K 렌더링을 가능하게 합니다.
본 논문은 단순 연결되지 않은 곡면에서의 비점성 유체 시뮬레이션을 위한 적응형 유체 코호몰로지(Adaptive Fluid Cohomology) 프레임워크를 제안합니다. 이 방법은 사후 오차 추정 기반의 동적 공간/시간 정제와 표준 시간 단계 기법을 결합하여, 고해상도 정확도를 유지하면서 메모리 사용량을 크게 줄입니다.
본 논문은 로봇의 액추에이터 동역학 및 외부 힘 인식을 개선하기 위한 신경 구동기 모델인 NeuralActuator를 제안합니다. 이 모델은 저가형 서보 플랫폼에서 궤적 전파, 센서 없는 힘 예측, 모터 상태 점수 예측을 수행하며, 이를 위해 Neural Actuation Dataset (NAD)도 함께 공개했습니다.
본 논문은 텍스트-이미지 개인화 모델에서 미세한 정체성 튜닝 방법을 제안합니다. 기존 방법들이 부족했던 얼굴 편집의 정밀도를 높여, 특정 정체성의 잠재적 표현을 수정함으로써 일관된 이미지를 생성할 수 있게 합니다. 이 접근 방식은 추가 학습 없이 고정된 인코더의 잠재 공간을 탐색하여 의미 있는 방향을 발견하는 것이 핵심입니다.
본 논문은 사실적인 디지털 휴먼을 위한 이인 대화 동작 생성 문제를 다룹니다. 기존 방식의 한계를 극복하기 위해, Learn2Chat이라는 통합 프레임워크를 제안합니다. 이는 사전 훈련된 모노로그 동작 사전을 활용하여 상호작용 변조로 이인 동작을 모델링함으로써, 음성 주도 동작과 사회적 피드백을 분리하고 구조화된 상호작용 모델링을 가능하게 합니다.
LATO.2는 정점 흐름과 연결성 흐름을 분리하여 3D 메시를 생성하는 새로운 프레임워크입니다. 이 방식은 기존의 잠재 공간 결합 방식을 개선하여, 기하학적 충실도와 위상 구조의 품질을 동시에 높였습니다. 이를 통해 부분별 고해상도 합성 및 위상 적응형 편집이 가능합니다.
본 논문은 텍스트 프롬프트에 맞춰 3D 메시를 변형하면서도 원래의 자세(pose) 일관성을 유지하는 PoseAlign을 제안합니다. 이 방법은 전역 자세 스케일링과 국부 디테일 조각이라는 두 단계로 과정을 분해하여, 라플라시안 기반의 효율적인 전역 변형과 새로운 자세 정렬 손실 함수를 사용합니다.