Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
AtlasLC는 XR 환경 배포를 위해 설계된 객체 중심 3D Gaussian Splatting(3DGS) 압축 파이프라인입니다. 별도의 학습 없이 소스 프리 방식으로 작동하며, 로컬 경쟁 가지치기와 아틀라스 패킹을 통해 압축 속도와 디코딩 효율을 획기적으로 개선했습니다.
삼각형 메쉬 학습을 위해 내재성과 삼각측량 불가지론을 갖춘 새로운 어텐션 메커니즘을 제안합니다. FEM 이산화를 활용하여 메쉬 기반 아키텍처와 포인트 클라우드 트랜스포머의 성능을 뛰어넘는 최첨단 결과를 달성했습니다.
다중 에이전트 군중 시뮬레이션에서 LLM 에이전트 간의 정서 전염(emotional contagion) 현상을 연구한 논문입니다. 별도의 직접적인 전달 메커니즘 없이 인지-평가-표현 루프를 통해 정서가 어떻게 창발적으로 전파되는지 분석합니다.
실시간 카메라 제어가 가능한 범용 비디오 월드 모델 Wonder를 소개합니다. 새로운 카메라 컨디셔닝, 희소 어텐션 기반 메모리 메커니즘, 증류 파이프라인을 통해 긴 시간 동안 일관된 비디오 생성을 지원합니다.
MMOE는 Diffusion Transformer를 현대화하기 위해 LLM의 효율적인 확장 원칙을 적용한 새로운 아키텍처입니다. 공유 및 경량 전문가, 게이트-잔차 라우팅 등을 통해 생성 품질과 비용 간의 최적의 균형을 달성했습니다.
3D Gaussian Splatting(3DGS)의 파라미터를 직접 조작하여 메쉬 없이도 도메인 랜덤화(DR)를 수행하는 새로운 프레임워크를 제안합니다. 광도와 기하학적 형상을 조절하는 두 가지 섭동 파이프라인을 통해 복잡한 유기적 대상에 대한 강건한 합성 데이터를 생성합니다.
T2I 모델의 급격한 발전으로 인한 합성 이미지 출처 식별(SIA) 문제를 해결하기 위해 의미론적 딥러닝과 수학적 포렌식 특징을 결합한 앙상블 프레임워크를 제안합니다. 이 방식은 후처리 연산이 가해진 이미지에서도 높은 정확도를 보이며, CPU 환경에서도 실행 가능한 높은 효율성을 자랑합니다.
3D Gaussian Splatting을 활용하여 대규모 입자 시뮬레이션 데이터를 효율적으로 압축하고 렌더링하는 ParticleGS 프레임워크를 제안합니다. 기존 압축 방식보다 높은 시각적 충실도를 유지하면서도 매우 빠른 렌더링 속도를 제공합니다.
GNM Head는 머리, 얼굴, 안구, 구강 내부를 포함하는 새로운 생성적 인체 측정 파라메트릭 모델입니다. 고해상도 3D 스캔과 아티스트 제작 샘플을 결합하여 기존 모델의 해부학적 한계를 극복하고 정밀한 공간 제어를 가능하게 합니다.
Deformable Triangle Splatting은 기존의 볼록한 Primitives 한계를 극복하기 위해 제어점을 활용한 비볼록(non-convex) 삼각형 형상 표현 방식을 제안합니다. 미분 가능한 래스터화 파이프라인을 통해 시점 일관성을 유지하며, 효율적인 렌더링과 높은 시각적 품질을 동시에 달면합니다.
미분 가능한 렌더러를 활용하여 특정 지표에 대한 장면 파라미터의 중요도를 분석하는 방법론을 제안합니다. 역방향 미분을 통해 이미지 형성 과정의 기여도를 파악하며, 지표에 따라 중요도가 달라짐을 입증합니다.
3D-GIMP는 3D Gaussian Splatting 환경에서 고충실도 객체 제거를 위해 제안된 새로운 하이브리드 인페인팅 패러다임입니다. 단 한 번의 생성적 인페인팅과 3D 인지 PatchMatch를 결합하여 다중 뷰 불일치 문제를 해결하고 렌더링 속도와 일관성을 높였습니다.
이미지, 비디오, 오디오 처리를 위한 고성능 FIR 필터 근사화 기술을 제안합니다. 경사 하강법을 통해 성능과 품질의 최적 균형을 찾는 파레토 프런티어 알고리즘을 생성하며, 이를 최적화된 C++ 코드로 자동 변환합니다.
ECoNGS는 볼륨 시각화(VolVis)를 위해 경량 신경망과 앵커 포인트를 활용하여 가우시안 스플래팅을 효율적으로 압축하는 프레임워크입니다. 암시적 표현의 압축성과 명시적 프리미티브의 고성능 렌더링을 결합하여 모델 크기와 학습 시간을 획기적으로 줄였습니다.
UVFaceFusion은 UV 공간에서의 신경 융합을 통해 야생 환경에서도 일관된 얼굴 기하학을 재구성하는 새로운 프레임워크를 제안합니다. 기존 방식의 위상 최적화 문제를 해결하여 고정된 위상의 고충실도 메쉬를 빠르게 생성합니다.
Diffusion Transformers(DiTs)에서 텍스트나 이미지 입력을 특정 마스크 영역에 정밀하게 정렬하는 'Appearance Pointers' 기술을 소개합니다. 모델을 재학습하지 않고도 공간적 배치와 재질을 제어할 수 있는 양식 불가지론적 인터페이스를 제공합니다.
미분 가능한 렌더러 없이도 역렌더링 문제를 해결할 수 있는 FIDE 프레임워크를 제안합니다. ViT의 시각적 특징을 활용한 확산 모델과 CMA 진화 전략을 결합하여, 기존 방식의 한계인 지역 최솟값 문제를 극복하고 수렴 성능을 향상시켰습니다.
패킷 손실이 발생하는 네트워크 스트리밍 환경에서 3D 가우시안 스플래팅(3DGS)의 렌더링 품질을 유지하기 위한 새로운 압축 및 오류 은폐 프레임워크를 제안합니다. 원자적 패키징과 GNN 기반의 속성 인페인팅 기술을 통해 패킷 손실 시 발생하는 렌더링 아티팩트를 최소화합니다.
FastVEM은 복잡한 경계 기하학을 가진 환경에서 효율적인 유체-경계 상호작용을 시뮬레이션하는 새로운 프레임워크를 제안합니다. 가상 요소법(VEM)과 개선된 다중 격자 솔버를 통해 기존 cut-cell 방식 대비 압력 투영 단계를 최대 100배 가속화합니다.
과학적 방법론 도식의 구조적 충실도를 보장하기 위한 새로운 생성 프레임워크 SciForma를 소개합니다. 구성 요소, 화살표, 텍스트의 세 가지 축을 기반으로 한 다차원 결합 선호 최적화(M-DPO)를 통해 기존 모델의 한계를 극복했습니다.