Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
4D 가우시안 스플래팅(4DGS) 콘텐츠의 효율적인 저장과 전송을 위한 새로운 포맷인 TSOG를 제안합니다. TSOG는 시간적·공간적 정렬을 통해 파일 크기를 90% 이상 획기적으로 줄이면서도 품질 저하를 최소화합니다.
Blade를 활용하여 개별 리소스 추적 없이 글로벌 패스 배리어를 사용하는 방식의 성능을 연구했습니다. NVIDIA와 AMD 등 다양한 GPU 벤더를 대상으로 비교 분석한 결과, 특정 조건에서 GPU span을 크게 절감할 수 있음을 확인했습니다.
CG-World는 월드 모델 학습을 위해 컴퓨터 그래픽스 파이프라인에서 추출한 대규모 월드 상태 데이터셋 및 프로토콜입니다. 멀티모달 시맨틱, 물리 캐시, 개입 학습을 위한 브랜치 계보 등을 포함하여 체화된 지능과 물리적 AI 연구를 지원합니다.
AtlasLC는 XR 환경 배포를 위해 설계된 객체 중심 3D Gaussian Splatting(3DGS) 압축 파이프라인입니다. 별도의 학습 없이 소스 프리 방식으로 작동하며, 로컬 경쟁 가지치기와 아틀라스 패킹을 통해 압축 속도와 디코딩 효율을 획기적으로 개선했습니다.
삼각형 메쉬 학습을 위해 내재성과 삼각측량 불가지론을 갖춘 새로운 어텐션 메커니즘을 제안합니다. FEM 이산화를 활용하여 메쉬 기반 아키텍처와 포인트 클라우드 트랜스포머의 성능을 뛰어넘는 최첨단 결과를 달성했습니다.
다중 에이전트 군중 시뮬레이션에서 LLM 에이전트 간의 정서 전염(emotional contagion) 현상을 연구한 논문입니다. 별도의 직접적인 전달 메커니즘 없이 인지-평가-표현 루프를 통해 정서가 어떻게 창발적으로 전파되는지 분석합니다.
설계 의도를 슬라이서 프로젝트로 자동 변환하여 기능적 경사(Functionally Grading)를 부여하는 새로운 워크플로우를 제안합니다. 이 방식은 수동 설정을 대체하여 재료, 경로, 공정 조건을 정밀하게 제어하며 FFF 제작의 효율성을 높입니다.
실시간 카메라 제어가 가능한 범용 비디오 월드 모델 Wonder를 소개합니다. 새로운 카메라 컨디셔닝, 희소 어텐션 기반 메모리 메커니즘, 증류 파이프라인을 통해 긴 시간 동안 일관된 비디오 생성을 지원합니다.
MMOE는 Diffusion Transformer를 현대화하기 위해 LLM의 효율적인 확장 원칙을 적용한 새로운 아키텍처입니다. 공유 및 경량 전문가, 게이트-잔차 라우팅 등을 통해 생성 품질과 비용 간의 최적의 균형을 달성했습니다.
3D Gaussian Splatting(3DGS)의 파라미터를 직접 조작하여 메쉬 없이도 도메인 랜덤화(DR)를 수행하는 새로운 프레임워크를 제안합니다. 광도와 기하학적 형상을 조절하는 두 가지 섭동 파이프라인을 통해 복잡한 유기적 대상에 대한 강건한 합성 데이터를 생성합니다.
T2I 모델의 급격한 발전으로 인한 합성 이미지 출처 식별(SIA) 문제를 해결하기 위해 의미론적 딥러닝과 수학적 포렌식 특징을 결합한 앙상블 프레임워크를 제안합니다. 이 방식은 후처리 연산이 가해진 이미지에서도 높은 정확도를 보이며, CPU 환경에서도 실행 가능한 높은 효율성을 자랑합니다.
AMD의 ROCm 소프트웨어 스택을 활용하여 VLA(시각-언어-행동) 모델과 체화된 에이전트를 구현하는 Real2Sim2Real 파이프라인을 제안합니다. CUDA 없이도 Radeon GPU와 Ryzen AI를 통해 로봇 조작 및 강화학습을 수행할 수 있음을 입증합니다.
3D Gaussian Splatting을 활용하여 대규모 입자 시뮬레이션 데이터를 효율적으로 압축하고 렌더링하는 ParticleGS 프레임워크를 제안합니다. 기존 압축 방식보다 높은 시각적 충실도를 유지하면서도 매우 빠른 렌더링 속도를 제공합니다.
GNM Head는 머리, 얼굴, 안구, 구강 내부를 포함하는 새로운 생성적 인체 측정 파라메트릭 모델입니다. 고해상도 3D 스캔과 아티스트 제작 샘플을 결합하여 기존 모델의 해부학적 한계를 극복하고 정밀한 공간 제어를 가능하게 합니다.
Deformable Triangle Splatting은 기존의 볼록한 Primitives 한계를 극복하기 위해 제어점을 활용한 비볼록(non-convex) 삼각형 형상 표현 방식을 제안합니다. 미분 가능한 래스터화 파이프라인을 통해 시점 일관성을 유지하며, 효율적인 렌더링과 높은 시각적 품질을 동시에 달면합니다.
미분 가능한 렌더러를 활용하여 특정 지표에 대한 장면 파라미터의 중요도를 분석하는 방법론을 제안합니다. 역방향 미분을 통해 이미지 형성 과정의 기여도를 파악하며, 지표에 따라 중요도가 달라짐을 입증합니다.
3D-GIMP는 3D Gaussian Splatting 환경에서 고충실도 객체 제거를 위해 제안된 새로운 하이브리드 인페인팅 패러다임입니다. 단 한 번의 생성적 인페인팅과 3D 인지 PatchMatch를 결합하여 다중 뷰 불일치 문제를 해결하고 렌더링 속도와 일관성을 높였습니다.
이미지, 비디오, 오디오 처리를 위한 고성능 FIR 필터 근사화 기술을 제안합니다. 경사 하강법을 통해 성능과 품질의 최적 균형을 찾는 파레토 프런티어 알고리즘을 생성하며, 이를 최적화된 C++ 코드로 자동 변환합니다.
3D Gaussian Splatting과 메쉬 재구성 결과물을 혼합 현실(MR) 환경에서 실시간으로 비교할 수 있는 MR-Compare 프레임워크를 제안합니다. Meta Quest 3를 활용해 두 모델 간의 공간적 정렬을 센티미터 수준의 오차로 구현하며, 사용자 연구를 통해 높은 사용성을 입증했습니다.
AR 안경의 전력 제한 문제를 해결하기 위해 지각 품질을 극대화하는 톤 매핑 프레임워크를 제안합니다. 학습 기반의 최적화 전략과 경량 신경망 증류 기술을 통해 실시간 배포가 가능한 전력 효율적 디스플레이 기술을 선보입니다.