Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 LLM 추론 가속화 기법인 투기적 디코딩(Speculative Decoding)을 연속 확산 모델에 효율적으로 적용하는 새로운 방법을 제안합니다. 기존 방식의 계산적 비효율성을 해결하기 위해, 블록 검증 메커니즘을 확산 모델에 성공적으로 구현했습니다.
본 논문은 시간 의존적 편미분 방정식(PDEs)을 해결하는 신경 연산자 분야의 한계를 개선하고자 합니다. 기존 메모리 증강 방식이 고정된 메모리 가중치를 사용해 적응성이 떨어진다는 문제점을 지적하고, 학습 가능한 게이트를 통해 메모리 가중치를 동적으로 조절하는 AMGFNO 모델을 제안했습니다.
본 연구는 그래프 신경망(GNN)을 활용하여 노드 속성 정보를 통합한 새로운 그래프 클러스터링 프레임워크를 제안합니다. 이 프레임워크는 완전히 비지도 학습 환경에서 자기 학습 라운드를 통해 작동하며, 매 라운드마다 GNN이 노드 표현을 생성하고 이를 기반으로 클러스터링을 수행합니다.
본 연구는 대규모 네트워크의 결함 전파를 포착하고, 고객 영향도를 근본 원인에 인과적으로 귀속시키는 NetCause라는 자기 지도 학습 기반 프레임워크를 제안합니다. 이 모델은 네트워크 사고를 그래프-시간 프로세스로 모델링하고 반사실적 시뮬레이션을 활용하여 후보 근본 원인을 순위화합니다. 실제 클라우드 서비스 데이터를 사용해 개발되었으며, 기존 방식 대비 높은 정확도 향상을 보였습니다.
본 논문은 적응형 디코딩을 위해 임의 길이 이산 확산 모델에 대한 보상 안내 미세 조정 프레임워크인 A2D2를 제안합니다. A2D2는 삽입 및 마스킹 정책을 공동 최적화하고 품질 기반 추론 스케줄을 통해 이론적으로 수렴함을 증명했습니다. 이를 통해 기존 방식 대비 생성 유연성과 정확도를 모두 향상시킵니다.
본 논문은 독립적인 세 개의 일관된 분류기(consistent classifiers)를 사용한 다수결 투표가 실현 가능한 PAC 설정에서 최적의 학습기임을 증명합니다. 이는 가장 단순한 투표 방식이 구조적 및 확률론적으로 우월함을 입증하며, 기존 배깅 분석을 간소화하는 중요한 연구 결과를 제시합니다.
본 논문은 지속 학습(Continual Learning)에서 발생하는 '파국적 망각'의 원인을 기하학적으로 분석했습니다. 연구진은 회복 가능성을 나타내는 복구 부분 공간 차원성($k_t$)을 도입하고, 이 값이 훈련 전반에 걸쳐 안정적으로 유지됨을 발견했습니다. 이는 망각된 지식이 파괴되는 것이 아니라 접근성 및 다양체 정렬 문제임을 시사합니다.
합성 데이터 생성(SDG) 과정에서 민감한 그룹 간 데이터 효용이 불균등하게 나타나는 '불균등한 영향(Disparate Impact)' 문제를 분석합니다. 근사 오차, 추정 오차, 샘플링 오차의 원인을 규명하고 이를 개선하기 위한 그룹별 모델 학습 전략을 제안합니다.
시공간 예측의 '시간적 신기루' 현상을 해결하기 위한 MP3 사전 학습 플러그인을 제안합니다. 다중 주기 패턴 학습과 공간 모델링을 통해 기존 STGNN의 한계를 극복하고 예측 성능을 크게 향상시켰습니다.
본 논문은 노이즈가 많고 고차원적인 측정값에서 잠재 동역학 시스템을 식별하는 문제를 다룹니다. 'DYSCO'라는 다중 뷰 시간 대조 학습 알고리즘을 제시하여, 여러 독립적 관측 뷰를 활용해 신호와 노이즈를 분리하고 잠재 궤적과 지배 역학을 동시에 복구합니다.
본 연구는 분산 및 연합 환경에서 비동기 SGD의 수렴성 문제를 다룹니다. 경사 클리핑(gradient clipping)이 업데이트 지연에 따른 부정적 영향을 제거하고, 높은 확률에서의 수렴을 보임을 이론적으로 증명했습니다.
본 논문은 사후 학습 양자화(PTQ)를 동적 시스템 안정성 관점에서 재구성한 '궤적 기반 양자화 민감도 점수(TQS)'를 제안합니다. TQS는 네트워크 전개를 이산 시간 동적 시스템으로 모델링하여, 양자화 오차가 지평선에 걸쳐 어떻게 전파되고 증폭되는지 특성화합니다. 이를 통해 보정 데이터 없이도 효율적인 혼합 정밀도 프레임워크(TQS-PTQ)를 구축할 수 있습니다.
본 논문은 이미지 및 비디오 생성의 핵심 아키텍처인 Diffusion Transformers(DiTs)의 효율적인 서빙 문제를 다룹니다. 기존 시스템의 정적 병렬 처리 방식이 DiT 워크로드의 이질성을 반영하지 못해 낮은 GPU 활용률과 서비스 품질 저하를 초래한다고 지적합니다. 이에 따라, 요청에 맞춰 병렬 처리를 동적으로 조정하는 탄성(elastic) 서빙 프레임워크 GF-DiT를 제안하며, 이를 통해 처리량 향상 및 지연 시간 감소 등의 성능 개선을 입증했습니다.
본 논문은 로봇 제어를 위한 비디오 예측 패러다임인 World Action Models (WAMs)의 한계를 극복한 MaskWAM을 제안합니다. MaskWAM은 마스크를 명시적 입력이자 예측으로 통합하여 객체 중심의 의미론적 감독을 제공함으로써, 기존 WAM의 공간적 병목 현상과 참조 모호성을 개선했습니다.
본 논문은 그래프 기반 인과 발견 기법을 활용하여 클라우드 네트워크 사고의 근본 원인 분석(RCA)에 새로운 접근 방식을 제시합니다. 시공간적 그룹화와 자동화 온톨로지를 도입해 복잡성을 줄이고, 이변량 Granger 인과성 및 조건부 독립성 테스트를 통해 인과 그래프를 구성했습니다. 실제 클라우드 운영 데이터셋에서 높은 정확도를 보여 실용성이 입증되었습니다.
본 논문은 높은 게이지 이론의 개념을 차용한 '조정된 컵 곱 신경 계층'을 제안합니다. 이 계층은 조정 항과 컵 곱을 결합하여 설계상 게이지 불변성을 갖는 판독 결과를 생성하는 새로운 신경 원시 요소입니다.
본 논문은 학습 이론의 근본적인 질문을 다루며, 데이터 생성 과정의 종속성 문제를 해결하기 위한 '시뮬레이트 가능한 과정' 프레임워크를 제안합니다. 이 시뮬레이터 접근법만으로도 독립적 데이터 환경과 동일한 강력한 학습 보장(VC 차원 기반 오차 경계)을 회복할 수 있음을 증명했습니다.
본 논문은 부트스트랩 기반 배깅 앙상블의 학습 후 압축 및 확률 보정을 위한 새로운 프레임워크인 Simplex-Constrained Sparse Bagging (SCSB)를 제안합니다. SCSB는 OOB 손실 최소화를 통해 결합 최적화 문제로 앙상블 가지치기 및 보정을 공식화하며, 오목한 이차 페널티를 도입하여 희소성을 유도합니다.
본 연구는 공유 MIDI 코퍼스를 활용하여 바흐 스타일의 기보 피아노 음악을 생성하는 모델링 방법을 비교 분석했습니다. Attention 기반 자기회귀적 LSTM, 잠재 변수 기반 VAE(벡터 양자화 포함), 그리고 GAN 세 가지 접근 방식을 비교한 결과, Attention-LSTM이 가장 높은 음악적 일관성을 보였습니다.
본 논문은 하이브리드 신경-셀룰러 오토마타(neural-cellular automaton)를 활용하여 공중 산불 진압 모델링 및 최적화 프레임워크를 제시합니다. 이 모델은 지형, 연료, 풍속 데이터 기반의 확산 거동 예측과 목표 공중 투하 설계를 결합했습니다. 또한 몬테카를로 샘플링을 통해 알레아토릭 및 인식론적 불확실성을 정량화하여 진압 계획의 견고성을 평가합니다.