Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Mind Dreamer(MD)는 모델 기반 강화학습(MBRL)에서 과거 데이터에 의존하여 발생하는 '역사적 결속' 문제를 해결하기 위해 제안된 프레임워크입니다. 능동적 잠재 개입(ALI)을 통해 생성기로부터 초기 상태를 샘플링함으로써 잠재 매니폴드 상의 비연속적인 점프를 유도하고, 이를 통해 인식론적 사각지대를 탐색합니다. 실험 결과, DeepMind Control Suite에서 DreamerV3 대비 희소 보상 작업 기준 최대 8.8배의 성능 향상을 입증했습니다.
본 논문은 딥러닝의 비볼록 최적화 문제를 해결하기 위해 국소 곡률을 활용하는 CT-AGD(Curvature-Tuned Accelerated Gradient Descent)를 제안합니다. CT-AGD는 유한 차분 몫을 사용하여 1차 최적화 방법을 가속화하며, 미니 배치 학습의 노이즈와 편향을 완화하는 휴리스틱을 포함합니다. 실험 결과, Adam과 유사한 오버헤드로 학습 에포크를 평균 33% 단축하면서도 기존 방식과 동일한 정확도를 달성했습니다.
몬테카를로 방법의 임계 감속 문제를 해결하기 위해 물리적 사전 확률을 통합한 변분 자기회귀 네트워크(Variational Autoregressive Networks)를 제안합니다. 기존 딥러닝 샘플러가 물리적 대칭성을 학습하는 데 겪는 어려움을 극복하고자, Ising 및 Edwards-Anderson 모델에 물리 정보 기반의 사전 확률을 적용하여 학습 효율을 높였습니다. 연구 결과, 이러한 접근 방식은 학습 부담을 줄이고 더 큰 시스템 크기의 이산 스핀 모델 시뮬레이션을 가능하게 합니다.
본 논문은 기존의 설명 가능한 AI(XAI)가 제공하는 '알고리즘적 구제'의 한계를 지적하며, 잘못된 결정을 검토하고 수정할 수 있는 '알고리즘적 이의 제기 가능성(Contestability)'의 중요성을 강조합니다. 저자들은 기존 XAI 방식이 결정 자체를 뒤집기 위한 충분한 근거를 제공하지 못함을 밝히고, 결정을 반박할 수 있는 세 가지 핵심 증거 유형을 제안합니다.
본 연구는 상태 공간 모델(SSM)에 깊이 재귀(depth-recurrence)와 입력 재형성(input reshaping) 기법을 적용하여 시계열 분류 성능을 혁신적으로 개선하는 방법을 제안합니다. 실험 결과, 파라미터를 공유하는 Looped SSM이 표준 SSM과 유사하거나 더 높은 성능을 보였으며, 이는 파라미터 공유가 최적화를 돕는 유익한 귀납적 편향임을 시사합니다. 또한 입력 재형성 기법을 결합했을 때 시너지 효과를 통해 정확도가 추가로 향상됨을 입증했습니다.
본 연구는 물리 모델링의 경계값 문제를 해결하기 위한 신경망 대리 모델이 확률적 분포의 꼬리(tails) 부분을 얼마나 정확하게 포착하는지 수치적으로 분석합니다. 열전도 방정식을 활용하여 데이터 기반 및 물리 정보 기반 손실 함수를 적용한 결과, 이상치 샘플에 대한 외삽 성능이 모델의 성능을 결정짓는 핵심 요소임을 밝혀냈습니다. 특히 약형 잔차 손실(weak form residual loss)을 사용한 완전 연결 신경망이 외삽된 입력에 대해 가장 우수한 예측 정확도를 보였습니다.
본 논문은 데이터 프라이버시 보호를 위해 부상하고 있는 연합 학습(Federated Learning)의 세 가지 아키텍처인 중앙 집중식(CFL), 분산형(DFL), 준분산형(SDFL)을 실험적으로 비교 분석합니다. Fedstellar 시뮬레이터와 MNIST 데이터셋을 활용하여 각 아키텍처가 가진 성능 지표 간의 트레이드오프를 규명함으로써, 애플리케이션 요구 사항에 적합한 아키텍처 선택을 위한 근거를 제시합니다.
MolCHG는 분자 구조를 원자, 결합, 파편의 세 가지 의미론적 계층으로 구성된 계층적 그래프로 모델링하는 새로운 자기지도 사전학습 프레임워크입니다. 기존 방식과 달리 결합 정보를 독립적인 노드 표현으로 격상시켜 원자 및 결합 수준의 정보를 통합적으로 학습하며, 세 가지 수준의 사전학습 목적 함수를 통해 분자 특성 예측 성능을 극대화했습니다. MoleculeNet 벤치마크 실험 결과, 다수의 데이터셋에서 기존 모델들을 뛰어넘는 최고 성능을 기록했습니다.
Ada-Diffuser는 의사결정 과정을 시퀀스 모델링할 때 간과되기 쉬운 잠재 요인(Latent factors)을 명시적으로 모델링하는 새로운 생성적 프레임워크입니다. 이 모델은 관측된 상호작용의 시간적 구조와 기저의 잠재 역학을 동시에 학습하여, 변화하는 환경과 보상 구조에 유연하게 적응할 수 있는 인과적 확산 모델을 제안합니다.
소아 ECMO 치료의 복잡성과 데이터 부족 문제를 해결하기 위해, 관측된 궤적으로부터 행동을 학습하는 모방 학습(Imitation Learning) 방식을 제안합니다. 연구 결과, 정형 데이터용 트랜스포머 기반 모델인 TabPFN이 XGBoost 및 MLP와 같은 전통적인 베이스라인보다 우수한 성능을 보였습니다. 이는 TabPFN이 소아 ECMO 임상 의사결정 지원을 위한 강력한 도구가 될 수 있음을 시사합니다.
본 논문은 진폭 인코딩과 학습 가능한 고전적 사전 인코딩 레이어를 결합하여 안정성을 높인 변분 양자 분류기(VQC)를 제안합니다. 정규화된 임베딩과 양계된 양자 관측량을 통해 입력 변화에 민감도가 제어된 매끄러운 가설 클래스를 유도하며, SAFE-AI 지표를 통해 모델의 신뢰성을 다각도로 평가합니다. 실험 결과, 제안된 모델은 고전적 베이스라인 대비 경쟁력 있는 성능과 함께 노이즈 및 구조적 특징 변화에 대한 뛰어난 강건성을 입증했습니다.
ITGPT는 불규칙한 샘플링과 결측치가 포함된 멀티모달 시계열 데이터를 처리하기 위해 설계된 어텐션 기반 아키텍처입니다. 자기지도 학습(SSL)과 GPT 방식의 목적 함수를 결합하여, 별도의 재샘플링이나 데이터 보간 없이도 의료 및 예측 유지보수 분야에서 최첨단 성능을 달성했습니다. 특히 레이블이 부족한 상황에서 비구조화된 데이터를 효과적으로 활용하여 지도 학습보다 뛰어난 성능을 보여줍니다.
기존 연합 학습(Federated Learning)은 클라이언트 간 피처 스키마가 일치한다고 가정하지만, 실제 정형 데이터 환경에서는 피처 서브셋이 서로 다른 이질적인 상황이 빈번합니다. 이를 해결하기 위해 제안된 FedHF-Impute는 공유된 글로벌 피처 그래프와 메시지 패싱 기술을 활용하여, 피처가 직접 겹치지 않더라도 클라이언트 간 지식을 전송하여 결측치를 효과적으로 보간합니다.
본 연구는 연속 시간 동적 그래프(CTDG) 학습 시 시간적 분포 변화로 인해 발생하는 어텐션 분산(attention dispersion) 문제를 진단하고 이를 해결하는 방법을 제시합니다. 기존 Transformer가 핵심 노드에 집중하지 못하는 문제를 차분 어텐션(differential attention) 도입을 통해 해결하여, 공통 모드 신호는 억제하고 독특한 토큰 신호를 증폭함으로써 성능을 개선했습니다. 이를 적용한 DiffDyG 모델은 다양한 벤치마크에서 SOTA 성능을 달성하며 특히 변화가 큰 데이터셋에서 탁월한 효과를 입증했습니다.
본 논문은 Foundation Models를 활용한 자동 주석 과정에서 발생하는 체계적인 모델 유도 레이블 노이즈 문제를 해결하기 위한 MIND 프레임워크를 제안합니다. 잠재 매니폴드 얽힘 해소(Latent Manifold Disentanglement) 기술을 통해 노이즈를 서브스페이스 의존적 구성 요소로 분리하여, 정답 데이터 없이도 구조적 오류를 효과적으로 식별합니다. 실험 결과, MIND는 3D 데이터셋과 같은 복잡한 환경에서 기존 방식보다 뛰어난 성능을 보였으며 시각-언어 모델의 제로샷 환각 현상을 교정하는 데 탁월함을 입증했습니다.
Multi-Fidelity Flow Matching(MFFM)은 PDE 솔루션을 계층적으로 정밀화하기 위해 조건부 흐름 매칭을 활용하는 새로운 프레임워크입니다. 저충실도 솔루션을 기반으로 잔차를 정밀화하는 방식을 통해 학습 기하 구조를 개선하며, 다중 해상도 계층 구조를 통해 효율적인 시공간 예측 및 초해상도 문제를 해결합니다.
본 연구는 클록리스(clockless) 비동기식 디지털 회로의 자율적인 스파이킹 역학을 활용한 확장 가능한 뉴로모픽 아키텍처를 제안합니다. FPGA 상에서 구현된 이 시스템은 불리언 스파이킹 뉴런 네트워크를 통해 머신러닝 태스크를 효율적으로 처리하며, 오디오 분류 작업에서 경쟁력 있는 성능과 낮은 전력 소비를 입증했습니다. 이는 특수 하드웨어 없이도 재구성 가능한 칩을 에너지 효율적인 뉴로모픽 플랫폼으로 활용할 수 있는 가능성을 제시합니다.
본 연구는 제한된 추론 예산 내에서 흐름 기반 생성 모델의 샘플링 품질을 높이기 위해 엔트로피율을 기반으로 한 새로운 이산화 및 스케줄링 방법을 제안합니다. 조건부-주변부 엔트로피율 목적 함수를 통해 양 끝점에 집중된 비균등 그리드를 구축함으로써, 기존 선형 또는 코사인 방식보다 적은 함수 평가(NFE)로도 더 높은 샘플링 성능을 달성했습니다. 실험 결과, 이미지 생성(CIFAR-10)과 단백질 생성(AlphaFlow) 작업 모두에서 기존 방식 대비 유의미한 성능 향상을 입증했습니다.
본 논문은 기존 SAM(Sharpness-aware minimization)이 손실 기하학을 고려하지 않고 모든 파라미터 방향을 균일하게 취급하는 한계를 극복하기 위해 LLQR+SAM 프레임워크를 제안합니다. LLQR의 학습된 전처리기를 통해 손실 지형의 기하학적 구조를 포착하고, 이를 SAM의 섭동 과정과 결합하여 '포트홀(potholes)'이라 불리는 국소적으로 날카로운 지점을 효과적으로 탈출합니다. 실험 결과, 이 이중 시간 척도 구조는 비전 및 시퀀스 모델링 벤치마크에서 기존 방식보다 우수한 성능 향상을 입증했습니다.
SNAC-Pack은 하드웨어 리소스와 정확도를 동시에 최적화하는 하드웨어 인지형 신경망 구조 공동 설계 및 FPGA 배포를 위한 오픈소스 AutoML 프레임워크입니다. Optuna와 NSGA-II를 활용한 다목적 탐색과 하드웨어 대리 모델을 통해 합성 비용을 절감하며, 양자화 인식 훈련(QAT)과 hls4ml을 결합하여 엔드 투 엔드 배포를 지원합니다. 실제 물리 실험 데이터셋 적용을 통해 수개월의 수동 미세 조정을 수 시간의 자동 탐색으로 단축하는 성능을 입증했습니다.