Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
비교 오라클만을 사용하여 비볼록 함수의 정지점을 찾는 알고리즘을 연구합니다. Lipschitz 연속 기울기와 헤시안을 가진 함수에 대해 효율적인 쿼리 횟수를 달성하며, 양자 비교 오라클 모델에서의 최초 양자 알고리즘도 제안합니다.
트랜스포머 기반 모델을 활용하여 박테리아 라만 스펙트럼 분류 성능을 체계적으로 평가한 연구입니다. LOOCV 프레임워크를 통해 기존 머신러닝 파이프라인과 비교한 결과, 트랜스포머가 전처리 없이도 원시 데이터에서 가장 우수한 분류 성능과 견고함을 보였습니다.
관측되지 않은 혼란 변수가 존재하는 환경에서 개별 처치 효과(ITE)를 정확히 추정하기 위한 새로운 업리프트 모델링 방법론을 제안합니다. 교차 헤드 어텐션을 활용한 CHAUN과 적대적 역 성향 점수 방식인 RA-IPS를 통해 편향을 완화하고 성능을 극대화했습니다.
본 연구는 새로운 신경망 아키텍처인 Kolmogorov-Arnold networks(KAN)를 유체 역학 대리 모델링에 적용하여 MLP 및 GNN과 성능을 비교합니다. KAN은 낮은 복잡도로 빠른 훈련이 가능하지만, 성능이 하이퍼파라미터에 민감하고 훈련 불안정성을 보일 수 있음을 확인했습니다.
분수계 편미분 방정식(fractional PDEs)을 해결하기 위한 새로운 텐서 신경망 방법론인 fTNN을 제안합니다. 기하학적 적응형 적분 분할과 시공간 분리형 신경망 설계를 통해 기존 fPINN 및 몬테카를로 방식보다 높은 정확도와 효율성을 입증했습니다.
행렬 직교화 기반 옵티마이저인 Muon의 높은 연산 비용 문제를 해결하기 위해 분산 학습 구현체인 DMuon을 제안합니다. DMuon은 기존 프레임워크 수정 없이 드롭인 모듈로 통합 가능하며, LLM 및 기초 모델 학습 시 획기적인 가속 성능을 제공합니다.
머신러닝 최적화 과정의 분산 문제를 해결하기 위해 조사 샘플링 이론을 결합한 모델 보조 샘플링 프레임워크를 제안합니다. 보조 경사 예측 모델을 통해 경사 추정의 효율성을 높이며, 기존 옵티마이저와 쉽게 통합 가능합니다.
의료기기 리콜의 심각도와 근본 원인을 동시에 예측하기 위한 멀티태스크 프레임워크 RecallRisk-BERT를 제안합니다. PubMedBERT 기반의 텍스트 표현과 구조화된 범주형 데이터를 결합하여 기존 단일 작업 모델보다 뛰어난 성능을 입증했습니다.
이벤트 기반 시계열 그래프 신경망(ETGNNs)의 설명 가능성을 높이기 위해 전체 정보 흐름을 분석하는 새로운 기여도 산출 방법을 제안합니다. NRM 프레임워크를 확장하여 이벤트 유도 변수를 통한 정보 경로를 정량화하고 기존 방식보다 뛰어난 해석력을 제공합니다.
그래프 신경망(GNN)의 설계 원칙과 표현력을 분석하고, 12가지 다양한 도메인에서의 응용 사례를 검토하는 조사 논문입니다. 메시지 패싱의 효율성, 아키텍처의 한계, 그리고 실제 배포 시 고려해야 할 제약 조건들을 심도 있게 다룹니다.
Muon 최적화 도구의 연산 효율성을 높이기 위해 타일형 Newton-Schulz 방식을 적용한 Hierarchical Muon(HiMuon)을 제안합니다. 행렬을 타일로 분할하여 연산량을 줄이면서도 Transformer 학습 시 기존 Muon과 유사한 성능을 유지합니다.
평균장 변분 추론(MFVI)이 파라미터 분산은 과소평가하지만, 예측 분산은 오히려 과대평가할 수 있다는 연구 결과를 제시합니다. 특히 훈련 데이터가 집중된 방향에서 이러한 과대평가가 발생하며, 이를 온도 조절을 통해 교정할 수 있음을 입증합니다.
2차원 쌍곡선 RNN 신경 양자 상태(NQS)를 구축하여 유클리드 RNN과의 성능을 벤치마킹한 연구입니다. 상전이 지점의 CFT 물리학과 쌍곡선 공간의 기하학적 특성이 결합되어 기존 유클리드 NQS보다 우수한 성능을 보임을 입증했습니다.
본 논문은 기존의 경험적 하이퍼파라미터 튜닝 방식의 한계를 극복하기 위해 통계적 보증을 제공하는 통합 프레임워크를 제안합니다. 다중 가설 검정 기반의 '학습 후 검정(LTT)' 패러다임을 통해 오류 확률을 명시적으로 제어하며 신뢰할 수 있는 파라미터 선택을 가능하게 합니다.
분산 지능형 시스템에서 데이터 프라이버시를 보호하며 중앙 집중식 학습 성능을 구현하는 TL++ 프레임워크를 제안합니다. 가상 배치를 통해 통신량을 획기적으로 줄이면서도, 비밀 공유 방식을 통해 활성화 값과 그래디언트 노출을 방지합니다.
우울증 진단을 위해 비디오 기반의 설명 가능한 딥러닝 프레임워크인 Expresso-AI를 제안합니다. DCNN을 활용해 얼굴 영역과 시간적 표현을 분석하며, 모델의 결정 과정을 시각적·정량적으로 설명하여 진단의 신뢰성을 높였습니다.
도메인 일반화(DG) 시 모든 도메인에 전역적 불변성을 강제하면 표현 공간이 제한되는 문제를 해결하기 위해, MoE 아키텍처를 활용한 '부분 집합 공유 불변성' 개념을 제안합니다. 각 전문가가 특정 도메인 부분 집합을 정렬하고 라우팅을 통해 조합함으로써 도메인 이질성에 대한 강건성을 높였습니다.
강화학습(RL) 환경에서 LoRA를 활용해 메모리 효율적인 정책 라이브러리를 구축하는 연구를 소개합니다. LoRA를 통해 전체 미세 조정 대비 메모리 사용량을 최대 160배 절감하면서도 성능 차이 없이 다수의 전문화된 정책을 저장할 수 있음을 입증했습니다.
모바일 셀룰러 부하 예측의 정확도를 높이기 위해 데이터 관점에서의 새로운 접근법을 제안합니다. 기존의 시계열 데이터 외에 인구 역학 및 이동성 데이터를 활용하여 고속도로 시나리오에서 예측 성능을 약 60% 개선했습니다.
파운데이션 모델의 편향성을 보완하기 위해 블랙박스 예측기를 활용한 비모수 회귀 연구를 다룹니다. 특정 임계값에서 발생하는 상전이 현상을 규명하고, 블랙박스 모델보다 성능이 저하되지 않도록 보장하는 '안전한 잔차 추정기'를 제안합니다.