Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
심층 신경망의 층별 표현 공간을 3차원으로 제한하여 저차원 위상수학적 관점에서 분석한 연구입니다. ResNet의 스킵 연결과 Transformer의 어텐션 메커니즘이 연결수(linking number)를 변화시키는 능력이 유사함을 증명했습니다.
Transformer의 잔차 연결(Residual connection)을 개선하기 위해 현재 상태와 업데이트 제안을 모두 고려하는 'Review Residuals' 기법을 제안합니다. 이 방식은 모델의 깊이에 따른 학습 안정성을 확보하고, 모델 규모가 커질수록 성능 우위가 뚜렷해지는 창발적 특성을 보입니다.
Sequential RC-TGAN은 스펙트럼 포락선 이론을 활용하여 관계형 시계열 데이터의 주기적 구조를 보존하는 새로운 생성 프레임워크입니다. 범주형 및 연속형 시계열 모두에서 계절성과 주파수 영역 특징을 효과적으로 재현하며, 새로운 평가 지표를 통해 성능을 입증했습니다.
Conformal Prediction의 계산 비용 문제를 해결하기 위해 근사적 Leave-One-Out(ALO) 추정치를 활용한 가속화 방법을 제안합니다. 고차원 통계학 방법론을 적용하여 점근적 커버리지와 효율성을 입증하였으며, 시뮬레이션을 통해 실행 시간을 크게 단축하면서도 정확한 방법과 유사한 성능을 보임을 확인했습니다.
항공우주 복합재의 응집 구역 모델(CZM) 시뮬레이션 시 발생하는 수렴 문제를 해결하기 위해 인터페이스 인식 신경 뉴턴 프리컨디셔너(IA-NNP)를 제안합니다. 이 방법은 학습된 상태 의존적 보정을 통해 물리적 법칙을 보존하면서도 까다로운 수렴 성능을 개선합니다.
RMSNorm 아키텍처를 사용하는 모델 간에 스티어링 벡터나 SAE 등 좌표 기반 객체를 전송할 때 발생하는 부호-순열 게이지 문제를 다룹니다. 부호-한계화 헝가리안 매칭을 통해 좌표 보존 전송을 수행함으로써 체크포인트 간의 해석 가능성 도구와 학습 상태를 효과적으로 복구할 수 있음을 증명합니다.
유전 프로그래밍(GP) 기반 심볼릭 회귀(SR)에서 초기 개체군 초기화 방법이 솔루션의 정확도와 복잡도에 미치는 영향을 분석한 연구입니다. NSGA-II를 활용해 다양한 초기화 방식을 비교한 결과, 초기화 방법이 최종 파레토 프런트에 미치는 영향은 미미함을 확인했습니다.
Random Reshuffling(RR)이 Stochastic Gradient Descent(SGD)보다 우수하다는 사실을 이론적으로 증명한 연구입니다. 기존 이론이 가진 단계 크기 및 에포크 수의 제한 사항을 극복하고, 합리적인 단계 크기 하에서 RR의 수렴 성능이 SGD를 압도함을 입증했습니다.
오픈 모델의 측정이 폐쇄형 모델의 내부 구조를 얼마나 정확히 설명할 수 있는지 '대리 충실도'를 연구합니다. 실험 결과, 예측 성능이 일치하더라도 모델의 행동 원인(기여도)은 서로 다를 수 있음을 발견했습니다.
CoMet은 멀티모달 거대 언어 모델(MLLM)의 불확실성을 문맥 특화 항과 다중성 특화 항으로 분해하여 추정하는 새로운 방법론을 제안합니다. 경량화된 사후(post-hoc) 모듈을 통해 추가적인 샘플링 없이도 효율적으로 불확실성을 측정하며, 기존 베이스라인 대비 우수한 성능을 입증했습니다.
FedLAB은 개인정보 보호를 위해 데이터를 격리한 상태에서 멀티모달 그래프 지식을 학습하는 연합 학습 프레임워크입니다. 유형화된 계층적 코드북을 통해 모달리티 증거와 토폴로지 컨텍스트를 명시적으로 추적할 수 있는 시맨틱 코드북을 제안합니다.
심층 신경망이 배경의 가짜 상관관계에 의존하여 일반화에 실패하는 문제를 해결하기 위한 AutoBackSwap 기법을 제안합니다. 보조 네트워크로 전경과 배경을 분리하고 인페인팅을 통해 새로운 배경을 합성하여 훈련 데이터를 자동으로 증강합니다.
언어 모델의 잔차 스트림(Residual-stream) 분석 시 발생하는 측정 드리프트를 해결하기 위해 SemRF라는 새로운 앵커 기반 형식주의를 제안합니다. SemRF는 의미론적 측정과 잔차 역학을 분리하여 레이어 깊이에 따른 모델의 의미론적 궤적을 안정적으로 분석할 수 있게 합니다.
Patch-PODiff-ViT는 고정된 선형 직교 기저를 사용하여 구조화된 잠재 공간을 정의하는 새로운 확산 모델 프레임워크입니다. Vision Transformer를 활용해 효율적인 확산을 가능하게 하며, 픽셀 공간의 추가 계산 없이도 물리 공간의 불확실성을 분석적으로 정량화할 수 있습니다.
표 형식 파운데이션 모델(LTM)의 인컨텍스트 학습 과정에서 발생하는 파라미터 암기 현상을 조사한 연구입니다. ICLMEM 프레임워크를 통해 문맥 기반 예측과 암기를 분리하여 분석하였으며, 특정 조건에서 암기 신호가 나타남을 확인했습니다.
LLM이 도덕적 딜레마 상황에서 기존의 이분법적 선택을 넘어 새로운 대안을 제시할 수 있는지 연구합니다. MoralAltDataset을 통해 LLM이 타협안이나 재구성된 대안을 생성할 때 인간의 판단과 비교하여 어떤 성능을 보이는지 분석했습니다.
Glauber dynamics의 단일 궤적을 활용하여 d-희소 가우시안 그래피컬 모델의 구조를 학습하는 새로운 다항 시간 알고리즘을 제안합니다. 혼합 시간(mixing time)에 의존하지 않고도 조건부 독립 그래프를 복구할 수 있는 방법론을 제시합니다.
STRATA는 전 지구적 폭풍을 해결하기 위해 개발된 최초의 자기회귀 AI 에뮬레이터입니다. 4.9km의 초고해상도 데이터를 사용하여 대기 역학을 시뮬레이션하며, 기존 물리 모델 대비 약 50배 높은 에너지 효율을 제공합니다.
비무작위 결측(MNAR) 데이터 환경에서 기존 k-means 클러스터링의 왜곡 문제를 해결하기 위한 새로운 알고리즘을 제안합니다. 데이터 값이 작을수록 결측 확률이 높아지는 시나리오를 가정하여, 통계적 일치성을 보장하는 새로운 손실 함수와 최적화 방법을 제시합니다.
AI 에이전트의 기술(skill) 관리를 위해 구성 요소별 식별성을 제공하는 새로운 지문(fingerprint) 기술을 제안합니다. SimHash를 활용해 프롬프트, 코드, 도구를 분리하여 식별함으로써 기술의 계보를 추적하고 변조된 복사본을 효과적으로 탐지합니다.