Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Random Reshuffling(RR)이 Stochastic Gradient Descent(SGD)보다 우수하다는 사실을 이론적으로 증명한 연구입니다. 기존 이론이 가진 단계 크기 및 에포크 수의 제한 사항을 극복하고, 합리적인 단계 크기 하에서 RR의 수렴 성능이 SGD를 압도함을 입증했습니다.
오픈 모델의 측정이 폐쇄형 모델의 내부 구조를 얼마나 정확히 설명할 수 있는지 '대리 충실도'를 연구합니다. 실험 결과, 예측 성능이 일치하더라도 모델의 행동 원인(기여도)은 서로 다를 수 있음을 발견했습니다.
CoMet은 멀티모달 거대 언어 모델(MLLM)의 불확실성을 문맥 특화 항과 다중성 특화 항으로 분해하여 추정하는 새로운 방법론을 제안합니다. 경량화된 사후(post-hoc) 모듈을 통해 추가적인 샘플링 없이도 효율적으로 불확실성을 측정하며, 기존 베이스라인 대비 우수한 성능을 입증했습니다.
FedLAB은 개인정보 보호를 위해 데이터를 격리한 상태에서 멀티모달 그래프 지식을 학습하는 연합 학습 프레임워크입니다. 유형화된 계층적 코드북을 통해 모달리티 증거와 토폴로지 컨텍스트를 명시적으로 추적할 수 있는 시맨틱 코드북을 제안합니다.
심층 신경망이 배경의 가짜 상관관계에 의존하여 일반화에 실패하는 문제를 해결하기 위한 AutoBackSwap 기법을 제안합니다. 보조 네트워크로 전경과 배경을 분리하고 인페인팅을 통해 새로운 배경을 합성하여 훈련 데이터를 자동으로 증강합니다.
언어 모델의 잔차 스트림(Residual-stream) 분석 시 발생하는 측정 드리프트를 해결하기 위해 SemRF라는 새로운 앵커 기반 형식주의를 제안합니다. SemRF는 의미론적 측정과 잔차 역학을 분리하여 레이어 깊이에 따른 모델의 의미론적 궤적을 안정적으로 분석할 수 있게 합니다.
Patch-PODiff-ViT는 고정된 선형 직교 기저를 사용하여 구조화된 잠재 공간을 정의하는 새로운 확산 모델 프레임워크입니다. Vision Transformer를 활용해 효율적인 확산을 가능하게 하며, 픽셀 공간의 추가 계산 없이도 물리 공간의 불확실성을 분석적으로 정량화할 수 있습니다.
표 형식 파운데이션 모델(LTM)의 인컨텍스트 학습 과정에서 발생하는 파라미터 암기 현상을 조사한 연구입니다. ICLMEM 프레임워크를 통해 문맥 기반 예측과 암기를 분리하여 분석하였으며, 특정 조건에서 암기 신호가 나타남을 확인했습니다.
LLM이 도덕적 딜레마 상황에서 기존의 이분법적 선택을 넘어 새로운 대안을 제시할 수 있는지 연구합니다. MoralAltDataset을 통해 LLM이 타협안이나 재구성된 대안을 생성할 때 인간의 판단과 비교하여 어떤 성능을 보이는지 분석했습니다.
Glauber dynamics의 단일 궤적을 활용하여 d-희소 가우시안 그래피컬 모델의 구조를 학습하는 새로운 다항 시간 알고리즘을 제안합니다. 혼합 시간(mixing time)에 의존하지 않고도 조건부 독립 그래프를 복구할 수 있는 방법론을 제시합니다.
STRATA는 전 지구적 폭풍을 해결하기 위해 개발된 최초의 자기회귀 AI 에뮬레이터입니다. 4.9km의 초고해상도 데이터를 사용하여 대기 역학을 시뮬레이션하며, 기존 물리 모델 대비 약 50배 높은 에너지 효율을 제공합니다.
비무작위 결측(MNAR) 데이터 환경에서 기존 k-means 클러스터링의 왜곡 문제를 해결하기 위한 새로운 알고리즘을 제안합니다. 데이터 값이 작을수록 결측 확률이 높아지는 시나리오를 가정하여, 통계적 일치성을 보장하는 새로운 손실 함수와 최적화 방법을 제시합니다.
AI 에이전트의 기술(skill) 관리를 위해 구성 요소별 식별성을 제공하는 새로운 지문(fingerprint) 기술을 제안합니다. SimHash를 활용해 프롬프트, 코드, 도구를 분리하여 식별함으로써 기술의 계보를 추적하고 변조된 복사본을 효과적으로 탐지합니다.
정형 데이터 생성을 위한 웹 기반 툴킷인 TDGT를 소개합니다. ABMS 알고리즘과 VAE-ABMS 하이브리드 아키텍처를 통해 수동 설정 없이 고충실도 합성 데이터를 생성하며, GPU 가속을 지원합니다.
AI 보조 연구에서 과학적 주장의 신뢰성을 확보하기 위한 교정(calibration) 프레임워크를 제안합니다. 증거에 기반한 주장 권리를 관리하는 다섯 가지 연산자를 정의하고, 주장과 증거 사이의 간극을 메우는 방법론을 다룹니다.
컴퓨터 사용 에이전트 개발 시 실패한 궤적을 활용하여 모델을 개선하는 '실패 기반 자기 개선 루프' 연구를 소개합니다. LLM을 통해 실패 원인을 진단하고 추론 시간 솔루션과 코드 패치를 생성함으로써, 추가 학습 없이도 에이전트의 성공률을 유의미하게 향상시켰습니다.
심층 신경망의 일반화 성능을 설명하는 '부피 가설'에 대한 실험적 재검토를 다룹니다. 데이터셋 크기에 따라 SGD의 일반화 이점이 변화함을 보여줌으로써 기존 실험 결과들 사이의 모순을 해결하고자 합니다.
비대칭 라플라스 가능도의 비공액성 문제를 해결하기 위해 라플라스 근사를 활용한 희소 가우시안 프로세스 분위수 회귀 프레임워크를 제안합니다. 예측 불확실성을 분해하여 모델 복잡도를 적응적으로 제어하는 순차적 알고리즘을 통해 효율적인 데이터 획득과 유도 변수 배치를 수행합니다.
생성형 AI 기술인 Flow Matching을 지구물리학적 탄성파 전파파형 역산에 적용하는 확률론적 역산 방법론을 제안합니다. 수학적 이론을 조정하여 2D 속도 모델과 OpenFWI 데이터셋을 통해 방법론의 유효성을 검증했습니다.
LLM의 사후 학습 백도어 탐지 및 트리거 역전을 위한 새로운 프레임워크인 CSO(Class Subspace Orthogonalization)를 제안합니다. 이 방식은 클래스 부분 공간 직교화를 통해 탐지 성능을 높이고 암시적 블랙리스트 역할을 수행하여 효과적인 보안 솔루션을 제공합니다.