Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
MeanFlowNFT는 평균 속도 예측 기반의 MeanFlow 생성기에 강화학습(RL) 프레임워크를 적용한 모델입니다. 기존 DiffusionNFT가 순간 속도를 최적화하는 것과 달리, MeanFlowNFT는 평균 속도를 유지하며 RL 튜닝을 수행합니다. 이를 통해 적은 샘플링 단계만으로도 높은 품질의 이미지 및 비디오 생성을 달성하여 기존 SOTA 모델들을 능가함을 입증했습니다.
본 논문은 '무한소 비구성적 스케치에서의 학습(LINCS)'이라는 범주론적 틀을 제시하며, 머신러닝 문제를 일반화된 스케치로 정의합니다. 이는 기존의 손실 함수나 벡터 공간 가정을 넘어선 보편 인수분해 문제 실패를 통해 비구성성을 다룹니다. 또한 연속적인 접선 전개(successive tangent unfoldings)를 통해 ML을 코알게브라적 고정점 찾기로 공식화했습니다.
본 논문은 월드-액션 모델(WAMs)의 취약점을 다루며, WAM이 상상하는 미래와 실제 행동 간의 불일치를 공격하는 BadWAM 프레임워크를 제안합니다. 이 적대적 공격은 시각적 교란을 통해 WAM의 정렬을 깨뜨리며, 명백한 액션 하이재킹부터 은밀한 비동기화까지 다양한 실패 스펙트럼을 포착합니다.
본 논문은 강화학습의 대안적 방법인 온-정책 증류(on-policy distillation)를 개선한 새로운 기법을 제안합니다. 기존 방식 대신, 교사 모델과 기본 모델 간의 차이인 '델타 신호'를 활용하여 추론 능력을 전이하는 것이 핵심입니다. 이를 통해 LLM이 짧은 훈련만으로도 강력한 성능을 달성할 수 있음을 입증했습니다.
본 논문은 멀티모달 모델의 지속적 적응 문제를 해결하기 위해 AlphaWiSE를 제안합니다. 기존 방법들이 단일 체크포인트에 의존하는 한계를 극복하고, 두 개의 고정된 소스 체크포인트를 조합하여 가중치 공간을 보간하는 새로운 방식을 제시했습니다. 이 방식은 추가적인 추론 시간 없이도 강력한 지속 학습 성능을 보여줍니다.
본 연구는 조정되지 않은 Hamiltonian Monte Carlo 및 감쇠된 Langevin과 같은 샘플러의 편향 비국소화 현상을 확장했습니다. 변수 간 상호작용이 약하거나 희소할 때, 고차원 분포의 $K$차원 주변분포의 $W_2$ 편향을 제어하는 데 필요한 적분 단계 수를 분석했습니다. 이 연구는 새로운 행렬-다항식 프레임워크를 제시하며, 감쇠된 Langevin 알고리즘에 대한 결과를 확장하여 광범위한 적용 가능성을 입증합니다.
본 논문은 생물음향학 분야의 파운데이션 모델 MetaPerch를 소개하며, Xeno-Canto 같은 대규모 데이터셋을 활용합니다. 특히 위치 및 시간과 같은 녹음 메타데이터를 보조 감독 신호로 사용하여 모델이 종-메타데이터 상관관계를 학습하도록 합니다. 이를 통해 실제 환경에 더 잘 일반화되는 견고한 표현을 얻는 것을 목표로 합니다.
본 논문은 선형 독립 성분 분석(ICA)의 한계를 극복하기 위해 새로운 접근법을 제안합니다. 기존 ICA가 네겐트로피 최대화에 의존했던 것과 달리, 이 연구는 표준 가우시안 분포와의 제곱 바서슈타인 거리($W_2^2$)를 사용하여 비가우시안성을 측정하는 OT-ICA 알고리즘을 개발했습니다. 시뮬레이션 및 실제 응용(EEG 아티팩트 제거, 계량 경제학)에서 그 우수성을 입증했습니다.
본 논문은 복잡한 멀티턴 에이전트의 장기 지평 학습에서 발생하는 크레딧 할당 문제를 해결하기 위해 TRACE(Turn-level Reward Assignment via Credit Estimation)를 제안합니다. TRACE는 롤아웃을 상태 전이로 보고, 참조 모델의 로그 확률 변화를 이용해 행동별 보상을 도출하는 조밀한 방법을 사용합니다. 이 방법은 추가적인 비평가나 복잡한 훈련 없이도 에이전트의 도구 사용 능력을 크게 향상시킵니다.
본 논문은 종단적 측정값, 드롭아웃 정보, 유전적 공변량을 통합하는 경험적 베이즈 변분 오토인코더(EB-VAE) 프레임워크를 제안합니다. 이 프레임워크는 잠재 개체 효과와 위험 모델을 결합하여 종양 성장과 드롭아웃 시간을 공동으로 예측하며, 유전학적 조건화 기능을 통해 높은 사전 예측 성능을 달성했습니다.
본 논문은 트랜스포머 피드포워드 블록 아키텍처에서 랭크(rank)가 깊이 전반에 걸쳐 어떻게 유지되는지 분석합니다. 기존의 이해를 넘어, 네트워크 표현력 확보 메커니즘을 '기울기 랭크 보존' 관점에서 재해석하며 스킵 연결과 정규화의 역할을 규명했습니다.
본 논문은 수직 운동이 있는 역진자 안정화 문제에 강화학습(RL)을 적용하고, 밀집 보상 신호로 Lyapunov 특성 지수(LCE)를 사용하는 방법을 제안합니다. 이 접근 방식을 통해 에이전트는 Kapitza 진자를 성공적으로 찾아내고, 진자의 회전을 감쇠시켜 수직 위치에 안정화시키는 것을 입증했습니다.
본 논문은 아날로그 회로 크기 설정을 위한 샘플 효율적인 강화학습(RL) 접근 방식인 Lighthouse RL을 제안합니다. 이 방법은 훈련 과정에서 발견된 고성능 구성('등대')으로부터 에피소드를 초기화하는 전략적 리셋 기법을 사용해 탐색의 비효율성을 해결했습니다. 실험 결과, 기존 대비 샘플 효율성과 최적화 성능 등 여러 면에서 큰 개선을 입증했습니다.
본 논문은 2,361개 GitHub 저장소의 에이전트 PR 25,264개를 분석하여 에이전트 코딩 도구의 채택 현황과 인간-에이전트 협업 패턴을 조사했습니다. 연구 결과, 에이전트 기여는 소수 프로젝트에 집중되어 있으며, 소규모 프로젝트가 더 높은 활동성을 보였습니다. 또한, 인간 감독은 단일 개발자가 주도하는 모델이 지배적입니다.
본 연구는 데이터가 제한적인 만주어 OCR 시스템을 다중 전문가 라우팅 방식으로 개선했습니다. 다양한 필기체를 수용하기 위해, 기존의 체크포인트들을 도메인별 전문가로 재사용하고 페이지 레벨 분류기를 통해 스타일별로 분배하는 시스템을 제안합니다. 이 시스템은 높은 정확도로 여러 필기체에 대한 OCR 성능을 입증했습니다.
본 연구는 정규화되고 구조화된 임베딩 학습을 목표로 하는 CoCo 손실 함수를 제안합니다. 이 손실은 클래스 내부 붕괴 방지 및 클래스 간 대비를 장려하며, 기하학적으로 최적인 각도 분리를 보존하는 유연성을 갖습니다. 실험 결과, CoCo는 기존의 점 회귀나 교차 엔트로피 방식보다 우수한 성능과 빠른 수렴을 보여주었습니다.
본 논문은 랜덤화된 해밀토니안 몬테카를로(RHMC) 알고리즘이 로그-오목 확률 분포에서 샘플링할 때 가속된 혼합 시간 보장을 갖는 것을 증명합니다. RHMC는 연속 시간 해밀토니안 역학 시뮬레이션과 독립적인 가우시안 랜덤 변수 재설정을 결합한 방식입니다.
LatentFlow는 확률 과정을 조건화하기 위한 범용 프레임워크를 제시합니다. 이 방법은 복잡한 조건부 법칙을 잠재 공간 추론으로 축소하여, 훈련 과정 없이도 다양한 모델 클래스에서 효율적인 조건부 샘플링을 가능하게 합니다. 단일 역시간 SDE 문제로 해결함으로써 기존에 어려웠던 광범위한 과학 및 공학 분야에 적용될 수 있습니다.
본 기사는 온라인 이진 순차 보정 문제에 대한 새로운 접근법을 제시합니다. 기존의 $T^{2/3}$ 오차 장벽을 넘어, 임의화된 예측기를 통해 기대 보정 오차가 $O(T^{2/3-\varepsilon})$임을 달성했습니다. 이는 기존의 보정 절차와 외부 Blackwell 스타일 보정 계층을 결합하여 총 오차를 효과적으로 제어한 결과입니다.
본 논문은 시계열 예측에서 스펙트럼 분석만으로는 부족하며, 컨텍스트 추가나 검색 플러그인 사용 등 '작동 지점'의 속성이 중요함을 제시합니다. 기존 스펙트럼 기반 인덱스는 위상 무작위화에 불변하지만, 외부 정보는 그렇지 않아 새로운 진단 지표를 통해 그 가치를 측정했습니다.