Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 다중 에이전트 강화학습(MARL)에서 행동 이질성을 측정하는 기존의 시스템 신경 다양성(SND) 지표가 팀 규모에 따라 계산 비용이 급격히 증가하는 문제를 해결하기 위해 Graph-SND를 제안합니다. Graph-SND는 임의의 그래프 $G$ 의 에지 가중 평균을 사용하여 SND를 근사하며, 이를 통해 계산 복잡도를 획기적으로 줄이고 효율성을 높입니다. 연구진은 다양한 시나리오에서 Graph-SND가 정확성(복원), 편향 없음, 높은 집중도, 그리고 실제 적용 사례(VMAS, DiCo)에서 기존 방식 대비 월등한 속도 향상을 입증했습니다.
본 논문은 머신러닝 배포의 주요 문제인 도메인 시프트를 해결하기 위해 새로운 확률적 분산 감소 기법을 제안합니다. 이 방법은 데이터 샘플링 순서를 최적화하여 도메인 불일치 추정 오차를 줄이는 'ORDERED' 방식을 사용합니다. 연구진은 이를 통해 기존 대비 낮은 분산을 달성하고, 실제 이미지 분류 벤치마크에서 목표 도메인 정확도를 개선했음을 입증했습니다.
본 논문은 확률적 다중 팔트 밴디트(stochastic multi-armed bandits)와 에피소드 강화학습(episodic reinforcement learning)의 '분포적 regret'을 통합적으로 분석하는 새로운 프레임워크를 제시합니다. 이 연구는 모든 신뢰 수준 $\delta$에 대해 균일하게 성립하는 확률적 보장을 통해 전체 범위에서의 regret 분포를 특징지으며, 탐험 보너스를 포함한 UCBVI 스타일의 알고리즘을 제안합니다. 특히, 기대 성능과 꼬리 리스크 간의 최적 균형을 달성하는 분포적 regret 바운드를 유도하여, 기존 연구의 한계를 극복하고 중요한 이론적 결과를 최초로 확인했습니다.
본 논문은 SWE-bench 스타일의 에이전트 강화 학습에서 발생하는 컴퓨팅 비효율성 문제를 해결하기 위해 '패스율 제어' 문제로 접근합니다. 기존 방식은 편향된 롤아웃 그룹을 사용하며, 이는 정보량이 가장 높은 작동 지점(50% 패스율)으로 자원을 유도하는 것이 중요함을 밝힙니다. 이를 위해 Prefix Sampling (PS) 기법을 제안하는데, 이 방법은 성공한 트래젝토리의 시작 부분(prefix)을 재활용하여 실패 그룹에 '헤드 스타트'를 제공하고, 반대로 실패한 prefix를 성공 그룹에 '핸디캡'처럼 활용합니다. PS는 Qwen3 모델에서 상당한 속도 향상과 성능 유지/개선 효과를 입증했습니다.
본 논문은 선형 반복 모델의 신호 전파를 유한 너비(finite width) 관점에서 분석하며, 기존 무한 너비 이론의 한계를 탐구한다. 연구진은 복잡 가우시안 초기화 하에서 숨겨진 상태 신호 에너지에 대한 정확한 유한 너비 공식을 도출하고, 반복 깊이($t$)와 너비($n$)가 커질 때 신호 전파를 지배하는 세 가지 스케일링 영역(subcritical, critical, supercritical)을 식별했다. 특히, 무한 너비 근사가 붕괴되는 정확한 임계적 깊이 스케일을 제시하며, 이는 반복 모델의 안정성과 초기화 방식에 대한 중요한 통찰을 제공한다.
본 논문은 신경망 표현(Neural representations)이 지닌 복잡한 기하학적 구조가 실제 행동을 인과적으로 형성하는지 탐구한다. 연구진은 활성화 공간에서 정의된 '매니폴드 스티어링(Manifold Steering)'이라는 방법을 사용하여, 모델의 내부 표현($M_h$)을 특정 행동 매니폴드($M_y$)를 따라 조작함으로써 자연스러운 행동 궤적을 생성함을 입증했다. 이 접근 방식은 기존의 유클리드 기하학 기반 선형 스티어링이 비자연적인 결과를 초래하는 한계를 극복하고, 표현의 기하학이 원칙적인 제어를 가능하게 하는 핵심 요소임을 보여준다.
본 연구는 LLM이 의미 있는 지시사항 없이도 해로운 출력을 유발할 수 있는 '자연스러운 백도어(natural backdoors)'의 존재와 그 난이도를 탐구합니다. 기존 제일브레이크 공격은 명시적 프롬프트 구조에 의존하지만, 본 연구는 오직 토큰 시퀀스 최적화만으로 해로운 행동을 유도하는 문제를 'junking 문제'로 정의하고 이를 분석했습니다. 실험 결과, 이 문제는 표준 제일브레이크 공격보다 더 어렵지만, 간단한 검색 전략만으로 높은 성공률로 해결될 수 있음을 보여주어 자연스러운 백도어가 존재하며 쉽게 발견 가능하다는 점을 시사합니다.
T-LVMOGP(Transformed Latent Variable MOGP)는 고차원 출력 공간의 데이터셋에 적용되는 다중 출력 가우시안 프로세스(MOGPs)의 확장성 문제를 해결하기 위해 제안된 새로운 프레임워크입니다. 이 모델은 Lipschitz 정규화 신경망을 사용하여 입력과 출력 특이 잠재 변수를 임베딩함으로써 유연한 다중 출력 심층 커널을 구성합니다. 확률적 변분 추론과 결합되어, 10,000개 이상의 출력을 가진 복잡한 데이터셋에서도 높은 예측 정확도와 계산 효율성을 입증했습니다.
본 논문은 LLM의 환각(hallucination)을 검출하기 위해, LLM을 동적 시스템으로 간주하는 새로운 접근 방식을 제안합니다. 응답 벡터 시퀀스를 고차원 다양체로 투영하고 쿠포만 연산자 이론을 활용하여 사실과 환각 영역의 전이 연산자를 적합시킵니다. 이 방법은 예측 오차 기반의 미분 잔류 점수를 계산하며, 단일 샘플 패스만으로 저비용 고성능 환각 검출을 가능하게 합니다.
본 논문은 트랜스포머 기반의 인-컨텍스트 학습(ICL)이 비선형 회귀 문제에 어떻게 적용될 수 있는지 탐구합니다. 기존 연구가 선형 모델에 집중된 것과 달리, 본 연구는 주의 메커니즘을 활용하여 다항식이나 스플라인 같은 넓은 함수 클래스를 포함하는 비선형 피처를 명시적으로 구성하고 이를 통해 엔드투엔드 ICL 프레임워크를 제시합니다. 나아가 컨텍스트 길이와 학습 세트 크기를 기반으로 하는 유한 샘플 일반화 오차 한계를 이론적으로 도출하고 수치적으로 검증했습니다.
본 논문은 선형 기억(linear memory)이 키-값 연상을 저장할 수 있는 용량 한계를 분석합니다. 등방성 가우시안 모델에서 가장 큰 방해자를 이겨야 하는 톱-1 회색(top-1 retrieval)의 경우, 용량은 $d^2 succeq n ext{log } n$을 요구하며, 이는 '승리자 취하기' 해독의 내재적 비용임을 보여줍니다. 또한, 올바른 대상이 후보 목록 중 하나여야 하는 리스트 회색(listwise retrieval) 기준에서는 용량이 $d^2 succeq n$ 스케일을 따르며, 이 경우에 대한 정확한 점근 이론과 예측 법칙을 제시합니다.
본 논문은 n차원 이산 도메인 위의 두 혼합 곱분포 간의 총 변동 거리(Total Variation Distance, TV distance)를 근사하는 확률적 알고리즘을 제시합니다. 특히 k_1개의 곱분포를 가진 혼합 분포 P와 Q에 대해 시간 복잡도 poly((nq)^{k_1+k_2}, 1/ε) 내에 높은 정확도로 TV 거리를 추정할 수 있음을 보였습니다. 또한, Boolean 서브큐브 혼합 분포의 특수한 경우에 대해서는 결정적 알고리즘을 제공하고, 이 계산이 #P-난해임을 입증했습니다.
이 논문은 인간의 시선 데이터를 기반으로 하는 '경험적 고정밀도(empirical fixation densities)'를 추정하는 기존 KDE 방법을 개선한 새로운 원리적 혼합 모델을 제안한다. 이 방법은 적응 대역폭과 중심 편향 및 균일 성분을 결합하여 공간적, 의미론적 상호 관찰자 일관성을 포착하며, 이미지별 교차 검증을 통해 최적화된다. 실험 결과, 이 새로운 추정치는 기존 방식 대비 여러 벤치마크에서 높은 상호 관찰자 일관성 및 로그-우도(log-likelihood)와 AUC 기준의 상당한 성능 향상을 보여주며, 특히 실패 사례 분석에 중요한 이미지들에서 큰 개선을 가져온다.
이 기술 기사는 R^2 위의 스칼라 이진 정제 연산자(dyadic refinement operators)에 대한 이론적 분석을 제시합니다. 연구진은 고정된 지지 윈도우 가설 하에서, 모든 컴팩트 지원 연속 조각선형 시드 함수 g에 대해 정제 반복 $V^n g$가 정확한 ReLU 실현을 가진다는 것을 증명했습니다. 또한, 1차원 루프 컨트롤러 프레임워크를 확장하여 텐서 곱의 잔류 역학을 다루고, 이를 일반적인 컴팩트 지원 연속 조각선형 시드 함수에 대한 유한 분해 및 정확한 클램프드 글루잉(clamped gluing)과 연결하는 방법을 제시합니다.
본 논문은 부분 관측된 저랭크 텐서 보전(Tensor Completion)에 대한 새로운 알고리즘을 제안합니다. 이 방법은 교차 방향 곱셈자(ADMM) 최적화 프레임워크를 활용하며, 기존의 핵 노름(Nuclear Norm) 최소화 기반 패러다임을 개선했습니다. 특히 과감사 및 적응형 페널티 파라미터 업데이트 스키마를 도입하여 수렴 속도와 전반적인 성능을 향상시켰으며, 시뮬레이션 결과에서 기존 최첨단 기술 대비 우수한 성능을 입증했습니다.
본 논문은 랜덤 행렬 이론(RMT) 기반의 스펙트럴 정보가 딥러닝 이론에서 중요하게 사용됨에도 불구하고, 계산적 한계로 인해 큰 모델의 속성을 작은 모델에서 추론하는 데 제약이 있음을 지적합니다. 이를 해결하기 위해, 연구진은 대수적 스펙트럴 곡선 이론을 활용하여 Free Decompression (FD) 방법을 일반화하고 실용적인 모델링 가정을 제시했습니다. 이 새로운 프레임워크는 신경망 및 확산 모델의 헤시안/활성화 행렬과 같은 실제 ML 모델에 쉽게 통합되어, 다중 모달 벌크 스펙트럴 밀도를 확장할 수 있게 합니다.
본 논문은 비디오 객체 중심 학습(Video Object-Centric Learning)의 기존 접근 방식이 미래 객체 표현을 예측하는 데 의존하여 시간적 일관성을 유지하는 한계를 지적합니다. 연구진은 이러한 예측자가 사실상 이산적인 대응 문제에 대한 비용이 많이 드는 근사치임을 증명하며, 대신 현대 컴퓨터 비전 백본에서 추출된 인스턴스 판별적 특징을 활용할 것을 제안합니다. 그 결과, 학습 가능한 시간 모델링 파라미터를 제거하고 결정론적 쌍분 매칭(deterministic bipartite matching) 기반의 Grounded Correspondence 프레임워크를 도입하여 높은 성능과 효율성을 달성했습니다.
본 논문은 전문가 모델의 능력을 단일 학생 모델로 통합하는 On-policy Distillation (OPD)의 한계를 극복하기 위해 Uni-OPD라는 일반화된 프레임워크를 제안합니다. 연구진은 OPD가 효과적으로 작동하지 못하게 하는 두 가지 주요 병목 현상, 즉 정보에 풍부한 상태 탐색 부족과 신뢰할 수 없는 교사 감독 문제를 식별했습니다. 이를 해결하기 위해 학생 측면에서는 데이터 균형 전략을, 교사 측면에서는 올바른 경로와 잘못된 경로 간의 일관성 조정 메커니즘을 도입하여 강력하고 범용적인 최적화 레시피를 제시합니다.
Tempered Guided Diffusion (TGD)는 훈련 없이 조건부 샘플링을 수행하기 위한 새로운 프레임워크입니다. 이 방법은 확산 사전(diffusion priors)과 Annealed Sequential Monte Carlo(ASMC) 기법을 결합하여, 노이즈된 확산 상태를 보조 변수로 활용하며 점진적 확률비율로 가중치를 부여받는 입자 전파 방식을 사용합니다. 특히, TGD의 개선 버전인 Accelerated TGD (A-TGD)는 재구성 작업의 비용을 줄이면서도 초기 탐색과 고확률 궤적 추적을 결합하여 높은 후방 근사 성능과 효율적인 속도-품질 트레이드오프를 달성합니다.
GEM-FI는 기존 증거 심층 학습(EDL)의 한계점인 과신 및 다중 모달 불확실성 표현 문제를 해결하기 위해 제안된 새로운 모델 계열입니다. 이 모델은 에너지 신호를 학습하고 이를 게이트드 증거 출력에 활용하며, 특히 피셔 정보 기반 정규화기를 추가하여 혼합 할당을 안정화하고 경계 불확실성을 개선합니다. 실험 결과, GEM-FI는 이미지 분류 및 OOD 탐지 벤치마크에서 기존 방법론 대비 높은 정확도 향상과 오분류 탐지 성능 개선을 입증했습니다.