Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 연구는 정규화되고 구조화된 임베딩 학습을 목표로 하는 CoCo 손실 함수를 제안합니다. 이 손실은 클래스 내부 붕괴 방지 및 클래스 간 대비를 장려하며, 기하학적으로 최적인 각도 분리를 보존하는 유연성을 갖습니다. 실험 결과, CoCo는 기존의 점 회귀나 교차 엔트로피 방식보다 우수한 성능과 빠른 수렴을 보여주었습니다.
본 논문은 랜덤화된 해밀토니안 몬테카를로(RHMC) 알고리즘이 로그-오목 확률 분포에서 샘플링할 때 가속된 혼합 시간 보장을 갖는 것을 증명합니다. RHMC는 연속 시간 해밀토니안 역학 시뮬레이션과 독립적인 가우시안 랜덤 변수 재설정을 결합한 방식입니다.
LatentFlow는 확률 과정을 조건화하기 위한 범용 프레임워크를 제시합니다. 이 방법은 복잡한 조건부 법칙을 잠재 공간 추론으로 축소하여, 훈련 과정 없이도 다양한 모델 클래스에서 효율적인 조건부 샘플링을 가능하게 합니다. 단일 역시간 SDE 문제로 해결함으로써 기존에 어려웠던 광범위한 과학 및 공학 분야에 적용될 수 있습니다.
본 기사는 온라인 이진 순차 보정 문제에 대한 새로운 접근법을 제시합니다. 기존의 $T^{2/3}$ 오차 장벽을 넘어, 임의화된 예측기를 통해 기대 보정 오차가 $O(T^{2/3-\varepsilon})$임을 달성했습니다. 이는 기존의 보정 절차와 외부 Blackwell 스타일 보정 계층을 결합하여 총 오차를 효과적으로 제어한 결과입니다.
본 논문은 시계열 예측에서 스펙트럼 분석만으로는 부족하며, 컨텍스트 추가나 검색 플러그인 사용 등 '작동 지점'의 속성이 중요함을 제시합니다. 기존 스펙트럼 기반 인덱스는 위상 무작위화에 불변하지만, 외부 정보는 그렇지 않아 새로운 진단 지표를 통해 그 가치를 측정했습니다.
본 연구는 태양광 발전(PV) 전력 예측의 신뢰성을 높이기 위해 물리적으로 제약된 강건성 평가 프레임워크를 제시합니다. NWP 오차와 같은 복잡한 입력 불확실성 하에서 다양한 딥러닝 모델들을 테스트했습니다. 그 결과, 시퀀스 모델들이 높은 수준의 교란에서도 우수한 노이즈 필터링과 시간적 복원력을 보여주었습니다.
본 논문은 기존 앙상블 필터가 처리하기 어려웠던 다대일, 암묵적, 비평활한 관측 메커니즘을 위한 '암묵적 데이터 동화' 기법을 제안합니다. 이를 바탕으로 확률적 제어 흐름(stochastic controlled flow)을 활용하는 앙상블 제어 흐름 필터(EnCF)를 개발했습니다. EnCF는 종단 에너지 기울기 및 역변환 매칭을 통해 관측값 의존적 제어를 학습하며, 비가우시안/암묵적 모델에 강점을 보입니다.
본 연구는 다중 공 하드스피어 역학 시뮬레이션에서 표준 비디오 확산 모델의 성능이 인과 사슬 길이 증가에 따라 저하되는 '직렬성 격차(seriality gap)'를 발견했습니다. 이 현상은 영상 길이가 아닌 의존적 이벤트 구조가 원인임을 밝혀냈습니다.
본 논문은 알고리즘 게임 이론에서 사용되던 정적 해 개념과 무질서의 가격(PoA)에 근본적인 문제를 지적합니다. 특히, 다중 에이전트 학습을 정적 균형으로 축소하는 것이 동적 불균형을 간과하게 만든다고 주장합니다. 연구 결과는 최악의 경우 순수 Nash 균형이 위상적으로 불안정하며, PoA가 무한대가 될 수 있음을 증명했습니다.
본 논문은 이산 확산 모델의 한계를 극복하기 위해 FactorDiff라는 요인별 조합 프레임워크를 제안합니다. 기존 방법들이 샘플 단위로 작동하며 전문가들의 특화된 공간적/기능적 정보를 무시하는 문제를 해결하고자 합니다. FactorDiff는 샘플을 작은 요인으로 분해하고, 각 요인을 가장 적합한 전문가에게 동적으로 라우팅하여 조합 생성의 성능을 높였습니다.
본 연구는 Transformer 모델의 표현력 분석에 초점을 맞추고 있습니다. 기존 이론적 연구들이 가중치 설계나 계산 복잡도 논증을 사용했다면, 본 연구는 손실 지형 분석에서 영감을 받아 C-RASP 구성을 학습하기 위한 예비 샘플 복잡도 경계를 제안합니다.
본 논문은 Mamba와 같은 선택적 상태 공간 모델(Selective state-space models)이 정보를 경로화하는 방식을 측정하는 정확한 도구를 제시합니다. 이 도구는 Gram 텐서를 활용하여 특정 모드 하위 집합을 드롭했을 때의 출력 오차를 정밀하게 예측할 수 있습니다. 연구 결과, 학습된 모델은 입력에 따라 상태 공간을 재할당하며, 이는 주로 입력 의존적 쓰기 맵 $B_t$에 기인합니다.
본 논문은 Quantum Neural Networks (QNNs)가 취약한 새로운 유형의 공격인 입력 인식 동적 백도어(Input-aware Dynamic Backdoor)에 대해 연구합니다. 기존 QNN 백도어가 고정된 트리거에 의존하는 약점을 지니고 있음을 지적하며, 이를 극복하기 위해 Q-DIBA라는 최초의 공격 기법을 제안했습니다. Q-DIBA는 3가지 모드 미니 배치 전략과 앙상블 밀도 대조 손실을 사용하여 높은 성공률과 은밀성을 입증했습니다.
본 논문은 막대한 컴퓨팅 자원을 요구하는 신경망 구조 탐색(NAS)의 한계를 극복하기 위해 경제적이고 기억 기반의 NAS 프레임워크를 제안합니다. 이 방법은 강화학습 트랜스포머와 인공 벌 군집 알고리즘을 결합하여 전역 및 국소 최적화를 수행합니다. 표준 소비자급 GPU에서도 효율적인 아키텍처를 발견할 수 있음을 CIFAR-10 및 사기 탐지 데이터셋에서 입증했습니다.
본 논문은 인과성 발견 알고리즘의 신뢰성을 다루며, 기존 방식이 간과하는 '개입(interventions)'의 중요성을 강조합니다. 특히 자연 시스템에 존재하는 상쇄 경로가 전통적인 가정인 '신뢰성'을 위반할 수 있음을 지적했습니다. 연구진은 개입 정보를 활용하여 인과 구조를 비모수적으로 식별할 수 있는 새로운 가정을 제시하며, 패러다임 전환을 제안합니다.
본 연구는 LLM-as-judge의 편향을 단순히 입력-출력 수준이 아닌, 모델 내부 은닉 상태(hidden state)의 표현 기하학적 관점에서 분석했습니다. 이를 통해 특정 편향이 저차원 부분 공간으로 나타나며, 이 부분을 조작하여 점수 산정을 유도하거나 실패를 예측할 수 있음을 입증했습니다.
본 연구는 개방형 교수 평가 피드백을 주제별 범주와 감성으로 분류하는 검증된 프로토콜을 제시합니다. 이 프로토콜은 세 가지 표현 세대(희소 특징, 고정 임베딩, LLM 프롬프팅)를 거쳐 스페인어 데이터에서 재실행되었으며, 영어로의 전이 가능성을 테스트했습니다.
본 논문은 'requential coding'이라는 새로운 압축 기법을 제안합니다. 이 방법은 훈련 궤적을 효율적으로 압축하여, 모델의 크기나 데이터 엔트로피에 관계없이 매우 짧고 강력한 코드를 생성할 수 있습니다. 이는 대규모 언어 모델(LLM)의 일반화 성능과 컴퓨팅 최적 영역에서의 이론적 경계를 개선하는 데 기여합니다.
본 논문은 단일 인간 시연으로부터 정교한 조작 정책을 학습하는 최소주의적 리타게팅 기반 RL 파이프라인인 REGRIND를 제시합니다. REGRIND는 손-물체 동작을 로봇 참조값으로 변환하고, 잔여 RL 정책 훈련 및 시스템 식별 과정을 거쳐 하드웨어에 제로샷 전이를 수행합니다. 이를 통해 가위 사용이나 드라이버 돌리기 같은 접촉이 많은 도구 사용 작업에서 인간과 유사한 유연한 동작 구현을 입증했습니다.
본 논문은 트랜스포머 언어 모델에서 귀납적 추론 능력이 나타나는 원리를 설명하는 이론적 프레임워크를 제시합니다. 여러 합성 과제를 통합한 일반화된 귀납적 과제 클래스를 연구하여, 어텐션 모델의 훈련 역학이 해석 가능한 저차원 불변 다양체에 국한됨을 증명했습니다. 이를 통해 트랜스포머 학습 과정을 예측 이론으로 접근할 수 있는 기반을 마련합니다.