Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 연구는 태양광 발전(PV) 전력 예측의 신뢰성을 높이기 위해 물리적으로 제약된 강건성 평가 프레임워크를 제시합니다. NWP 오차와 같은 복잡한 입력 불확실성 하에서 다양한 딥러닝 모델들을 테스트했습니다. 그 결과, 시퀀스 모델들이 높은 수준의 교란에서도 우수한 노이즈 필터링과 시간적 복원력을 보여주었습니다.
본 논문은 기존 앙상블 필터가 처리하기 어려웠던 다대일, 암묵적, 비평활한 관측 메커니즘을 위한 '암묵적 데이터 동화' 기법을 제안합니다. 이를 바탕으로 확률적 제어 흐름(stochastic controlled flow)을 활용하는 앙상블 제어 흐름 필터(EnCF)를 개발했습니다. EnCF는 종단 에너지 기울기 및 역변환 매칭을 통해 관측값 의존적 제어를 학습하며, 비가우시안/암묵적 모델에 강점을 보입니다.
본 연구는 다중 공 하드스피어 역학 시뮬레이션에서 표준 비디오 확산 모델의 성능이 인과 사슬 길이 증가에 따라 저하되는 '직렬성 격차(seriality gap)'를 발견했습니다. 이 현상은 영상 길이가 아닌 의존적 이벤트 구조가 원인임을 밝혀냈습니다.
본 논문은 알고리즘 게임 이론에서 사용되던 정적 해 개념과 무질서의 가격(PoA)에 근본적인 문제를 지적합니다. 특히, 다중 에이전트 학습을 정적 균형으로 축소하는 것이 동적 불균형을 간과하게 만든다고 주장합니다. 연구 결과는 최악의 경우 순수 Nash 균형이 위상적으로 불안정하며, PoA가 무한대가 될 수 있음을 증명했습니다.
본 논문은 이산 확산 모델의 한계를 극복하기 위해 FactorDiff라는 요인별 조합 프레임워크를 제안합니다. 기존 방법들이 샘플 단위로 작동하며 전문가들의 특화된 공간적/기능적 정보를 무시하는 문제를 해결하고자 합니다. FactorDiff는 샘플을 작은 요인으로 분해하고, 각 요인을 가장 적합한 전문가에게 동적으로 라우팅하여 조합 생성의 성능을 높였습니다.
본 연구는 Transformer 모델의 표현력 분석에 초점을 맞추고 있습니다. 기존 이론적 연구들이 가중치 설계나 계산 복잡도 논증을 사용했다면, 본 연구는 손실 지형 분석에서 영감을 받아 C-RASP 구성을 학습하기 위한 예비 샘플 복잡도 경계를 제안합니다.
본 논문은 Mamba와 같은 선택적 상태 공간 모델(Selective state-space models)이 정보를 경로화하는 방식을 측정하는 정확한 도구를 제시합니다. 이 도구는 Gram 텐서를 활용하여 특정 모드 하위 집합을 드롭했을 때의 출력 오차를 정밀하게 예측할 수 있습니다. 연구 결과, 학습된 모델은 입력에 따라 상태 공간을 재할당하며, 이는 주로 입력 의존적 쓰기 맵 $B_t$에 기인합니다.
본 논문은 Quantum Neural Networks (QNNs)가 취약한 새로운 유형의 공격인 입력 인식 동적 백도어(Input-aware Dynamic Backdoor)에 대해 연구합니다. 기존 QNN 백도어가 고정된 트리거에 의존하는 약점을 지니고 있음을 지적하며, 이를 극복하기 위해 Q-DIBA라는 최초의 공격 기법을 제안했습니다. Q-DIBA는 3가지 모드 미니 배치 전략과 앙상블 밀도 대조 손실을 사용하여 높은 성공률과 은밀성을 입증했습니다.
본 논문은 막대한 컴퓨팅 자원을 요구하는 신경망 구조 탐색(NAS)의 한계를 극복하기 위해 경제적이고 기억 기반의 NAS 프레임워크를 제안합니다. 이 방법은 강화학습 트랜스포머와 인공 벌 군집 알고리즘을 결합하여 전역 및 국소 최적화를 수행합니다. 표준 소비자급 GPU에서도 효율적인 아키텍처를 발견할 수 있음을 CIFAR-10 및 사기 탐지 데이터셋에서 입증했습니다.
본 논문은 인과성 발견 알고리즘의 신뢰성을 다루며, 기존 방식이 간과하는 '개입(interventions)'의 중요성을 강조합니다. 특히 자연 시스템에 존재하는 상쇄 경로가 전통적인 가정인 '신뢰성'을 위반할 수 있음을 지적했습니다. 연구진은 개입 정보를 활용하여 인과 구조를 비모수적으로 식별할 수 있는 새로운 가정을 제시하며, 패러다임 전환을 제안합니다.
본 연구는 LLM-as-judge의 편향을 단순히 입력-출력 수준이 아닌, 모델 내부 은닉 상태(hidden state)의 표현 기하학적 관점에서 분석했습니다. 이를 통해 특정 편향이 저차원 부분 공간으로 나타나며, 이 부분을 조작하여 점수 산정을 유도하거나 실패를 예측할 수 있음을 입증했습니다.
본 연구는 개방형 교수 평가 피드백을 주제별 범주와 감성으로 분류하는 검증된 프로토콜을 제시합니다. 이 프로토콜은 세 가지 표현 세대(희소 특징, 고정 임베딩, LLM 프롬프팅)를 거쳐 스페인어 데이터에서 재실행되었으며, 영어로의 전이 가능성을 테스트했습니다.
본 논문은 'requential coding'이라는 새로운 압축 기법을 제안합니다. 이 방법은 훈련 궤적을 효율적으로 압축하여, 모델의 크기나 데이터 엔트로피에 관계없이 매우 짧고 강력한 코드를 생성할 수 있습니다. 이는 대규모 언어 모델(LLM)의 일반화 성능과 컴퓨팅 최적 영역에서의 이론적 경계를 개선하는 데 기여합니다.
본 논문은 단일 인간 시연으로부터 정교한 조작 정책을 학습하는 최소주의적 리타게팅 기반 RL 파이프라인인 REGRIND를 제시합니다. REGRIND는 손-물체 동작을 로봇 참조값으로 변환하고, 잔여 RL 정책 훈련 및 시스템 식별 과정을 거쳐 하드웨어에 제로샷 전이를 수행합니다. 이를 통해 가위 사용이나 드라이버 돌리기 같은 접촉이 많은 도구 사용 작업에서 인간과 유사한 유연한 동작 구현을 입증했습니다.
본 논문은 트랜스포머 언어 모델에서 귀납적 추론 능력이 나타나는 원리를 설명하는 이론적 프레임워크를 제시합니다. 여러 합성 과제를 통합한 일반화된 귀납적 과제 클래스를 연구하여, 어텐션 모델의 훈련 역학이 해석 가능한 저차원 불변 다양체에 국한됨을 증명했습니다. 이를 통해 트랜스포머 학습 과정을 예측 이론으로 접근할 수 있는 기반을 마련합니다.
본 논문은 LLM 강화학습(RL)에서 사용되는 신뢰 영역 마스크의 한계를 지적하고, 이를 개선한 예측 분산 마스크(Predictive Divergence Mask)를 제안합니다. 이 새로운 마스크는 정책 기울기 단계가 신뢰 영역 내에서 분산을 증가시키거나 감소시킬지 예측하여 RL 학습을 안정화하는 것을 목표로 합니다.
본 논문은 확산 모델의 한계인 희귀 모드 도달 어려움을 해결하기 위해 '온도 샘플링' 기법을 제안합니다. 여기에 추가로, 분산 증가 문제를 해결하는 '분산 보정 시간 이동(variance-corrective time shifting)'이라는 비훈련적 방법을 도입했습니다. 이 방법은 모델의 다양성을 높이면서도 샘플 품질과 조건 충실도를 유지하여 다양한 확산 모델에 적용 가능함을 입증합니다.
본 논문은 고차원에서 잘못 사양화된 단일 지수 모델을 학습하는 두 개의 층 신경망의 개체군 기울기 흐름을 연구합니다. 특히, 명시적 시간 스케일을 가진 계층적 학습 시나리오에서 숨겨진 연결 함수의 상수 및 선형 성분이 임계값에서 복구됨을 증명했습니다.
본 논문은 약물 및 단백질 시뮬레이션을 위해 Equivariant Graph Neural Network 기반의 새로운 암시적 물 네트워크(TWIN)를 제안합니다. TWIN은 오직 ab initio 데이터와 실험적 레이블만으로 훈련되었으며, 기존 기계 학습 포텐셜보다 빠르면서도 DFT 수준의 정확도를 유지하여 생체 분자 시스템 모델링에 혁신을 가져올 것으로 기대됩니다.
ZoRRO는 학습이 필요 없는 제로 가중치(zero-weight) 프레임워크 기반의 개인화 추천 시스템입니다. 이 시스템은 기존 신경망 모델 대비 오프라인 평가에서 우수한 성능을 보였으며, 온라인 A/B 테스트에서도 높은 클릭률을 달성했습니다. 특히 600배 이상의 빠른 작동 속도를 제공하여 대규모 뉴스 추천에 효율적임을 입증했습니다.