Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 실제 데이터 샘플에 의존하지 않고 확률 공간에서 분류 손실을 학습하는 새로운 프레임워크인 진화 역학 손실(EDL)을 제안합니다. EDL은 의미론적 순위 일관성 목표를 사용하여 네트워크가 오류 있는 예측에 더 큰 벌칙을 받도록 파라미터화하며, 최적화를 위해 진화 전략과 혼란스러운 변이 기법을 활용합니다. 실험 결과, EDL은 기존의 크로스 엔트로피 손실의 효과적인 대안으로 사용될 수 있으며, 특히 표준 가우시안 변이보다 더 빠르고 안정적인 전 학습 성능을 보여주었습니다.
본 논문은 모달 불균형 및 노이즈 교란과 같은 저품질 데이터 문제를 해결하기 위해 '확률적 예측 자기 보정(Conformal Predictive Self-Calibration, CPSC)'이라는 통합 프레임워크를 제안합니다. CPSC는 모델이 학습 과정에서 실시간으로 자체적으로 신뢰성을 점검하고 보정할 수 있도록 설계되었으며, 특히 표현 자기 보정과 그래디언트 자기 보정을 결합한 새로운 자기 보정 학습 루프가 핵심입니다. 이 프레임워크는 다양한 벤치마크 데이터셋에서 기존 방법들보다 우수한 성능을 입증했습니다.
본 논문은 일반적인 거리 손실을 가진 실현 가능한(realizable) 설정에서 강력한 보편적 Bayes-consistency를 연구하며, 기존의 분류 및 실수값 회귀 문제를 넘어선 고전적인 특징화를 제시합니다. 저자들은 모든 실현 가능한 데이터 생성 분포에 대해 위험이 가장 좋은 클래스 내 위험(0)으로 거의 확실하게 수렴하는 분포 독립적 학습 규칙이 존재하는 가설 클래스 $\mathcal H$에 대한 필요충분 조건을 찾습니다. 주요 기여로는 Littlestone 트리를 거리 손실 설정으로 확장한 무한 증가 $(\gamma_k)$-Littlestone 트리가 있습니다.
이 논문은 유한 시간 간격의 에피소드 마르코프 결정 과정(MDP)에서 $(\varepsilon, \delta)$-PAC 정책 식별 문제를 다룹니다. 기존 방법들이 높은 계산 비용이나 최적 의존성 문제점을 가졌던 것과 달리, 연구진은 후속 샘플링과 온라인 학습 알고리즘을 결합한 새로운 접근 방식을 제안했습니다. 이 방법은 샘플 복잡성과 후속 수축률 측면에서 점근적 최적성을 달성하며, 계산 효율성이 높고 $\log(1/\delta)$에 대한 비최적 다항식 의존성을 피하는 것이 주요 강점입니다.
본 논문은 기존 차분 프라이버시(Differential Privacy, DP)가 모든 특성에 균일한 제약을 가하는 한계를 지적하고, 특정 특성 간의 상관관계 이질성을 고려한 완화된 DP 정의를 도입합니다. 연구진은 총 변동 거리(total variation distance)를 사용하여 이러한 상관관계를 정량화하고, 이를 활용하여 비민감한 특자에 대한 프라이버시 제약을 완화하는 '상관관계 인식 차분 프레임워크($ ext{CorrDP}$)'를 제안합니다. 이 $ ext{CorrDP}$를 기반으로 하는 DP-ERM 알고리즘은 기울기에 거리 의존성 노이즈를 적용하여 이론적 유틸리티를 향상시키며, 실제 데이터셋 실험을 통해 표준 DP보다 우수한 성능을 입증했습니다.
PALACE(Persistence Adaptive-Landmark Analytic Classification Engine)는 데이터 적응형 커널을 활용하여 포인트 클라우드 및 그래프 분류의 성능을 향상시킨 새로운 방법론입니다. 이 엔진은 세 가지 나뉜 값에 대한 작은 교차 검증 계층을 지불하며, 레베그 수 기준 기반의 커버 이론적 핵심을 통해 네 가지 강력한 폐쇄형 보장(closed-form guarantees)을 제공합니다. 실험 결과, PALACE는 Orbit5k, COX2, MUTAG 등 여러 데이터셋에서 기존의 다이어그램 기반 방법론들을 능가하는 우수한 성능을 입증했습니다.
본 기술 기사는 밀도 평가가 제한적인 비정규화 다중 모드 분포에서 샘플링하는 근본적인 문제를 해결하기 위한 새로운 프레임워크인 조건부 확산 샘플링(CDS)을 소개합니다. CDS는 기존의 강력한 글로벌 탐색 방법인 병렬 온도화(PT)와, 연속적 대안을 제공하는 확산 기반 접근 방식을 결합했습니다. 이 방식은 PT를 사용하여 초기 분포에서 효율적으로 샘플링하고, 이후 조건부 보간자(Conditional Interpolants)가 정의하는 해석적인 확률 미분 방정식(SDE)을 통해 샘플을 전송하여 높은 품질과 낮은 비용의 균형을 달성합니다.
본 논문은 대규모 언어 모델(LLM)의 후속 훈련 과정에서 SFT와 RLVR이라는 두 가지 핵심 패러다임을 통합하는 어려움을 다룹니다. 기존 방식들이 재앙적 망각이나 그래디언트 충돌 같은 문제를 겪는 근본적인 이유를 작업 벡터 분석을 통해 밝혀냈습니다. 이를 해결하기 위해, 연구진은 모델 파라미터를 업데이트하지 않고도 추론 시간 합성(inference time synthesis)을 통해 두 패러다임의 능력을 결합하는 새로운 프레임워크인 DoTS(Decoupled Test-time Synthesis)를 제안했습니다.
본 논문은 고형종양 조직 미세구조 내 세포외 확산계수, 난이도, 세포 크기 분포 및 세포 밀도를 생체내 영상화하기 위한 새로운 물리 기반 모델인 TRACED를 제안합니다. 이 모델은 세포 분포에 시간 의존성을 통합하여 확산 MRI 신호를 계산하며, 신경망을 사용하여 다양한 세포 크기를 가진 세포 군집의 시간에 따른 확산 특성을 빠르고 정확하게 예측할 수 있습니다. 연구진은 8명의 glioma 환자 데이터를 활용하여 TRACED를 검증했으며, 이 모델이 기존 단순 모델보다 개선된 파라미터 추정치를 제공하고 임상적으로 유용한 다중 물리적 정보를 동시에 정량화할 수 있음을 입증했습니다.
본 기사는 안과에서 중요한 OCT(광간섭 단단층 촬영) 이미지의 자동 분석을 위한 표현 학습 방법론을 포괄적으로 검토하는 서평입니다. 초기 CNN 및 트랜스포머 기반 접근법부터 최신 대규모 기반 모델 및 시각-언어 시스템까지 발전 과정을 체계적으로 다룹니다. 또한, 각 학습 패러다임별 핵심 기여와 한계를 분석하고, 향후 연구가 집중해야 할 볼륨 기반 사전 훈련, 불확실성 인식, 공정성 개선 등의 오픈 방향을 제시합니다.
본 기술 기사는 선택적 예측(selective prediction)을 합의 기반 접근 방식으로 다룹니다. 주어진 임베딩 공간에서 라벨링되지 않은 풀 중 일부 점만 쿼리할 수 있는 상황을 가정하며, 리프치츠 일관성 제약 조건을 활용하여 모델이 모든 헤드가 동의하는 경우에만 예측하도록 합니다. 또한 예산 기반 쿼리를 위한 모노톤 서모듈러 기하학적 대안(proxy)도 제시합니다.
본 논문은 시간 의존 데이터 처리에 사용되는 순환 신경망(RNN)의 한계점인 낮은 해석 가능성과 느린 훈련 속도를 극복하기 위해 '병렬화 가능한 RNN(ParaRNN)'을 제안합니다. ParaRNN은 반복 역학을 가산적 표현으로 분리하여 구성함으로써, 모델이 시간 의존성을 가지면서도 높은 수준의 해석 가능성을 확보할 수 있게 합니다. 이 구조는 효율적인 병렬화를 가능하게 하여 훈련 속도를 개선하고, 비모수 회귀 응용에서 우수한 성능과 예측 오차 한계를 입증했습니다.
본 연구는 대규모 언어 모델(LLM)이 환경 상호작용을 통해 작업을 해결하는 인터랙티브 에이전트로서의 잠재력을 탐구하며, 특히 훈련에 필요한 '지평선 길이'가 성능에 미치는 영향을 체계적으로 분석했습니다. 연구 결과, 지평선 길이가 길어질수록 훈련 불안정성이 증가하고 탐사 및 신용 할당 문제가 발생하여 훈련 병목 현상을 초래하는 것으로 나타났습니다. 이러한 문제를 해결하기 위해 '지평선 축소(horizon reduction)' 기법을 제안했으며, 이는 모델의 훈련 안정성을 높이고 장기 지평선 작업에 대한 일반화 성능(horizon generalization)을 향상시키는 핵심 원리임을 입증했습니다.
본 논문은 활성 학습(Active Learning)의 효율성을 높이기 위해 새로운 경량 기반(gradient-based) 획득 기준을 제안한다. 이 기준은 기존의 불확실성 샘플링 방식에서 사용되는 불확실성 측정치 대신 활용될 수 있으며, 라벨의 불확실성과 데이터 분포를 동시에 고려하는 다양성 기반 방법론에 통합 가능하다. 연구진은 제안한 획득 기준에 대한 이론적 근거와 경험적 평가를 통해 그 효과성을 입증했다.
본 논문은 대규모 언어 모델의 선호도 최적화(DPO) 과정에서 발생하는 '압축 효과'와 확률 붕괴 문제를 해결하기 위한 새로운 방법인 Gradient-Gated Preference Optimization (Gate-DPO)를 제안합니다. Gate-DPO는 업데이트가 낮은 확률 응답을 목표로 할 때 해로운 그래디언트를 동적으로 감쇠시켜 모델의 훈련 안정성을 높입니다. 실험 결과, Gate-DPO는 기존 DPO 방법이 초래하는 선택 응답의 과도한 집중(압축) 현상을 효과적으로 줄이고 전반적인 확률 분포를 개선하며, 이는 언어 모델 정렬에 더 건강하고 효율적인 최적화 행동을 제공함을 입증했습니다.
본 기술 기사는 과학적 논문의 재현성 평가의 어려움을 해결하기 위해 '에이전트 기반 재현성 평가(ARA)'라는 새로운 프레임워크를 제안합니다. ARA는 논문에서 소스, 방법, 실험, 출력 등을 연결하는 방향성 워크플로우 그래프를 추출하고 구조적 및 내용 기반 점수를 사용하여 재현성 가능성을 자동으로 평가합니다. 213개의 ReScience C 기사를 대상으로 한 실험 결과, ARA는 기존의 인간 검증된 연구보다 높은 정확도를 보여주며, 대규모 과학 문헌 검토에 혁신적인 잠재력을 제시합니다.
본 논문은 검증 가능한 보상을 가진 온라인 강화 학습(RLVR)의 효율성을 높이기 위해 참조 샘플링 볼츠만 투영을 제안합니다. 기존 SFT 방식이 가중치 가능도를 제대로 지정하지 못하는 문제를 해결하기 위해, 이 연구는 유도 정책이 고정 참조 KL 정규화된 RLVR 최적화자와 일치하도록 하는 '목표 일치 가중치' SFT 목적을 식별합니다. 이를 통해 밀도 비율 가중치가 볼츠만 투영으로 단순화되며, BOLT라는 경험적 추정자가 제안됩니다. 또한 유한 한샷 분석을 통해 커버리지 부족 문제와 최적화의 근사 오차를 분리하고, 적응적 샘플링이 필요할 때 KL 정책 거울 하강 방식을 제시합니다.
이 논문은 다중 모달 모델(MLLM)에서 시각적 잠재 공간이 가진 잠재적인 추론 능력이 실제 답변 예측 과정에서 체계적으로 억제되는 'Silenced Visual Latents' 문제를 식별하고 해결책을 제시합니다. 연구진은 백본 파라미터를 고정한 상태에서, 두 단계의 최적화 과정을 통해 잠재 추론 자체를 직접 개선하는 방법을 제안했습니다. 이 방법은 시각적 잠재 공간의 의미적 품질을 높이고(Stage I), 예측 토큰이 잠재 스페인을 따라 점진적으로 집중되도록 유도하여(Stage II) 모델의 억제된 추론 능력을 효과적으로 해방시킵니다.
Bolek은 Morgan fingerprint 임베딩을 인스트럭션 튜닝 텍스트 디코더에 주입하여 자연어 추론이 분자 구조에 근거하도록 설계된 컴팩트한 다중 모달 언어 모델입니다. 이 모델은 분자 설명, RDKit descriptor 예측 등 다양한 작업으로 미세 조정되었으며, 기존 LLM 대비 높은 성능과 함께 생성되는 설명의 신뢰성(근거 기반)을 크게 향상시켰습니다. Bolek는 여러 다운스트림 추론 작업에서 우수한 성능을 보였을 뿐만 아니라, 언급된 분자 특성 값들이 RDKit 계산값과 매우 높은 상관관계를 보여 모델의 감사 가능성을 입증했습니다.
본 논문은 충분히 다양하고 도전적인 행동 인식 데이터를 확보하기 어려워진 현 비전-언어 모델(VLMs)의 행동 인식 능력을 재활성화하기 위해 'VideoNet'이라는 도메인 특화 행동 인식 벤치마크를 제안합니다. VideoNet은 37개 도메인의 1,000개 고유 행동을 포함하며, 다양한 평가 설정(다중 선택, 이진 분류, 퓨샷 등)에서 모델들의 성능을 체계적으로 분석했습니다. 나아가, 테스트 시간 개선에만 의존하는 것이 아니라, 대규모의 비디오 질문-답변 쌍(약 50만 개)으로 구성된 도메인 특화 행동 인식 훈련 데이터셋을 구축하고 이를 활용하여 오픈 웨이트 모델의 성능을 향상시키는 방법을 제시했습니다.