Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
기존의 LLM 프로그램 합성 방식은 단순 수치 점수에 의존하여 실패 원인을 파악하기 어렵고 비용이 많이 드는 한계가 있습니다. 본 연구는 형식적으로 정의된 속성을 기반으로 실패 시 구체적인 반례를 제공하는 '속성 가이드 기반 합성' 방식을 제안합니다. 이를 PDDL 계획 도메인에 적용한 결과, 기존 방식 대비 프로그램 생성 횟수를 7배 줄이면서도 더 높은 성능과 효율성을 달성했습니다.
VLA(Vision-Language-Action) 모델의 강화학습 과정에서 발생하는 막대한 그래디언트 계산 비용을 줄이기 위한 확률적 청크 마스킹(PCM) 기법을 제안합니다. PCM은 성공과 실패를 가르는 핵심적인 단계에만 계산 자원을 집중함으로써, 모델의 성능 저하 없이 학습 속도와 메모리 효율성을 획기적으로 개선합니다.
회귀 분석에서 예측 구간의 효율성을 높이기 위해 왜도(Skewness)에 적응할 수 있는 새로운 분할 등각 예측(Split Conformal Prediction) 방법론을 제안합니다. 게이지 접근법과 역쌍곡사인 변환을 활용하여 국소적 척도와 왜도에 모두 대응하며, 기존의 스케일링된 점수 방식이나 등각화된 분위수 회귀보다 더 효율적인 예측 구간을 생성합니다.
SwAIther-Precip은 글로벌 AI 기상 모델인 AIFS의 저해상도 예측을 스위스 지역의 1km 단위 상세 강수 예측으로 변환하는 새로운 프레임워크입니다. FiLM 기반의 U-Net을 통해 예측 시점(lead-time)에 따른 편향을 먼저 보정한 후, 확산 기반 모델을 사용하여 미세한 공간 변동성을 생성합니다. 이 방식은 기존 방식보다 예측 정확도를 크게 높이며, 특히 예측 시점이 길어질수록 발생하는 편향 문제를 효과적으로 해결합니다.
본 논문은 변분 오토인코더(VAE)의 고질적인 문제인 사후 확률 붕괴(Posterior collapse)를 해결하기 위해 엔트로피적 오토인코더(EAE) 프레임워크를 제안합니다. EAE는 명시적인 사전 확률 대신 자유 에너지 최소화 앙상블 인코더를 사용하여 잠재 변수의 사전 확률을 암시적으로 생성하며, 이를 통해 데이터의 복잡한 구조를 보존하는 비가우시안 및 다봉 잠재 분포를 학습합니다.
본 논문은 시스템의 역학이 갑작스럽게 변하는 '구간별 정적' 환경에서 안정성과 성능을 동시에 확보하기 위한 BAPR(Bayesian Amnesic Piecewise-Robust SAC) 알고리즘을 제안합니다. 베이지안 온라인 변화 탐지(BOCD)와 강건 앙상블 강화학습을 결합하여, 체제 변화 시에는 보수적인 정책을, 안정기에는 적응적인 정책을 구사합니다. 특히 Lean 4를 사용하여 알고리즘의 수렴성과 오차 예산을 수학적으로 엄격하게 기계 검증하였습니다.
2차 최적화 방법론은 높은 샘플 효율성을 제공하지만 대규모 옵티마이저 상태 유지로 인한 시스템 비용 문제가 있습니다. 본 논문은 Asteria라는 런타임 시스템을 통해 옵티마이저 상태를 GPU, CPU, NVMe에 동적으로 분산하고 비동기 연산을 수행하여 이 병목 현상을 해결합니다. 이를 통해 대규모 언어 모델(LLM) 학습 시 2차 최적화의 이점을 유지하면서도 실용적인 학습 속도와 효율성을 달성합니다.
본 연구는 AI 개발 생명주기 전반에서 LLM의 안전성과 규정 준수를 보장하기 위해 형식 기법(Formal Methods)을 결합한 새로운 감사 및 모니터링 기술을 제안합니다. 선형 시제 논리(LTL)를 활용하여 시간적 제약 조건을 검증하며, 예측 모니터링과 개입형 모니터를 통해 위반 사항을 선제적으로 차단합니다. 실험 결과, 제안된 방식은 기존 LLM 기반 방법보다 우수한 탐지 성능을 보였으며, LLM의 한계인 시간적 추론 능력을 효과적으로 보완함을 입증했습니다.
QSurv는 시간 이산화나 제한적인 분포 가정 없이 비매개변수 연속 시간 생존 모델링을 가능하게 하는 확장 가능한 딥러닝 프레임워크입니다. Gauss-Legendre 수치 적분법을 사용하여 누적 위험을 정확하게 근사하며, 시간 조건부 저차원 적응(time-conditioned low-rank adaptation)을 통해 복잡한 비정상적 위험 역학을 효과적으로 포착합니다.
본 연구는 복잡한 다중 스케일 시스템을 위해 수학적으로 제약된 가설 클래스 내에서 중간 규모 역학(Mesoscopic dynamics)을 학습하는 새로운 방법론을 제안합니다. 온사거 원리를 기반으로 소산적 및 보존적 역학을 통합하며, 학습 전 전역적 적정성과 안정성 등 이론적 보장을 확립하여 정확하고 해석 가능한 모델을 생성합니다. 연속체 PDE 및 미시적 사슬 모델 데이터를 통해 프레임워크의 유효성을 검증하였습니다.
본 논문은 차분 프라이버시(Differential Privacy) 환경에서 CVaR(Conditional Value-at-Risk) 학습 시 발생하는 유효 샘플 크기의 변화를 분석합니다. 프라이버시 적용 시 유효한 꼬리 샘플 크기가 $n\tau$에서 $\epsilon n\tau$로 감소함을 밝히고, 스칼라 추정 및 유한 클래스 상황에서의 수렴 속도와 오차 분해를 수학적으로 증명합니다.
본 연구는 원자 결정 구조로부터 공선적 및 비공선적 자기 구조를 모두 예측할 수 있는 E(3) 등변 그래프 신경망인 Magnetic Structure Network(MSN)를 제안합니다. PMSR이라는 새로운 표현 방식을 통해 대칭성 가정 없이 정수적 및 비정수적 구조를 통일된 방식으로 인코딩하며, 실험 수준의 정확도로 자기 구조를 재구성할 수 있습니다.
Flow Matching 모델의 속도장(Velocity field)에 직접 워터마크를 삽입하는 역학 수준(Dynamics-level)의 새로운 워터마킹 기술을 제안합니다. 연속 채널 상의 랜덤 코딩 방식을 사용하여 생성된 데이터의 품질을 유지하면서도, 블랙박스 쿼리를 통해 메시지를 안전하게 복구할 수 있습니다.
본 연구는 정형 데이터(tabular data)의 불균형 학습 문제를 다루기 위해 대규모 경험적 벤치마크인 TILBench를 제시합니다. TILBench는 57개의 다양한 정형 데이터셋과 40개 이상의 알고리즘을 사용하여 20만 개 이상의 통제된 실험을 수행했습니다. 연구 결과, 불균형 학습 방법의 효과는 특정 방법론에 국한되지 않고 데이터셋의 특성과 계산 제약 조건에 강력하게 의존함을 보여주며, 실질적인 방법 선택 가이드를 제공합니다.
본 논문은 고차원 데이터가 가지는 공간적 상관관계가 얕은 신경망의 학습 샘플 복잡도에 미치는 영향을 연구한다. 특히, 입력 특징이 클러스터 구조를 이루고 잠재 변수와 상관관계를 가질 때, 적절한 모델(layerwise gradient-descent)을 사용하면 샘플 복잡도가 은닉 변수의 수에 따라 확장되며 신호 대 잡음비가 충분히 높다면 입력 차원과는 무관함을 이론적으로 증명하고 경험적으로 검증한다.
연속적인 회귀 작업에서 예측 분포가 멀티모달일 때 발생하는 인식론적 불확실성을 효과적으로 포착하기 위한 새로운 능동 학습 프레임워크를 제안합니다. Two-Index 프레임워크를 통해 인식론적 불확실성과 데이터 자체의 무작위성을 분리하며, Mixture Density Network 앙상블을 위한 상호 정보량 하한(MI-LB) 근사치를 도출하여 기존 베이스라인보다 뛰어난 성능을 입증했습니다.
본 논문은 멀티모달 거대 언어 모델(MLLMs)의 지속 학습(Continual Learning) 문제를 해결하기 위해 Octopus라는 새로운 프레임워크를 제안합니다. 기존 방법들이 가진 계산 오버헤드, 데이터 저장 문제, 파라미터 간섭 등의 한계를 극복하고자 합니다. Octopus는 과거 태스크 데이터를 사용하지 않고도 그래디언트 수준의 직교성(Orthogonality)을 강제하는 이력 없는 그래디언트 직교화(HiFGO)를 기반으로 하며, 2단계 미세 조정 전략을 통해 모델의 가소성과 안정성을 효과적으로 균형 잡습니다.
본 연구는 에이전트가 주어진 목표 확률 $\phi$로 최소한 하나의 '성공'을 식별해야 하는 컨포멀 선택 문제를 다룹니다. 특히 피드백 정보가 제한적인(limited feedback) 상황에서, 자원 비용을 최소화하는 효율적인 온라인 컨포멀 예측 방법을 제안합니다. 연구진은 적응형 컨포멀 추론(ACI) 업데이트 규칙이 적대적으로 타당하며, 분포 변화 상황에서도 성공 목표 달성을 보장하고 확률적 효율성 및 서브리니어 효율성 후회(sublinear efficiency regret)를 입증하는 알고리즘을 제시합니다.
본 연구는 강화학습(RL)에서 발생하는 가치 근사 문제를 해결하기 위해 2차 최적화 기반의 Actor-Critic 방법론을 제안합니다. 기존 RL 방법들이 사용하는 1차 업데이트와 달리, 본 접근법은 목적 함수의 곡률 정보를 활용하여 수렴 속도를 높입니다. 특히, Critic이 Actor보다 빠르게 진화하는 '2-타임스케일' 프레임워크를 가정하고 Hessian-vector product (HVP) 계산을 통해 계산 효율적이고 안정적인 2차 업데이트 방법을 공식화했습니다.
본 논문은 기존 Shapley value가 요구하는 이진적이고 비순환적인 쌍별 우선순위 제약을 극복하고, 임의의 유향 가중 우선순위 그래프를 기반으로 하는 일반화된 우선순위 인지 Shapley value (GPASV)를 제안합니다. GPASV는 순서 위반에 페널티를 부여하는 방식으로 작동하며, 공리적 특성 규명과 새로운 계산 방법론을 통해 확립되었습니다. 연구진은 Chatbot Arena의 선호도 그래프와 같은 실제 복잡한 데이터에 GPASV를 적용하여, 우선순위 인지 가치 평가가 단순하지 않으며 다양한 유형의 우선순위 정보 간의 균형이 중요함을 입증했습니다.