Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 난류 반응 유동의 DNS 가속화를 위해 물리 기반 기계 학습 프레임워크를 제안합니다. 이 모델은 상세 화학 소스 항을 대리 모델로 대체하고, 훈련 시 두 번째 열역학 법칙(비음성 엔트로피 생성)을 통합하여 물리적 일관성을 확보했습니다. 또한 잔여 데이터 증강 전략으로 계산 효율성과 정확도를 동시에 높였습니다.
본 논문은 확률적 회로(PCs)가 데이터 노이즈나 분포 변화에 취약한 문제를 해결하기 위해 PeTeR이라는 새로운 학습 후 강건화 프레임워크를 제안합니다. PeTeR은 사전 학습된 PC를 재학습 없이 분포 변화에 강건하게 만드는 데이터 프리 방식입니다.
본 논문은 Group Relative Policy Optimization (GRPO)의 한계를 극복하기 위해 AdaPrefix-GRPO라는 새로운 방법을 제안합니다. 이 방법은 참조 해답의 접두사 길이를 난이도에 따라 동적으로 조절하는 피드백 컨트롤러를 도입하여, 모델 학습 과정에서 가장 효과적인 기울기 신호를 얻도록 합니다. 이를 통해 어려운 문제 해결 능력을 크게 향상시키고 트레이스 길이는 줄일 수 있습니다.
본 논문은 PDE 기반 물리 시스템의 역설계를 위해 신경 연산자(DeepONet)와 진화 전략(CMA-ES)을 결합한 NOTES를 제안합니다. NOTES는 위상 정보를 활용하여 고차원 설계 공간에서 효율적이고 전이 가능한 글로벌 최적화를 수행하며, 나노광학 빔 디플렉터 및 구조 최적화 등 다양한 분야에서 우수한 성능을 입증했습니다.
본 연구는 인과적 셀프 어텐션의 2차 비용 문제를 해결하기 위해 트랜스포머 선형화 기법을 제안합니다. 모델 품질 보존에 초점을 맞춰, 상태 업데이트 설계와 구조적 개입(싱크 토큰 등)을 분석했습니다. LLaMA 및 Qwen 같은 대규모 모델까지 확장하여 MMLU에서 우수한 성능과 긴 컨텍스트 검색 능력을 입증했습니다.
본 논문은 MILP(혼합-정수 선형 계획법) 인스턴스를 생성하는 새로운 방법인 GraphBU를 제안합니다. 기존 방식의 한계를 극복하기 위해, GraphBU는 국부 서브문제와 그 인터페이스로 구성된 그래프 네이티브 생성기를 사용합니다. 이 접근법은 결합 노드를 마스터 제약 조건이나 경계 변수로 승격시켜 높은 호환성을 보장하며, 다운스트림 예측 및 검색 학습 성능을 개선하는 것으로 나타났습니다.
본 논문은 2단계 샘플링 프레임워크에서 커널 기반 연산자 학습을 연구하며, 오프라인 회귀와 온라인 재구성 과정을 다룹니다. 주요 이론적 기여는 데이터 크기($N, n, m$) 간의 명시적인 예산 할당 조건을 제시하여 전체 오차를 분석하고 수렴 스케일링 법칙을 도출했습니다. 또한, PDE 지식을 통합하는 물리 정보 기반 확장 방법을 제안합니다.
본 논문은 텐서 프로그램을 활용하여 무한 너비의 가우시안 프로세스 극한을 가진 랜덤 신경망을 연구하고, Wasserstein 거리에서의 정량적 수렴 이론을 제시합니다. 특히 유한 네트워크 실행과 그들의 가우시안 프로세스 극한 사이의 오차 경계를 명확히 합니다.
본 논문은 디더링 가우시안 메커니즘(dithered Gaussian mechanism)을 제안합니다. 이는 기존 이산 가우시안 메커니즘의 대안으로, 사적인 출력 자체를 이산화하여 표준 가우시안 메커니즘의 프라이버시 보장을 유지하면서 유한 정밀도 부동 소수점 취약점을 회피합니다. 또한, 증명 가능한 랜덤성 효율성을 통해 필요한 난수 비트 수를 크게 줄여 성능과 보안을 동시에 확보했습니다.
본 논문은 편미분 방정식(PDE)의 해 집합에 대한 유한 차원 임베딩을 학습하는 물리 정보 프레임워크를 제안합니다. 다중 헤드 Physics-Informed Neural Network를 사용하여 공유 본체가 잠재 다양체를 학습하고, 선형 헤드가 개별 해를 재구성합니다. 이 방법은 초기 조건의 변동성을 효과적으로 포착하며, 낮은 차원의 주성분으로 높은 분산 설명력을 보여줍니다.
본 논문은 로봇 조작에 유망한 VLA 모델의 계산 병목 현상을 해결하기 위해 ActionCache라는 외부 캐시를 제안합니다. 이 캐시는 과거 중간 액션을 재사용하여 목표 액션 근처에서의 생성을 워밍업함으로써 추론 지연 시간을 크게 줄입니다. 실험 결과, ActionCache는 대표적인 플로우 기반 VLA 모델에서 높은 태스크 성공률을 유지하며 상당한 추론 가속화를 달성했습니다.
복잡한 물리적 상호작용이 발생하는 환경을 위한 최초의 멀티플레이어 월드 모델을 소개합니다. Rocket League 데이터를 활용해 50억 파라미터 규모의 잠재 확산 모델을 구축하였으며, 여러 에이전트의 행동을 조건으로 실시간 상호작용을 생성합니다.
LLM 생성 텍스트에 삽입된 워터마크의 선택적 공개를 가능하게 하는 새로운 프레임워크 HeRo를 제안합니다. 계층적 어휘 라우팅을 통해 정보 노출을 최소화하면서도 세밀한 액세스 제어와 높은 탐지 정확도를 동시에 달성합니다.
언어 모델의 뉴런 기여도 점수가 인과적으로 중요한 행을 실제로 식별하는지 검증하는 연구입니다. 원샷 뉴런 제로화 방식을 통해 기여도 기반 방법이 모델의 유창성을 유지하면서도 유해한 요청에 대한 거절 메커니즘을 효과적으로 제어할 수 있음을 입증했습니다.
오프라인 강화학습의 오프-정책 평가를 위해 Bellman 완결성 가정 없이도 작동하는 FORE(Fitted Occupancy-Ratio Evaluation) 방법을 제안합니다. adjoint Bellman 재귀를 활용하여 할인된 점유율 비율을 추정하며, 이론적 수렴성과 유한 샘플 후회 경계를 입증했습니다.
장기적 목표를 수행하는 에이전트형 LLM의 컨텍스트 제한 문제를 해결하기 위해 컨텍스트 압축을 강화학습에 통합한 CompactionRL을 제안합니다. 토큰 수준 손실 정규화와 교차 궤적 일반화 어드밴티지 추정을 통해 작업 실행과 요약 생성을 동시에 최적화합니다.
변동성이 큰 자동화 작업(VA)을 위해 그래프 기반 정책(GaP)을 활용하는 멀티 에이전트 자기 학습 프레임워크를 제안합니다. MORSL 라이브러리를 통해 인지, 계획, 제어 노드를 포함하는 계산 그래프를 생성하고 시뮬레이션을 통해 이를 반복적으로 최적화합니다.
이산 확산 모델(Discrete Diffusion Model)의 학습 대상과 최적화 원리를 수학적으로 분석한 연구입니다. CTMC ELBO 유도를 통해 오라클 거리 정리를 증명하고, 디노이저, 스코어, 브릿지 플러그인 간의 관계를 규명합니다.
LLM의 검증 능력을 새로운 확장 축으로 정의한 'LLM-as-a-Verifier' 프레임워크를 소개합니다. 이 방식은 이산적 점수 대신 로짓 분포의 기댓값을 활용한 연속적 점수를 생성하여 검증의 정밀도와 정확도를 높입니다. 다양한 벤치마크에서 SOTA 성능을 기록하며 에이전트 모니터링 및 강화학습 피드백으로도 활용 가능함을 입증했습니다.
약한 모델의 강화학습(RL) 성과를 강한 모델로 효율적으로 전이하는 Direct-OPD 기법을 제안합니다. 교사 모델의 정책 변화를 암시적 보상 신호로 활용하여, 타겟 모델의 추가적인 롤아웃 비용 없이도 추론 성능을 크게 향상시킵니다.