Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
연합 에지 학습(FEEL) 환경에서 훈련과 추론을 동시에 최적화하는 온라인 프레임워크를 제안합니다. C-MOPPO 알고리즘을 통해 지연 시간, 에너지 소비, 추론 정확도 사이의 최적의 균형을 달성합니다.
멀티 에이전트 LLM의 숙의 과정을 Friedkin-Johnsen 의견 역학 모델로 분석하여, 에이전트 간의 소통 방식이 전문가 혼합(MoE) 모델처럼 작동함을 규명합니다. 에이전트의 역량에 따른 라우팅이 시스템 성능을 결정하는 핵심 요소임을 제시합니다.
RawMal-TF 컬렉션을 기반으로 패밀리 및 유형별 레이블이 지정된 적대적 악성코드 데이터셋을 구축했습니다. EMBER 분류기에 대해 높은 회피율을 달성했으며, 데이터 오염 공격이 악성코드 탐지 시스템의 강건성에 미치는 취약성을 입증했습니다.
STaT는 비정상 시계열 예측 시 발생하는 형태 왜곡 문제를 해결하기 위해 상징적, 시간적, 텍스트 모달리티를 결합한 혁신적인 멀티모달 아키텍처를 제안합니다. 이 모델은 수치적 정확도와 도메인 의미론을 동시에 활용하여 예측의 매끄러움과 변동성 사이의 균형을 맞춥니다.
합성 오디오의 출처 증명을 위해 이산화 과정의 어휘 중복성을 활용한 새로운 그래디언트 프리(Gradient-free) 워터마킹 기술을 제안합니다. 기존의 미세 조정 방식 없이도 토큰 오류를 완화하여 탐지 성능과 견고성을 획기적으로 높였습니다.
기존 벤치마크가 실제 배포 행동을 충분히 지원하지 못하는 문제를 해결하기 위해 '배포 완결적 벤치마킹' 개념을 제안합니다. 벤치마크가 특정 행동을 결정하기 위해 필요한 증거의 완결성을 정량화하고, 모호성을 해결하는 방법을 다룹니다.
딥러닝 모델의 부동 소수점 산술 변동성을 신속하게 평가하기 위한 프레임워크인 Fuzzy PyTorch를 소개합니다. 확률적 반올림 기술을 통해 기존 도구 대비 실행 시간을 대폭 단축하며 대규모 모델에서도 높은 확장성을 입증했습니다.
LLM 개발 및 평가 과정에서 발생하는 데이터 혼합, 보상 모델, 라우팅 전략 등의 핵심 질문들을 인과적 방법론(Causal methods) 관점에서 분석합니다. 기존의 예측 중심 접근 방식이 가진 한계를 지적하며, 인과 추론을 통한 과학적이고 신뢰할 수 있는 설계 방안을 제시합니다.
무한 분산을 가진 확률적 경사 하강법(SGD) 환경에서도 통계적 추론이 가능하도록 돕는 새로운 방법론을 제안합니다. 모델 불가지론적 접근을 통해 SGD 궤적으로부터 신뢰 영역을 구축하며, 유한 및 무한 분산 영역 모두에서 점근적으로 유효한 결과를 제공합니다.
뉴럴 오퍼레이터를 활용하여 전산유체역학(CFD) 기반의 베이지안 역설계 과정을 획기적으로 가속화하는 연구입니다. 대리 모델을 MCMC 샘플링 루프에 직접 통합하여 물리적 불확실성을 보존하면서도 추론 시간을 1초 미만으로 단축했습니다.
신경망의 길이 일반화 문제를 해결하기 위해 로그 깊이 순환 유닛(MLP-LDRU)을 제안합니다. 이 모델은 병렬 리덕션을 통해 순환을 근사하며, 정규 언어 및 NLP 벤치마크에서 기존 모델을 능가하는 성능을 보였습니다.
모델 파라미터의 불확실성을 줄이는 대신 특정 의사결정 목표를 최적화하는 GoBOED 프레임워크를 제안합니다. 변분 사후 대리 모델과 미분 가능한 의사결정 레이어를 결합하여 목표 지향적인 실험 설계를 가능하게 합니다.
Paris 2.0은 분산형 연산을 통해 학습된 최초의 비디오 생성 모델입니다. 기존 Paris 1.0의 이미지 생성 기술을 넘어, 분산형 환경에서도 시간적 일관성을 유지하는 비디오 생성을 성공적으로 구현했습니다.
사용자 선호도 학습의 비용 문제를 해결하기 위해 능동적 쿼리 합성 프레임워크인 Info-Synth를 제안합니다. 이 프레임워크는 피드백의 신뢰도 문제를 고려하며, 연속 공간 내 상호 정보량을 최대화하여 최적의 쿼리를 생성합니다.
LLM이 새로운 물리 법칙을 발견할 수 있는지 평가하는 대화형 벤치마크인 DiscoverPhysics를 소개합니다. 에이전트가 시뮬레이션 세계의 데이터를 관찰하고 가설을 세워 물리 법칙을 추론하는 능력을 측정합니다.
Wasserstein 정책 경사(WPG)를 활용한 엔트로피 정규화 강화학습의 전역 수렴 이론을 다룹니다. Bellman 구조를 활용하여 기존의 볼록성 기반 분석을 대체하고, 분포적 Polyak-Łojasiewicz 조건을 통해 수렴성을 증명합니다.
마스크 확산 모델(MDM)의 효율성을 높이기 위해 트랜스포머의 레이어를 선택적으로 루프시키는 LoopMDM 구조를 제안합니다. 이 방식은 파라미터 추가 없이 모델의 깊이를 확장하며, 훈련 효율성과 추론 성능을 동시에 개선합니다.
언어 모델이 새로운 태스크를 학습할 때 발생하는 망각 현상을 해결하기 위해 '자기 생성 재생(Self-Generated Replay)' 기법을 제안합니다. 모델 스스로 생성한 샘플을 활용하면 이전 지식을 유지하면서도 효율적인 미세 조정이 가능함을 입증했습니다.
부분 관측된 동적 시스템을 학습하기 위해 Hamiltonian 신경망과 Neural ODE를 결합한 NHODE 프레임워크를 제안합니다. 물리적 구조를 임베딩하여 에너지 보존을 강제함으로써, 관측되지 않은 상태에서도 높은 예측 정확도와 장기 안정성을 확보합니다.
차원 축소(DR) 과정에서 발생하는 시각적 아티팩트의 원인인 '모호한 인스턴스' 문제를 다룹니다. 고차원에서 여러 이웃과 유사한 데이터를 단일 점으로 매핑할 때 발생하는 왜곡을 해결하기 위해, 데이터를 여러 점으로 분할하여 투영하는 그래프 기반 접근 방식을 제안합니다.