Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Fast-TurboQuant는 LLM의 메모리 병목을 해결하기 위해 곱셈 없이 덧셈만으로 수행되는 새로운 벡터 양자화 방식을 제안합니다. 기존 TurboQuant의 무거운 회전 행렬 대신 빠른 Walsh-Hadamard 변환을 사용하여 연산 복잡도를 획기적으로 낮췄습니다.
이산 오디오 토큰 기반 음성 향상 모델의 최적화를 위해 지각적 보상을 활용한 사후 학습(post-training) 방법을 제안합니다. 미분 불가능한 품질 지표를 직접 보상 신호로 사용하는 GSPO 기법을 통해 DNS2020 벤치마크에서 SOTA 성능을 달성했습니다.
피질하 영역 분할 시 템플릿 공간보다 네이티브 공간 기반 파이프라인이 더 높은 정확도를 보임을 입증했습니다. 특히 파킨슨병 수술 계획에 필수적인 STN, RN, SN 분할에서 우수한 성능을 기록했습니다.
ASCII Art를 활용해 시각적 관찰을 텍스트로 변환함으로써, 텍스트 전용 LLM을 VLA(Vision-Language-Action) 컨트롤러로 활용하는 연구를 소개합니다. 이 방식은 기존 LLM 스택을 유지하면서도 효율적인 시각 상태 조건화와 액션 생성을 가능하게 합니다.
위성 데이터와 기상 정보를 융합하여 토양 수분을 정밀하게 추정하는 딥러닝 연구를 소개합니다. 기상 변수의 시간 지연과 토양 층간 수분 전파를 고려한 CNN, LSTM, CNN-LSTM 하이브리드 모델의 성능을 비교 분석했습니다.
아프리카계 미국인 코호트를 대상으로 대장 내시경 전 비침습적 데이터를 활용해 고위험 대장 용종을 예측하는 머신러닝 모델 연구입니다. 신경망, XGBoost 등 다양한 모델을 개발하고 시계열 외부 검증을 통해 모델의 유효성을 입증했습니다.
본 연구는 VLA 모델이 선언적 지식과 절차적 지식을 분리하지 못해 제로샷 기술 전이에 한계가 있는 문제를 다룹니다. 이를 해결하기 위해 정보 흐름을 재구조화한 w²VLA 모델을 제안하여, 새로운 객체에 대한 견고한 행동 복제와 전례 없는 제로샷 전이 능력을 입증했습니다.
기존 역전파 방식의 순차적 제약을 극복하기 위해 계층적 블록 국소 학습(HBLL) 프레임워크를 제안합니다. HBLL은 $\mathcal{O}(\log N)$의 병렬 시간 복잡도로 심층 신경망을 학습할 수 있어 확장성을 크게 높였습니다.
자기회귀 text-to-image 모델의 정렬을 위해 GRPO 스타일의 강화학습 프레임워크 내에서 f-발산(f-divergence)을 분석한 연구입니다. JS 정규화가 참조 정책과의 발산을 효과적으로 제어하여 생성 성능과 다양성 사이의 최적의 균형을 제공함을 입증했습니다.
IoMT 환경의 보안을 위해 Federated TGCN-A2C라는 프라이버시 보존형 방어 아키텍처를 제안합니다. 디지털 트윈과 강화 학습 에이전트를 결합하여 사이버 위협에 적응적으로 대응하며 높은 탐지 정확도를 달성했습니다.
Muon 옵티마이저의 성능을 강-계곡(River-Valley) 관점에서 분석한 연구입니다. Muon이 초기 학습에는 유리하지만, 목표 지점 근처에서는 잔여 스케일 정보 부족으로 진동이 발생할 수 있음을 이론적으로 규명했습니다.
환경 역학이 미분 가능한 경우 시뮬레이션을 통해 역전파를 수행하는 해석적 정책 경사(APG) 방식을 제안합니다. PPO와 같은 모델 프리 방식보다 정확한 경사 계산이 가능하며, 다양한 연속 제어 작업에서 샘플 및 계산 효율성을 평가했습니다.
min-max 최적화 문제를 해결하기 위해 Halpern 반복에서 영감을 얻은 GOMA 방법론을 제안합니다. 이 방법은 단일 그래디언트 호출만으로도 결정론적 및 확률적 환경에서 우수한 수렴 속도를 달성합니다.
기존 그래프 필터링(GF) 기반 협업 필터링의 메모리 병목 문제를 해결하기 위해 Krylov 부분 공간을 활용한 Mem-GF를 제안합니다. 아이템 유사도 그래프를 명시적으로 저장하지 않고도 다항식 필터를 근사하여 메모리 사용량을 대폭 줄였습니다.
Transformer 내부의 정보 흐름을 분석하기 위해 레이어별 통합 기울기(LIG) 기법을 제안합니다. Set-to-set Integrated Gradients를 활용하여 Multi-Head Attention과 MLP 모듈 간의 토큰 기여도를 정밀하게 추적합니다.
Transformer의 긴 시퀀스 처리 시 발생하는 높은 계산 비용 문제를 해결하기 위해, 전체 이력을 사용하는 Transformer의 압축 전략을 Recurrent Transformer로 전달하는 증류(distillation) 기법을 제안합니다. 이를 통해 고정된 메모리 크기 내에서도 전체 이력을 사용하는 모델에 근접하는 성능을 구현합니다.
자율 주행 강화학습의 샘플링 효율성을 높이기 위한 새로운 병렬 프레임워크 FAST를 제안합니다. DPSA와 SMPO 기술을 통해 데이터 편향 없이 샘플링 병목 현상을 해결하며, 기존 방식 대비 최대 1.78배의 속도 향상을 달성했습니다.
노이즈가 있는 관측 환경에서 신념(belief) 간의 전환 비용을 기하학적으로 정의하는 새로운 프레임워크를 제안합니다. Fisher information을 활용해 Wasserstein 공간을 재가중함으로써 추론의 비용 구조와 가우시안 분포의 극단성을 수학적으로 규명합니다.
멀티모달 연합 그래프 학습(MM-FGL)에서 발생하는 클라이언트 및 노드 수준의 모달리티 불균형 문제를 해결하기 위한 FedMGS 프레임워크를 제안합니다. 데이터 합성 기반의 접근 방식을 통해 누락된 모달리티의 의미를 복구하고 모델의 성능과 효율성을 높였습니다.
본 연구는 심층 강화학습의 샘플 효율성을 높이는 직접적 어드밴티지 추정(DAE)의 한계를 개선합니다. 부분 관측 가능 도메인으로의 확장과 이산 잠재 역학 모델을 통한 계산 복잡도 감소를 통해 효율적인 학습을 가능하게 합니다.