Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
정답(Ground-Truth) 없이 결정론적 실행 피드백을 활용해 LLM을 학습시키는 RiVER 프레임워크를 제안합니다. 보상 형성 과정에서 발생하는 규모 및 빈도 지배 문제를 해결하여, 점수 기반 작업 학습만으로도 코딩 벤치마크 성능을 유의미하게 향상시켰습니다.
DanceOPD는 이미지 생성 모델의 T2I, 로컬/글로벌 편집 능력을 통합하기 위한 온폴리시 생성 필드 증류 프레임워크입니다. flow-matching 모델을 기반으로 각 능력을 속도 필드로 정의하여, 모델이 다양한 생성 능력을 충돌 없이 학습하도록 돕습니다.
본 논문은 DP-SGD의 과도한 노이즈 문제를 해결하기 위해 하이퍼네트워크를 활용한 새로운 차분 프라이버시(DP) 학습 프레임워크를 제안합니다. 저차원 임베딩에 노이즈를 한 번만 주입하여 타겟 모델의 파라미터를 생성함으로써 모델의 유용성을 높였습니다.
식용 곤충의 종 인증을 위해 배치 간 변동성을 극복하는 BISN 프레임워크를 제안합니다. 엔트로피 정규화 적대적 목적 함수를 통해 배치 효과를 억제하며, 높은 정확도와 생화학적 해석 가능성을 동시에 달성했습니다.
ProtoKV는 스트리밍 비디오 이해(SVU) 환경에서 지연된 쿼리에 대응하기 위해 제안된 상수 크기 메모리 기술입니다. 과거 이력을 요약된 상태로 표현하여 제한된 GPU 메모리 내에서 비디오의 핵심 정보를 효율적으로 유지합니다.
확산 트랜스포머(DiT)의 추론 속도를 높이기 위해 특징 캐싱을 활용하는 LearniBridge를 제안합니다. 저차원 부분 공간을 활용한 경량 LoRA 업데이트를 통해 오차 누적 문제를 해결하고, FLUX 및 WAN2.1 등에서 높은 가속 성능을 입증했습니다.
멀티모달 에이전트형 RAG 시스템의 다양한 공격 표면을 탐색하기 위한 통합 레드팀 프레임워크 MIRROR를 제안합니다. MCTS와 참신함 제약을 활용하여 텍스트, 이미지, 오케스트레이터 조작 등 여러 공격 방식에서 높은 성공률을 입증했습니다.
장기 실행 언어 에이전트의 목표 지속성을 위해 '메모리 깊이'라는 개념을 제안합니다. 단순 검색을 넘어 LoRA 기반의 EVAF 메커니즘을 통해 중요한 경험을 파라미터에 선택적으로 통합하는 연구를 다룹니다.
고품질 추론 모델 학습을 위해 초기 추론 토큰의 손실 값을 활용하여 난이도 높은 데이터를 식별하는 새로운 데이터 큐레이션 방법을 제안합니다. 기존 방식보다 비용 효율적이며, Qwen2.5 및 Llama3.1 모델 실험을 통해 성능 향상을 입증했습니다.
연합 학습(FL)의 통신 및 연산 효율성을 높이기 위한 양자화 기술을 체계적으로 리뷰한 연구입니다. 클라이언트 이질성, 보안, 하드웨어 최적화 등 FL 특화 차원을 중심으로 새로운 분류 체계를 제안합니다.
Weisfeiler-Leman 계층 내에서 확장 가능한 메시지 전달 방식을 갖춘 양자 그래프 신경망(QGNN) 연구를 소개합니다. 사전 학습을 통해 학습 가능성 문제를 해결하고, 대규모 시뮬레이션과 분자 특성 예측 등을 통해 이론적 보장과 실질적 확장성을 검증했습니다.
SamAdams 가변 타임스텝과 위치 적응형 Langevin(PAL) 역학을 결합한 새로운 가속 샘플링 방법인 SA-PAL을 제안합니다. 이 방식은 적응형 타임스텝과 마찰 텐서 구조를 활용하여 반복당 단 한 번의 힘 평가만으로도 높은 효율성을 달성합니다.
지수형 분포를 포함한 매개변수적 가족에서의 예언자 부등식(Prophet Inequalities)에 대한 최적 학습을 연구합니다. 최적의 점근적 경쟁비를 규명하고, 온라인 관측값만으로 이를 달성하는 신뢰 기반 동적 계획법 정책을 제안합니다.
dMRI tractography를 생성적 사전 정보로 활용하여 조직학 이미지의 섬유 다발 분할을 위한 합성 데이터를 생성하는 프레임워크를 제안합니다. 이 방식은 수동 어노테이션 양을 3배 줄이면서도 최첨단 성능에 도달하는 향상된 일반화 성능을 보여줍니다.
오픈셋 준지도 학습(OSSL)에서 발생하는 샘플 필터링과 의사 레이블 충돌 문제를 해결하기 위해 '기하학적 그래디언트 교정(GGR)' 프레임워크를 제안합니다. 지도 그래디언트를 기준으로 보조 그래디언트를 투영하여 정보 손실을 최소화하면서도 학습 안정성을 높입니다.
RolloutPipe는 분리형 아키텍처 기반의 RLVR 시스템에서 롤아웃 생성과 정책 학습을 효율적으로 중첩시키는 프레임워크입니다. CGP와 FGD 기술을 통해 온-폴리시 정확성을 유지하면서도 학습 대기 시간을 획기적으로 단축합니다.
정답 데이터 없이도 CT 영상을 재구성할 수 있는 자기지도 학습 기반의 N2I-LPD 프레임워크를 제안합니다. Noise2Inverse를 Learned Primal-Dual 알고리즘에 적용하여 저선량 및 희소 각도 환경에서 높은 재구성 품질을 달성했습니다.
수치 예보의 데이터 동화 과정에서 Conformal Prediction(CP)을 활용하여 불확실성을 정량화하는 연구를 다룹니다. 다양한 CP 변형 방식의 성능을 비교하고, 이를 전통적인 앙상블 기반 측정치와 비교 분석하여 효과를 검증합니다.
JEPA 기반 월드 모델의 이론적 이해를 돕기 위해 최초의 일반화 이론을 제안합니다. JEPA 사전 학습을 스펙트럼 그래프 학습 문제로 공식화하여 사전 학습 오차와 다운스트림 계획 후회 사이의 관계를 규명합니다.
Hamiltonian Neural Networks(HNNs)의 학습 효율을 높이기 위해 암시적 심플렉틱 적분기를 활용하는 새로운 연구를 소개합니다. 노이즈가 있는 관측 환경에서도 에너지 보존 법칙을 유지하며 시스템의 Hamiltonian을 정확하게 식별하는 방법을 제안합니다.