Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
표 형식 파운데이션 모델의 인컨텍스트 학습 시 발생할 수 있는 개인정보 유출 문제를 해결하기 위한 TabPATE를 제안합니다. 공개 데이터 없이 차분 프라이버시(DP) 기반의 PATE 방식을 적용하여 데이터 유용성을 유지하면서도 멤버십 추론 공격을 효과적으로 방어합니다.
동결된 소규모 코드 모델의 자기 수정 성능을 평가하기 위해 반증 가능성을 기반으로 한 새로운 방법론을 제안합니다. 단순 재시도와 피드백의 효과를 구분하기 위해 위약 대조 도구를 구축하여 실험적 검증을 수행했습니다.
언어 모델이 작성한 확률적 프로그램의 통계적 오류를 탐지하고 수정하는 연구를 소개합니다. 기존 단위 테스트가 잡아내지 못하는 잘못 지정된 모델을 베이지안 워크플로우 기반의 교정 오라클을 통해 효과적으로 검증하고 개선할 수 있음을 보여줍니다.
양자 기계 학습(QML)에서 발생하는 바렌 플레이토(Barren Plateaus) 현상의 수학적 원인을 분석하고, 이를 해결하기 위한 동적 리 대수(DLA) 기반의 프레임워크를 제안합니다. 대칭 보존 접근 방식을 통해 학습 가능한 기울기 지형을 확보함으로써 확장 가능한 양자 신경망 설계 로드맵을 제시합니다.
RaBitQCache는 긴 문맥 LLM 추론 시 발생하는 KV 캐시 병목 현상을 해결하기 위한 새로운 희소 어텐션 프레임워크입니다. 무작위 회전 이진 양자화를 통해 어텐션 가중치를 효율적으로 추정하며, 적응형 Top-p 검색과 하드웨어 인식 시스템을 통해 추론 속도를 높이고 메모리 I/O를 절감합니다.
Split Conformal Prediction의 통계적 효율성을 높이기 위해 훈련 및 교정 샘플의 최적 분할 비율을 결정하는 이론적 프레임워크를 제안합니다. 대칭 및 비대칭 체제에서의 분석적 특성을 도출하고 선형 회귀부터 신경망까지 다양한 모델에 적용 가능함을 입증했습니다.
Vision-Language Models(VLMs)를 활용한 이미지 분류에서 불확실성을 정량화하기 위한 국소적 컨포멀 예측(Localized Conformal Prediction) 연구를 소개합니다. 기존 코사인 유사도 방식의 한계를 극복하기 위해 비선형 변환을 제안하며, 이를 통해 평균 집합 크기를 효과적으로 감소시켰습니다.
생성형 머신러닝의 핵심인 확률 미분 방정식(SDE)과 포커-플랑크 방정식에 대한 이론적 입문을 다룹니다. 확산 모델, 스코어 매칭, 플로우 매칭을 변분적 관점에서 통합적으로 이해할 수 있는 수학적 프레임워크를 제공합니다.
머신러닝 시스템(MLS)의 신뢰성을 확보하기 위해 이해관계자의 요구사항을 체계적으로 모델링하는 REAL 프레임워크를 제안합니다. 데이터, 모델, 시스템 전체를 통합하고 실패 사례를 통해 요구사항을 정교화하는 세 가지 원칙을 제시합니다.
학습된 신경망의 입력값 노이즈 섭동에 대한 강건성을 측정하는 새로운 지표를 제안합니다. MSE와 정확도 사이의 관계를 분석하며, 블랙박스 방식으로 계산이 효율적인 강건성 상한 측정법을 제시합니다.
SWE-Interact는 다회차 상호작용과 사용자 주도형 워크플로우를 통해 코딩 에이전트의 능력을 평가하는 새로운 벤치마크를 제안합니다. 기존 단회차 평가와 달리, 모호한 요구사항과 점진적인 피드백에 대응하는 에이전트의 적응력을 측정합니다.
LLM 사후 학습에서 온라인 모방 학습(IL)이 오프라인 SFT보다 효과적인 원인을 분석한 연구입니다. 온라인 상호작용의 이점은 오차 누적이 아닌, 학생 모델이 전문가 모델을 표현할 수 있는지 여부(realizability)에 달려 있음을 밝혀냈습니다.
개방 양자계(Open Quantum Systems)의 Lindbladian 계수를 학습하기 위한 새로운 알고리즘을 제안합니다. 보조 큐비트 없이 무작위 Pauli 측정을 사용하는 비적응형 방식을 통해 준-국소 및 멱법칙 구조를 효율적으로 학습할 수 있습니다.
모델 병합을 통한 무단 모델 통합을 막기 위한 파라미터 수준 방어 기제의 취약성을 분석한 연구입니다. 사전 학습된 모델의 지배력을 이용해 방어 기제를 우회하는 '앵커 가이드 공격(AGA)'을 제안하며, 이를 방어하기 위한 '앵커 반발 미세 조정(ARF)' 방법론을 함께 제시합니다.
FlowAWR은 연속 공간에서 생성형 플로우 모델을 온라인 강화학습으로 정렬하는 새로운 패러다임을 제안합니다. SDE 샘플러와 CFG 없이도 이론적으로 최적화된 속도장을 도출하여 수렴 속도와 정렬 성능을 크게 향상시켰습니다.
RenderFormer++는 메쉬 장면의 전역 조명을 위한 확장 가능한 피드포워드 신경 렌더링 프레임워크입니다. PITG와 HOCT 기술을 통해 물리적 일관성을 유지하면서도 계산 복잡도를 획기적으로 줄였습니다.
신경망 학습 궤적을 시계열 네트워크의 스칼라 임베딩을 통해 저차원으로 표현하는 연구를 소개합니다. MNIST 실험을 통해 임베딩이 학습률 민감도와 리아푸노프 지수 등 주요 역학적 특징을 효과적으로 보존함을 입증했습니다.
긴 문맥 LLM 디코딩 시 발생하는 동적 희소 어텐션(DSA)의 지연 시간 문제를 해결하기 위해 PRR 런타임을 제안합니다. 예측, 재사용, 복구 메커니즘을 통해 정확도를 유지하면서 디코딩 지연 시간을 최대 40% 단축했습니다.
본 논문은 2층 ReLU 신경망이 SGD를 통해 학습할 때 가짜 상관관계(spurious correlations)를 지수적으로 빠르게 학습하는 메커니즘을 이론적으로 규명합니다. XOR 신호와 가짜 특징이 공존할 때, 가짜 특징이 신호 학습을 억제하는 상전이 현상을 분석합니다.
확산 모델의 증류와 강화학습 미세 조정을 결합한 새로운 프레임워크인 RMMD를 제안합니다. RMMD는 샘플링 루프를 온폴리시 학습에 맞게 조정하여 생성 품질과 속도 사이의 최적의 트레이드오프를 달성합니다.