Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
우주선 재진입 시의 자세 제어를 위해 심층 강화학습(DRL)을 적용한 연구입니다. 전통적인 PID 제어기와 비교하여 동역학 무작위화를 통해 일반화 성능을 높였으며, 하이브리드 제어 방식이 변화하는 환경에서도 더 강건한 성능을 보임을 입증했습니다.
무한 영역에서의 편미분 방정식을 효율적으로 해결하기 위한 도메인 분할 무작위 신경망 프레임워크를 제안합니다. 근접장과 원격장을 각각 담당하는 서브 네트워크를 통해 절단 오차를 줄이고 복잡한 기하학적 구조를 효과적으로 포착합니다.
수직적 연합 학습(VFL)에서 통신 오버헤드를 줄이기 위해 기대 이득 기반의 선택적 에스컬레이션 프로토콜을 제안합니다. 예측 정확도 개선이 통신 비용을 정당화할 때만 임베딩 융합을 수행하여 효율성을 높입니다.
안전한 온라인 강화학습을 위해 성능과 안전 사이의 매끄러운 전환을 지원하는 AutoSafe 아키텍처를 제안합니다. 기존의 불연속적인 행동 개입 방식 대신, 안전 인지 정책을 통해 최적화 역학을 유지하며 제약 조건을 준수합니다.
복소수 값 신호 분석을 위해 IQ 채널 간 파라미터를 공유하는 DualNN 프레임워크와 Transformer 기반의 Dualformer 아키텍처를 제안합니다. 이 모델은 표현 능력을 유지하면서 일반화 오차를 줄여 AMR, SSR, SSP 등 다양한 신호 분석 작업에서 뛰어난 성능을 보입니다.
LLM 에이전트가 평가자 피드백을 통해 학습할 때 발생하는 '평가자 선호도 결합' 현상을 완화하기 위한 확률 교정(Probability Calibration) 연구를 소개합니다. 평가자의 판단에 확률 교정을 적용함으로써 가짜 선호도 전파를 줄이고 학습의 정확도를 높일 수 있음을 실험으로 증명했습니다.
제한된 적응성 환경에서 일반화 선형 보상을 갖는 문맥적 슬레이트 밴딧 문제를 다루는 연구입니다. 배치형 및 드물게 전환되는 방식의 새로운 알고리즘을 제안하며, 이론적 후회 한계 증명과 함께 언어 모델의 인컨텍스트 예시 선택 작업에서의 성능을 입증했습니다.
저계수 행렬 최적화의 효율성을 높이기 위해 방향-크기 분해(DMD)라는 새로운 프레임워크를 제안합니다. 과매개변수화된 DMD와 재귀적 DMD 두 가지 방식을 통해 기존 Burer-Monteiro 정식화보다 지수적으로 빠른 수렴 속도를 입증했습니다.
Slater 조건과 같은 정규성 가정 없이도 작동하는 제약 조건이 있는 온라인 볼록 최적화(COCO) 프레임워크를 제안합니다. 적응형 정규화 항을 통합한 anytime primal-dual 방식을 통해 확률적 및 적대적 제약 조건 환경에서 안정적인 성능을 보장합니다.
원본 데이터 없이 에지 디바이스용 객체 탐지 모델을 양자화하는 GoodQ 프레임워크를 제안합니다. 기성 생성 모델을 활용해 학습 세트를 구축하며, 정보 밀집 프롬프팅과 노이즈 감소 기술을 통해 저비트 양자화 성능을 극대화했습니다.
생성형 음성 기술 발전에 따른 음성 스푸핑 탐지의 일반화 성능 문제를 해결하기 위한 연구입니다. 언어적 편향을 줄이기 위해 Gradient Reversal과 Variational Information Bottleneck을 결합한 새로운 프레임워크를 제안합니다.
기존의 '선(先) 사고 후(後) 결정' 방식 대신, 모델의 확신도를 기반으로 분기점을 먼저 식별하는 'Fork-think with confidence' 방법론을 제안합니다. 이 방식은 병렬 사고와 대등한 성능을 유지하면서도 토큰 소비량과 실행 시간을 획기적으로 줄일 수 있습니다.
표 형식 파운데이션 모델의 인컨텍스트 학습 시 발생할 수 있는 개인정보 유출 문제를 해결하기 위한 TabPATE를 제안합니다. 공개 데이터 없이 차분 프라이버시(DP) 기반의 PATE 방식을 적용하여 데이터 유용성을 유지하면서도 멤버십 추론 공격을 효과적으로 방어합니다.
동결된 소규모 코드 모델의 자기 수정 성능을 평가하기 위해 반증 가능성을 기반으로 한 새로운 방법론을 제안합니다. 단순 재시도와 피드백의 효과를 구분하기 위해 위약 대조 도구를 구축하여 실험적 검증을 수행했습니다.
언어 모델이 작성한 확률적 프로그램의 통계적 오류를 탐지하고 수정하는 연구를 소개합니다. 기존 단위 테스트가 잡아내지 못하는 잘못 지정된 모델을 베이지안 워크플로우 기반의 교정 오라클을 통해 효과적으로 검증하고 개선할 수 있음을 보여줍니다.
양자 기계 학습(QML)에서 발생하는 바렌 플레이토(Barren Plateaus) 현상의 수학적 원인을 분석하고, 이를 해결하기 위한 동적 리 대수(DLA) 기반의 프레임워크를 제안합니다. 대칭 보존 접근 방식을 통해 학습 가능한 기울기 지형을 확보함으로써 확장 가능한 양자 신경망 설계 로드맵을 제시합니다.
RaBitQCache는 긴 문맥 LLM 추론 시 발생하는 KV 캐시 병목 현상을 해결하기 위한 새로운 희소 어텐션 프레임워크입니다. 무작위 회전 이진 양자화를 통해 어텐션 가중치를 효율적으로 추정하며, 적응형 Top-p 검색과 하드웨어 인식 시스템을 통해 추론 속도를 높이고 메모리 I/O를 절감합니다.
Split Conformal Prediction의 통계적 효율성을 높이기 위해 훈련 및 교정 샘플의 최적 분할 비율을 결정하는 이론적 프레임워크를 제안합니다. 대칭 및 비대칭 체제에서의 분석적 특성을 도출하고 선형 회귀부터 신경망까지 다양한 모델에 적용 가능함을 입증했습니다.
Vision-Language Models(VLMs)를 활용한 이미지 분류에서 불확실성을 정량화하기 위한 국소적 컨포멀 예측(Localized Conformal Prediction) 연구를 소개합니다. 기존 코사인 유사도 방식의 한계를 극복하기 위해 비선형 변환을 제안하며, 이를 통해 평균 집합 크기를 효과적으로 감소시켰습니다.
생성형 머신러닝의 핵심인 확률 미분 방정식(SDE)과 포커-플랑크 방정식에 대한 이론적 입문을 다룹니다. 확산 모델, 스코어 매칭, 플로우 매칭을 변분적 관점에서 통합적으로 이해할 수 있는 수학적 프레임워크를 제공합니다.