Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 연구는 클라이언트의 하드웨어 제약과 데이터 이질성을 해결하기 위해 신경망 구조 탐색(NAS)과 지식 증류(Knowledge Distillation)를 결합한 FedKDNAS 프레임워크를 제안합니다. 각 클라이언트는 자원 제약에 맞춰 최적의 경량 모델을 자율적으로 선택하며, 서버는 공유된 예측값을 집계하여 안정적인 학습 타겟을 생성합니다. 실험 결과, FedKDNAS는 기존 방식 대비 정확도를 높이고 통신 오버헤드와 CPU 사용량을 획기적으로 줄이는 성과를 보였습니다.
본 연구는 표현 유사성 행렬(RSM) 분석 시 네트워크 입력의 대칭성이 결과에 미칠 수 있는 혼란 요인을 규명합니다. 자극의 대칭성으로 인해 기능적으로 동일한 표현들이 서로 다른 RSM을 생성할 수 있으며, 이는 SGD나 에너지 정규화 과정에서 발생하는 희소하고 표류하는 코드 문제와 결합되어 분석의 어려움을 초래합니다.
Delta-Rule Linear Transformer 모델의 핵심 연산인 삼각 행렬 역행렬 계산의 효율성과 수치적 안정성을 개선하는 연구를 다룹니다. 직접적 및 반복적 알고리즘을 체계적으로 분석하여 하드웨어 효율성을 극대화하는 방법론을 제시합니다. 실험 결과, NPU 환경에서 SGLang 대비 최대 4.3배의 속도 향상을 달성하며 모델 정확도를 유지함을 입증했습니다.
하위 수준 문제가 비모수적으로 학습될 때 발생하는 1차 편향 문제를 해결하기 위해 효율적 영향 함수 기반의 준모수적 편향 제거 이론을 제안합니다. 이 이론을 통해 교차 적합 직교 하이퍼기울기 추정기를 개발하였으며, 합성 벤치마크 실험을 통해 기존 플러그인 방식 및 정규화된 커널 방식보다 우수한 성능을 입증했습니다.
신경 연산자(Neural Operator)를 이용한 편미분 방정식(PDE) 풀이 시 발생하는 높은 데이터 요구량 문제를 해결하기 위해 물리 정보 기반의 능동 학습(Active Learning) 알고리즘을 제안합니다. PDE 잔차를 활용하여 정보 가치가 높은 샘플을 선택하는 '물리 기반 획득(Physics-based acquisition)' 방식을 통해 데이터 효율성을 극대화하고 모델의 물리적 이해도를 높였습니다.
본 연구는 고속 스위칭 전력 전자 기기 환경에서 발생하는 부분 방전(PD)을 효과적으로 분류하기 위해 진폭, 폭, 면적을 활용한 AWA(Amplitude-Width-Area) 패턴 표현법을 제안합니다. 시간 영역의 PD 펄스를 시각적 패턴으로 변환하여 6가지의 단일 및 혼합 PD 소스를 구분하며, CNN 모델을 통해 높은 분류 정확도를 입증했습니다.
자율 주행 엔드 투 엔드 학습을 위해 실제 데이터와 합성 데이터를 효율적으로 혼합하는 폐쇄 루프 데이터 엔진인 AutoScale을 제안합니다. AutoScale은 장면 표현, 데이터 혼합 최적화, 검색 과정을 통합하여 모델 성능을 극대화하도록 데이터 구성을 동적으로 조정합니다. 실험 결과, 기존 방식보다 적은 합성 데이터만으로도 NavSim 벤치마크에서 더 뛰어난 성능을 입증했습니다.
DiSI는 확률적 보간법(Stochastic Interpolants)을 생성과 회귀 구성 요소로 분리하여 이미지 복원의 효율성과 충실도를 동시에 해결하는 통합 프레임워크입니다. 이를 통해 단일 모델 내에서 왜곡-지각 트레이드오프를 조절하며, 고품질의 적은 단계 추론(few-step inference)을 가능하게 합니다.
본 논문은 PDE(편미분 방정식) 유도 확률 측도를 대상으로 하는 1단계 Wasserstein 가이드 생성 모델의 정칙성과 일반화 특성을 분석하는 이론적 프레임워크를 제안합니다. 선형 타원형, 포물선형 방정식 및 Fokker-Planck 방정식을 다루며, 최적 운송 맵의 횔더 연속성을 증명하여 1단계 생성 모델의 근사 이론적 정당성을 확보했습니다. 또한 DeepParticle 사례를 통해 초과 위험 경계와 타겟 시프트에 대한 강건성을 입증했습니다.
본 논문은 6G 네트워크가 단순한 통신 수단을 넘어 AI가 네이티브하게 통합된 자율적이고 회복 탄력적인 인프라로 진화해야 한다는 BlueSky 비전을 제시합니다. 기존의 산재된 모델 방식에서 벗어나, 파운데이션 모델과 멀티 에이전트 시스템을 활용하여 네트워크 관리를 통합적인 멀티모달 및 멀티태스크 최적화 문제로 해결하는 로드맵을 제안합니다.
본 연구는 생성 모델이 훈련 데이터를 단순히 암기하는지, 아니면 데이터 분포를 학습하여 일반화하는지를 분석합니다. 선형 생성 모델을 통해 데이터 샘플 수가 입력 차원에 비례할 때 수렴이 발생함을 밝혀냈으며, 데이터 분포의 일치(수렴)와 주요 잠재 요인의 복구는 서로 별개의 과정임을 입증했습니다.
본 연구는 12편의 LLM 에이전트 및 정적 벤치마크 논문을 대상으로 평가 과정의 정보 공개 수준을 분석한 파일럿 감사 보고서입니다. 연구 결과, 에이전트 벤치마크 논문들은 정적 벤치마크에 비해 추론 비용이나 평가 환경(harness specification)에 대한 정보 공개가 현저히 낮음을 확인했습니다. 연구진은 투명한 연구 생태계를 위해 감사 체계와 점수 코드북을 JSON, Markdown, CSV 형식으로 공개했습니다.
6G 초고밀도 네트워크의 셀 간 간섭 문제를 해결하기 위해 서버리스 연합 학습 기반의 자원 할당 프레임워크인 FedCritic을 제안합니다. FedCritic은 중앙 코디네이터 없이 가십 기반 파라미터 평균화를 통해 크리틱을 연합함으로써, 부반파 스케줄링과 전력 할당을 효율적으로 수행합니다. 시뮬레이션 결과, 기존 방식 대비 낮은 오버헤드로 네트워크 전체의 전송률과 공정성을 크게 개선함을 입증했습니다.
HiRes는 화학 반응 조건 추천을 위해 검색 증강(Retrieval-Augmented) 방식을 도입한 새로운 모델입니다. 그래프 인코더와 k-NN 검색 레이어를 결합하여 높은 예측 정확도를 달성함과 동시에, 화학자가 검토할 수 있는 구체적인 선례(precedents)를 함께 제공하여 모델의 해석 가능성을 높였습니다.
LLM 미세 조정 시 데이터 효율성을 높이기 위해 모델의 현재 선호도를 반영하여 데이터에 가중치를 부여하는 PRISM 방법론을 제안합니다. PRISM은 목표 동작과 현재 모델 간의 관련성을 고려하여 데이터 예산을 최적의 샘플에 집중시킴으로써 미세 조정 및 안전 지향적 SFT의 성능을 개선합니다.
높은 희소성을 가진 비전 네트워크에서 발생하는 가지치기 후 정확도 저하 문제를 해결하기 위해, 채널별로 신호를 복구하는 '적응형 신호 소생(ASR)' 기법을 제안합니다. ASR은 레이어 단위의 보정 대신 채널 단위의 분산 매칭과 데이터 기반 수축 규칙을 사용하여, 재학습 없이도 손상된 채널의 신호를 효과적으로 복구합니다. 실험 결과, ResNet-50 모델의 90% 희소성 환경에서 기존 방식보다 월등히 높은 정확도 회복 성능을 입증했습니다.
가우시안 주변 분포를 가진 다중 클래스 선형 분류기의 비가정적 학습(agnostic learning) 문제를 해결하기 위한 새로운 연구를 소개합니다. 기존 알고리즘이 가졌던 지수적 복잡도 문제를 극복하여, 차원에 독립적인 오차 보장을 제공하는 완전 다항 시간 강건 학습기를 설계했습니다. 특히 다중 클래스 퍼셉트론의 한계를 규명하고, 효율적인 쌍별 부적절 학습(pairwise improper-learning) 프레임워크를 제안합니다.
roto 2.0은 파편화된 촉각 기반 강화학습(RL) 연구를 표준화하기 위해 설계된 GPU 병렬화 벤치마크입니다. 고유 수용 감각과 촉각 센싱만을 사용하는 '맹목적(blind)' 조작에 집중하며, 기존 SOTA 대비 압도적인 성능 향상을 입증했습니다. 오픈 소스 환경과 베이스라인을 제공하여 연구자들이 알고리즘 자체에 집중할 수 있도록 돕습니다.
전통적인 GNN의 메시지 전달 방식이 확률 분포 형태의 노드 특징을 처리할 때 발생하는 구조적 한계를 극복하기 위한 새로운 프레임워크인 가우시안 층 신경망(GSNNs)을 제안합니다. 셀룰러 층(cellular sheaves) 이론을 기반으로 가우시안 분포의 평균과 공분산이 가진 기하학적·대수적 구조를 보존하는 새로운 라플라시안 연산자를 도출하였습니다.
본 연구는 기존 포아송 분포 기반 지진 예측 모델의 한계를 극복하기 위해, 공간적 이질성을 반영한 EarthquakeNet 아키텍처를 제안합니다. 이 모델은 신경망을 통해 셀별 과분산 파라미터를 내생적으로 추정함으로써 지진 클러스터링을 효과적으로 식별하고 극단적 사건에 대한 예측 정확도를 높였습니다.