Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM의 추론 과정을 잠재적 끌개(latent attractors)로 저장된 고차원 연상 메모리 검색 과정으로 재정의하는 연구입니다. Gibbs 가중 에너지 최소화 메커니즘을 통해 추론 경로를 샘플링하고 최적의 솔루션으로 이완시키는 물리 기반 접근법을 제안합니다.
고차 구조의 위상 정보를 단일 정점 수준의 연산자로 응축하는 '붕괴된 유효 연산자'를 제안합니다. 이 방식은 장거리 상호작용을 인코딩하며, 스펙트럼 클러스터링과 신경망의 위치 인코딩 성능을 개선합니다.
Multi-Armed Bandits 문제에서 행동 간의 유사성 구조를 활용하는 온라인 학습 연구를 다룹니다. 단일 지점 피드백의 한계를 증명하고, 세미 밴딧 및 멀티 포인트 피드백 환경에서 유사성을 효과적으로 활용하는 알고리즘 세트를 제안합니다.
GRINQH는 LLM의 디코딩 단계 병목 현상을 해결하기 위해 양자화와 희소화를 통합한 새로운 사후 훈련 양자화 프레임워크입니다. 활성화 크기를 기반으로 가중치 채널에 서로 다른 정밀도를 동적으로 할당하여 생성 품질과 추론 속도 사이의 최적의 균형을 제공합니다.
전력 부하 예측의 정확도와 해석 가능성을 동시에 확보하기 위해 Kolmogorov-Arnold 네트워크(KAN)와 특징 격리형 시간적 어텐션 메커니즘을 결합한 LoadKAN 프레임워크를 제안합니다. 기존 블랙박스 모델과 달리 데이터의 비선형 관계를 세밀하게 분석할 수 있는 것이 특징입니다.
비지도 비디오 객체 추적 시 외형과 포즈가 얽혀 발생하는 정체성 유지 문제를 해결하기 위한 STAITUS 프레임워크를 제안합니다. 슬롯을 외형과 기하학적 포즈로 분리하고 적응형 게이팅 메커니즘을 도입하여 객체 추적의 안정성을 높였습니다.
MolFormer와 같은 화학 언어 모델(cLMs)이 분자 표현을 구축하는 과정을 희소 오토인코더(SAE)를 통해 기계론적으로 분석한 연구입니다. 초기 층은 분자 문법을 파싱하고 후기 층은 약리학적 특징을 인코딩함을 밝혀냈습니다.
SkyJEPA는 쿼드로터의 실시간 제어를 위해 잠재 공간에서 역학을 모델링하는 JEPA 스타일의 월드 모델을 제안합니다. 물리 기반 프로버를 통해 장기 예측 오차를 줄이고, 시뮬레이션에서 학습한 모델을 실제 환경에 즉시 적용하는 Zero-Shot Sim-to-Real 성능을 입증했습니다.
시계열 예측에서 예측하기 어려운 샘플을 모델이 스스로 거부할 수 있는 선택적 예측 프레임워크를 제안합니다. 메타러닝을 통해 도메인에 구애받지 않는 구조적 특성을 학습함으로써, 다양한 시계열 데이터에서도 예측 정확도를 효과적으로 향상시킵니다.
기존 DTW의 이산적 매칭 한계를 극복하기 위해 미분동형 변환을 활용한 새로운 시계열 분류 프레임워크 DiffTW를 제안합니다. 선형 수송 방정식과 ODE를 결합하여 실수 함수 간의 연속적인 매핑을 학습하며, 다양한 데이터셋에서 DTW보다 우수한 성능을 입증했습니다.
위치 인코더가 지리적 좌표를 임베딩할 때 공간적 효과를 얼마나 잘 포착하는지 GeoShapley 벤치마크를 통해 분석했습니다. TorchSpatial의 11개 인코더를 대상으로 다양한 규모에서 계수 복구 성능을 평가한 연구입니다.
아선형 구조의 심층 신경망(Sublinearly Structured DNNs)이 합성 함수를 학습할 때 달성하는 특징 학습 일관성을 이론적으로 증명합니다. 과잉 매개변수화 영역에서도 일관성이 유지되며, AlexNet과 ResNet 등 주요 CNN 모델이 이 구조를 따름을 확인했습니다.
이산적 텍스트 최적화(Discrete Text Optimization)를 통합하고 표준화하기 위한 최초의 오픈 소스 프레임워크인 TROPT를 제안합니다. 다양한 최적화 도구와 손실 함수를 단일 인터페이스로 제공하여 LLM 탈옥 및 모델 해석 가능성 연구의 장벽을 낮춥니다.
데이터 수집 단계부터 편향을 줄이기 위해 베이지안 실험 설계(BED)를 활용하는 FairBED 프레임워크를 제안합니다. 민감한 속성에 대한 정보 이득은 최소화하고 타겟 수량에 대한 정보 이득은 최대화하여 공정성과 정확도 사이의 트레이드오프를 개선합니다.
Concordia는 LLM 에이전트의 장시간 실행 중 발생하는 GPU 장애에 대비하여 결함 허용(Fault-Tolerance)을 제공하는 새로운 런타임입니다. JIT 컴파일된 지속성 커널을 통해 KV 캐시와 같은 상태를 효율적으로 체크포인팅하고 복구합니다.
희소한 차량 카운트 데이터를 활용해 시뮬레이션 없이 교통 흐름 패턴을 추정하는 새로운 최적화 방법을 제안합니다. 가중 최소제곱 최적화를 통해 센서 커버리지를 고려한 경로를 도출하며, 브뤼셀 도로 네트워크 실험에서 높은 효율성과 정확도를 입증했습니다.
SQLConductor는 복잡한 Text-to-SQL 작업을 위해 단계별 오케스트레이션을 수행하는 새로운 학습 프레임워크를 제안합니다. MCTS와 Search-to-Policy 학습을 통해 중간 결과와 피드백에 따라 유연하게 다음 액션을 선택하며, 기존 방식보다 뛰어난 실행 정확도와 일반화 성능을 보여줍니다.
VeriEvol은 멀티모달 수학적 추론을 위한 검증 가능한 데이터 구축 프레임워크입니다. 프롬프트 난이도를 높이는 진화 모듈과 정답 신뢰도를 검증하는 HTV-Agent를 통해 고품질의 데이터를 대량으로 생성합니다.
Transformer 모델 학습 시 발생하는 에너지 소비를 예측하기 위한 새로운 프레임워크를 제안합니다. Roofline 모델에서 영감을 얻어 하드웨어 효율성과 병렬성 효과를 반영한 스케일링 법칙을 도출했습니다.
고온 초전도(HTS) 자석의 전압 분포를 예측하기 위해 그래프 신경망(GNN)을 활용한 SuperCond-GNN 대리 모델을 제안합니다. 회로 토폴로지와 재료 특성을 학습하여 기존 시뮬레이션보다 빠르고 확장 가능한 추론을 제공합니다.