Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
카메라 보정 없이도 다양한 시점에서 동작 가능한 새로운 VLA 모델인 CamVLA를 소개합니다. 카메라 기하학을 예측하여 로봇 동작을 생성함으로써, 별도의 외부 파라미터나 깊이 정보 없이 단일 RGB 이미지로도 안정적인 로봇 제어를 구현합니다.
Brownian Bridge Diffusion Models(BBDM)의 효율적인 스케줄 설계를 위해 Mixture-of-Gaussians 기반의 분석 프레임워크를 제안합니다. Wasserstein과 MSE 기준을 통해 지각적 품질과 재구성 충실도 사이의 트레이드오프를 분석하고 범용적인 스케줄 설계 방식을 제시합니다.
CoDA는 멀티태스크 LoRA 학습 시 도메인 간의 간섭을 줄이고 긍정적 전이를 극대화하는 공동 적응형 컨트롤러입니다. 라벨 없는 프로브를 통해 도메인별 역량과 학습 궤적을 추적하여 최적의 데이터 참여도와 손실 가중치를 결정합니다.
비디오 이상 탐지를 위해 운동학적 정보와 의미론적 정보를 결합한 월드 모델 파이프라인인 PULS를 제안합니다. 잠재적 명확성 가설을 통해 예측된 미래 표현이 현재 관찰보다 의미론적으로 더 잘 분리됨을 입증했습니다.
지식 증류 시 교사 모델의 절대적 특징이 아닌, 등가 클래스 내의 불변량을 학습해야 함을 이론적으로 규명합니다. Qwen2.5와 Llama-3.1을 통해 은닉 표현 매칭과 모델 능력 복구 사이의 관계를 기하학적으로 분석했습니다.
WeightCLIP은 신경망 가중치와 데이터셋 정보를 정렬하여 가중치 공간 표현을 학습하는 새로운 방법론을 제안합니다. 대조 학습을 통해 데이터셋 특성이 반영된 잠재 공간을 구축하며, 이를 통해 검색, 생성, 정제 등 다양한 다운스트림 태스크에서 뛰어난 성능을 입증했습니다.
UNet, ViT, DiT 아키텍처에서 기하학적 섭동이 은닉 상태에 미치는 영향을 연구한 논문입니다. 이면각 군을 활용한 변환을 통해 특징 안정성을 분석하며, 기하학적 일관성이 모델의 안정적인 개입을 위한 핵심 원칙임을 입증합니다.
NetinfoGC는 고전적 구조 지표를 활용하여 그래프 분류를 수행하는 새로운 프레임워크를 제안합니다. 엔드투엔드 학습 없이도 NUI(네트워크 사용 가능 정보)를 통해 그래프 표현의 품질을 평가하고 최적의 구조적 기술자를 선택할 수 있습니다.
양자 고속 가중치 프로그래머(QFWP)의 긴 시퀀스 처리 시 발생하는 발산 문제를 해결하기 위해 유계 메모리 게이트를 적용한 새로운 연구를 소개합니다. tanh 게이트를 통해 이전 상태의 변조을 안정화함으로써 양자 시퀀스 모델링의 강건성을 향상시켰습니다.
HNSW 그래프의 탐욕적 탐색이 가진 정확성 보장 문제를 해결하기 위해 'Certify-then-Rectify' 프레임워크를 제안합니다. 통계적 인증을 통해 검색 품질을 평가하고, 필요 시 기하학적 스패너와 극값 이론을 활용해 정확한 검색으로 전환하여 속도와 정확성을 동시에 확보합니다.
시계열 예측에서 Transformer의 이차 복잡도 문제를 해결하기 위해 제안된 셀프 게이팅 어텐션(SGA)에 관한 연구입니다. 공유 학습 행렬과 입력 의존적 잔차 성분을 활용하여 선형 시간 및 메모리 복잡도를 달성하면서도 높은 예측 성능을 유지합니다.
LLM 페르소나 평가 시 집계된 점수와 기하학적 구조 사이의 이중적 특성을 분석한 연구입니다. 페르소나의 특징은 프레임에 견고한 집계 데이터와 프레임에 의존적인 기하학적 구조로 나뉘며, 프레임 인지적 평가의 필요성을 강조합니다.
NASA의 방대한 지구과학 데이터셋을 효율적으로 탐색하기 위해 에이전트 기반 검색 시스템을 도입했습니다. LLM과 지식 그래프를 결합하여 자연어 질의에 최적화된 데이터셋을 찾아내며, 기존 검색 방식보다 뛰어난 성능을 입증했습니다.
LLM의 유해 답변 거부 행동이 다차원 서브스페이스에 존재한다는 점에 착안하여, RFM-AGOP 알고리즘을 통해 이를 빠르게 식별하는 연구를 소개합니다. 기존 방식보다 계산 비용이 낮아 Qwen 2.5 및 Qwen 3와 같은 모델에서도 수 초 내에 효율적인 추출이 가능합니다.
WattGPU는 프로파일링 데이터 없이 LLM의 추론 전력 소모량과 지연 시간을 예측하는 새로운 모델을 제안합니다. GPU 사양과 LLM 메타데이터만을 활용하여 미학습 하드웨어 및 모델 조합에 대해서도 높은 정확도로 성능을 예측할 수 있습니다.
Transformer의 학습 과정 중 내부 표현의 기하학적 진화를 분석하는 프레임워크 TGO-II를 제안합니다. ViT를 대상으로 CKA, SVCCA 등을 활용해 분석한 결과, 레이어별 표현 전문화와 고유 차원의 확장이 동시에 일어남을 확인했습니다.
DecompRL은 복잡한 문제를 독립적인 하위 함수로 분해하여 해결하는 새로운 강화학습 알고리즘입니다. 모듈형 코드 생성을 통해 탐색 공간을 효율적으로 관리하며, 기존 방식 대비 GPU 토큰 비용을 약 50배 절감하면서도 높은 문제 해결 능력을 보여줍니다.
객체 중심 LeJEPA는 장면 전체가 아닌 개별 객체 수준에서 표현을 정렬하여 데이터 효율성을 높인 자기지도 학습 방식입니다. SAM의 제안을 활용해 분할과 표현 학습 사이의 불안정성을 해결했으며, 다양한 다운스트림 태스크에서 기존 이미지 수준 LeJEPA보다 우수한 성능을 입증했습니다.
냉각 원자 실험 분석을 위해 머신러닝과 물리 정보를 결합한 Python 패키지 Q-GAIN을 소개합니다. 이 패키지는 분류, 객체 탐지, 물리 지표 계산을 위한 모듈형 워크플로우를 제공하여 연구의 신속한 배포를 지원합니다.
LIME은 1인칭 비디오를 통해 자연어 의도에 따라 카메라 움직임을 예측하는 모델입니다. 시각-언어 모델을 활용해 다음 관측을 위한 최적의 카메라 포즈를 생성하며, 능동적 지각(Active Perception) 능력을 보여줍니다.