Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
글로벌 사우스의 혼잡한 도시 환경을 분석하기 위한 새로운 세계 모델 아키텍처인 FactorJEPA를 제안합니다. 레이아웃, 엔티티, 상호작용을 분리된 하위 공간으로 구성하여 복잡한 환경에서의 예측 정확도와 강건성을 높였습니다.
정형 데이터의 스트리밍 환경에서 발생하는 테스트 시간 적응(TTA) 문제를 해결하기 위한 새로운 방법론을 제안합니다. 배치 크기가 1인 싱글톤 환경에서 로짓 공간을 이동시키는 경량 방식인 PLOC를 통해 모델 성능 저하를 방지합니다.
Muon 옵티마이저를 위한 1비트 부호 압축 방식인 SignMuon의 수렴성과 한계를 분석합니다. 특정 방식이 선형 함수에서 발산할 수 있음을 증명하고, 오차 피드백(EF)의 적용 위치에 따른 성능 차이를 실험적으로 보여줍니다.
희소한 관측 데이터로부터 편미분 방정식(PDE)을 정확하게 발견하기 위한 '동결 후 선택(freeze-then-select)' 방법론을 제안합니다. 구조화된 필드 어댑터와 안정성 검증된 약한 선택법(SVWS)을 결합하여 미분 항 선택의 정확도를 높였습니다.
차분 프라이버시(Differential Privacy) 환경에서 다중 모드 분포의 밀도 모드를 복구하는 새로운 방법론인 DP-GRAMS를 제안합니다. 고차 커널과 노이즈가 포함된 상승법을 통해 프라이버시를 보장하면서도 높은 정확도로 모드를 추정하며, 회귀 및 클러스터링으로의 확장 가능성을 입증했습니다.
이 논문은 이질적인 태스크 학습 시 발생하는 간섭과 파괴적 망각 문제를 해결하기 위해 자동화된 태스크 시퀀싱 프레임워크를 제안합니다. 고정된 매개변수 예산 내에서 최적화 경로를 조직하여 QLoRA 기반의 다중 정책 PEFT를 구현함으로써 모델의 전이 성능을 극대화합니다.
지속 학습(CL) 시스템에서 발생하는 OOD 망각(OOD Forgetting) 현상을 분석하고, 이를 해결하기 위한 TOOD 기법을 제안합니다. 에너지 기반 및 특징 기반 탐지기에서 나타나는 성능 저하 원인을 규명하고, 사후 처리 방식으로 점수를 재보정하여 OOD 탐지 성능을 크게 향상시켰습니다.
QASP는 쿼리별 재현율(Recall)을 예측하여 검색 정책을 동적으로 조정하는 쿼리 적응형 벡터 검색 기술입니다. 단 한 번의 회귀를 통해 목표 재현율에 최적화된 검색 깊이를 결정하며, 데이터 액세스를 80% 절감하면서도 높은 성능을 유지합니다.
다면체에 정점을 추가할 때 피라미드 너비(pyramidal width)가 증가할 수 없다는 기존의 추측을 반박하는 연구입니다. 6개의 정수 점을 이용한 구체적인 반례를 제시하여 정점 삽입이 피라미드 너비를 증가시킴을 증명했습니다.
TerraNova는 물리적 지구 시스템과 인간 사회의 데이터를 결합하여 모델링하는 새로운 파운데이션 모델입니다. 격자형 지구 데이터와 국가 지표를 교차 모달 트랜스포머로 융합하여 시공간적 상태를 통합적으로 표현합니다.
확산 환경(Diffusion Environment) 내 다중 팔 밴딧 문제에 대한 정책 경사 업데이트를 연구합니다. 확률적 정책의 로짓 매개변수화를 통해 최적의 팔로의 수렴성을 증명하고, 비점근적 후회 상한을 도출했습니다.
ReToken은 긴 시각적 문맥을 처리할 때 발생하는 성능 저하와 메모리 문제를 해결하기 위해 제안된 단일 학습 가능 임베딩 방식입니다. 시각적 KV 캐시에서 쿼리와 관련된 희소한 토큰 세트를 검색하여 효율성을 높이며, 다양한 벤치마크에서 성능 향상을 입증했습니다.
온폴리시 자기 증류(OPSD)의 불안정성을 해결하기 위해 정책 최적화 관점에서 접근한 $\beta$-OPSD를 제안합니다. KL 페널티 가중치 $\beta$를 조절하여 참조 정책과 교사 모델 사이의 균형을 맞추며, RL 대신 폐형식 해를 이용한 효율적인 증류 방식을 사용합니다.
ScaFE는 LLM의 임상 지식을 활용해 데이터 효율적인 흉터 분류를 수행하는 새로운 프레임워크입니다. 이미지를 직접 전송하는 대신 로컬에서 실행 가능한 특징 프로그램을 합성하여 데이터 보안을 유지하면서도 높은 분류 정확도를 달성했습니다.
APO는 정답 좌표 없이도 원자 시스템의 3D 구조를 예측할 수 있는 비지도 원자 정책 최적화 프레임워크입니다. 구조적 보상과 물리적 보상을 결합한 이중 보상 메커니즘을 통해 데이터 부족 문제를 해결하고 SOTA 성능을 달성했습니다.
금속 자성체의 복잡한 스핀 역학을 효율적으로 시뮬레이션하기 위해 그래프 신경망(GNN) 기반의 자기 힘의 장(magnetic force-field) 프레임워크를 제안합니다. 이 모델은 전자 계산의 병목 현상을 해결하며, 비평형 자성 시스템의 스핀 토크를 정확하게 재현합니다.
불규칙한 시계열 데이터를 가진 종단적 인과 추론을 위해 이중 강건 기능 표현 학습(DR-FRL) 방법론을 제안합니다. 기능 및 시간 인코더를 통해 불규칙한 이력을 타겟 상태로 변환하여 추정의 안정성과 정확도를 높입니다.
Vision Transformers(ViTs)의 효율적인 배포를 위해 구성 요소별 민감도를 고려한 혼합 정밀도 사후 훈련 양자화(PTQ) 프레임워크인 MixFrag를 제안합니다. KL 발산을 통해 양자화 취약성을 측정하고 MCKP를 통해 최적의 비트 할당을 수행합니다.
Change2Task는 저장소 이력을 기반으로 풀 리퀘스트를 실행 가능한 코딩 에이전트 작업으로 변환하는 시스템입니다. 이를 통해 버그 수정, 기능 추가 등 다양한 작업 데이터를 자동으로 생성하여 에이전트의 훈련과 평가를 지원합니다.
Self-Refine, Reflexion 등 모델의 자기 비판 및 재작성 기법들이 동일한 토큰 비용 대비 반복 샘플링(Majority Voting)보다 성능이 낮음을 입증한 연구입니다. 실험 결과, 많은 자기 검사 방식이 비용 효율성 측면에서 오히려 부정적인 영향을 미치는 것으로 나타났습니다.