Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
데이터의 대칭성을 고려하여 레이블링 효율을 높이는 새로운 능동 학습 프레임워크 GRINCO를 제안합니다. 변환 군을 활용한 몫 공간에서 코어셋을 선택함으로써 중복된 데이터를 배제하고 정보 가치가 높은 샘플을 효과적으로 추출합니다.
CausalMix는 LLM 학습 시 데이터 혼합 최적화를 인과 추론 문제로 접근하여 해결하는 새로운 프레임워크입니다. 기존의 정적인 방식과 달리 데이터 풀의 변화에 유연하게 대응하며, CATE를 통해 최적의 혼합 비율을 동적으로 추론합니다.
SynLaD는 3D 약리단 프로파일과 합성 가능성을 동시에 고려하는 새로운 잠재 확산(Latent Diffusion) 프레임워크입니다. 3D 구조와 합성 경로를 함께 학습하여, 생물 활성 리간드 설계 시 높은 합성 가능성과 구조적 정확도를 동시에 확보합니다.
로봇이 테스트 시간 중 실패를 인지하고 이전의 실수를 바탕으로 행동을 수정하여 작업을 완수하는 FAR 프레임워크를 제안합니다. 실패 대조 선호도 적응과 경량 액션 섭동을 결합하여 로봇의 자율적 복구 능력과 데이터 효율성을 높였습니다.
ZO-Act는 입력 활성화 정보를 활용하여 저차원 부분 공간 내에서 Zeroth-Order 미세 조정을 수행하는 새로운 방법론을 제안합니다. 기존 ZO 방식의 높은 분산 문제를 해결하며, 양자화된 LLM 미세 조정에서도 뛰어난 성능과 효율성을 보여줍니다.
Muon 옵티마이저의 성공 원인을 암시적 잔차 연결(Implicit Residual Connection) 관점에서 해석한 연구입니다. 업데이트를 직교화함으로써 그래디언트 충실도는 일부 희생하되, 하위 계층을 위한 표현 보존 능력을 향상시킨다는 점을 밝힙니다.
생성 모델의 보상 정렬 과정에서 발생하는 국소적 탐색 문제를 해결하기 위해 IMPFM 프레임워크를 제안합니다. 다입자 흐름 지도를 통해 광범위한 탐색과 샘플 효율성을 동시에 확보하며, 보상 과최적화와 모드 붕괴를 방지합니다.
GAIA는 기하학적 토큰과 크로스 어텐션을 활용하여 임의의 도메인에서 편미분 방정식(PDEs)의 순방향 및 역문제를 해결하는 새로운 연산자 학습 모델입니다. 단일 아키텍처로 재학습 없이 다양한 경계값 문제(BVP)를 해결하며, 여러 벤치마크에서 최첨단(SOTA) 성능을 입증했습니다.
심전도(ECG) 분석을 위해 계층적 구조를 가진 경량 자기지도 학습 프레임워크인 ER-JEPA를 제안합니다. ViT 백본과 이중 JEPA 구조를 활용하여 다변량 시계열 데이터에서 효율적인 추상적 표현을 학습합니다.
QuasiMoTTo는 추론 연산 스케일링 시 발생하는 샘플 중복 문제를 해결하기 위해 Quasi-Monte Carlo(QMC) 기법을 도입한 새로운 샘플링 방식입니다. i.i.d. 샘플링 대신 상관관계가 있는 샘플을 생성하여 출력 공간의 커버리지를 높임으로써, 더 적은 연산으로도 높은 성능을 달성합니다.
3D Gaussian 프리미티브를 활용하여 구조적 및 비구조적 볼륨 데이터를 효율적으로 압축하는 새로운 명시적 모델을 제안합니다. 기존 INR 방식과 달리 메쉬 저장 없이도 기하학적 구조를 인코딩할 수 있어 압축률과 재구성 품질을 크게 향상시켰습니다.
검증 가능한 보상(RLVR)의 한계를 극복하기 위해 인간의 시연을 결합한 적대적 생성자-판별자 프레임워크를 제안합니다. 이 방식은 모델의 정확도를 유지하면서도 스타일, 구조 등 주관적이고 검증하기 어려운 속성을 개선합니다.
조합 최적화(CO) 문제의 검증 효율성을 높이기 위해 비지도 학습 기반의 신경 인증 가격 책정(NCP) 프레임워크를 제안합니다. 신경망이 인증 수준의 쌍대 가격을 예측하고 구조적 복구 레이어를 통해 실행 가능한 한계값을 구성하는 방식입니다.
양자 머신러닝(QML)과 고전적 머신러닝 모델의 성능을 지도 학습 및 강화 학습 관점에서 비교 분석한 연구입니다. 실험 결과 QML은 예측 성능이나 훈련 시간 면에서 고전적 모델을 능가하지 못했으나, 노이즈 필터링과 거짓 양성 제어 측면에서 잠재력을 확인했습니다.
비선형 및 신경망 동역학의 실시간 강건 최적 제어를 위해 GPU 병렬 선형화 오차 경계(LEB)를 개발한 연구입니다. 해석적 동역학 및 NN 검증 기술을 결합하여 정밀한 오차 경계를 도출하고, GPU를 통해 실시간 성능과 형식적 보장을 동시에 달성했습니다.
TiRex-2는 xLSTM 기반의 시계열 파운데이션 모델로, 단변량 모델을 다변량 및 스트리밍 환경으로 확장했습니다. 재귀적 설계를 통해 스트리밍 상황에서도 일정한 추론 비용을 유지하며, 변수 간 의존성과 미래 공변량을 효과적으로 통합합니다.
LLM이 특정 엔티티나 관점에 대해 가지는 은밀한 선호 편향을 탐지하는 새로운 방법론인 Distill to Detect(D2D)를 소개합니다. KV-cache prefix adapter를 활용해 숨겨진 로짓 분포의 변화를 증폭시켜, 텍스트 검사로는 발견하기 어려운 모델의 편향성을 효과적으로 드러냅니다.
Theoria는 LLM의 비형식적 추론 과정을 유형화된 상태 전이 시퀀스로 재작성하여 검증하는 새로운 아키텍처를 제안합니다. 각 전이 단계에 명시적인 정당화를 부여함으로써 숨겨진 전제나 오류를 독립적으로 감사할 수 있게 합니다. 벤치마크 결과, 기존의 전체론적 LLM 판정기보다 높은 정밀도와 오염된 증명 탐지 능력을 보여주었습니다.
Transformers가 다음 토큰 예측과 상태 저장을 동일한 계산 스트림에서 수행한다는 점에 주목하여, 이 두 역할을 분리하는 '상태 예측 분리 가설'을 제안합니다. 실험 결과, 두 기능을 분리한 모델이 데이터 및 계산 효율성을 높이고 검증 손실과 다운스트림 태스크 성능을 개선함을 입증했습니다.
차선책 시연으로부터 자연어 피드백을 활용해 정책을 학습하는 '언어 비판(Language-Critique)' 프레임워크를 제안합니다. 기존의 스칼라 신호 대신 구조화된 언어 라벨을 사용하여 행동 복제 및 확산 정책의 성능을 높였습니다.