Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
HamEvo는 단일 단계의 자기 일관적 업데이트를 학습하여 Kohn-Sham 해밀토니안을 예측하는 신경 연산자입니다. 기존 DFT 대비 최대 242배 빠른 속도로 분자 오비탈과 에너지 준위를 정확하게 예측하며, 퓨샷 파인튜닝을 통해 대규모 분자로의 확장성을 입증했습니다.
시각-언어 모델(VLM)을 밀집 좌표 목록 출력 방식으로 미세 조정할 때 발생하는 구조적 출력 변화와 반복 문제를 연구합니다. Gemma 4 12B와 Qwen3-VL-8B를 통해 LoRA 어댑터 용량이 모델의 생성 및 제어 표면에 미치는 영향을 분석했습니다.
양자 컴퓨팅 위협에 대응하여 IoMT 환경의 보안을 강화하기 위한 에지 네이티브 연합 학습(FL) 프레임워크를 제안합니다. Kubernetes 기반의 확장 가능한 구조를 통해 양자 내성 암호(PQC)를 통합하고 Raspberry Pi 테스트베드에서 그 효용성을 검증했습니다.
LLM 기반 에이전트 가드레일의 추론 능력을 악용하여 무한 루프를 유발하는 서비스 거부(DoS) 공격 방식을 연구했습니다. 공격자는 정교한 페이로드를 통해 토큰 및 지연 시간을 대폭 증폭시켜 시스템을 마비시킬 수 있습니다.
확산 모델을 활용하여 지역 기후 모델(RCM)을 에뮬레이션하는 ParamDiffusion 프레임워크를 제안합니다. 연구 결과, 확산 기반 방식은 기후학적 강수 통계와 극한 상황을 재현하는 데 뛰어난 성능을 보였으나, 가장 극단적인 이벤트를 완벽히 포착하기에는 개선의 여지가 있음을 확인했습니다.
지연된 증거가 존재하는 환경에서 로봇의 시각-운동 모방 성능을 높이기 위한 TRACE 프레임워크를 제안합니다. 경로 시그니처를 활용해 제한된 메모리에 핵심 증거를 저장하고 검색함으로써, 시각적으로 모호한 상황에서도 정확한 행동 결정을 내릴 수 있도록 돕습니다.
현대 이미지 분류기의 Global Average Pooling(GAP) 구조가 본질적으로 Multiple-Instance Learning(MIL)과 유사하게 작동함을 분석합니다. 이를 통해 이미지 레벨의 예측이 틀리더라도 공간적 클래스 증거를 추출하고 사후 진단할 수 있는 방법을 제시합니다.
에이전트의 메모리 능력을 평가하기 위해 스트리밍 관찰 데이터로부터 미래의 작업을 보조하는 능력을 측정하는 StreamMemBench를 제안합니다. 기존 벤치마크가 놓쳤던 스트리밍 데이터 기반의 연속적인 작업 수행 능력을 4가지 지표로 진단합니다.
VISTA는 GUI Grounding 성능 향상을 위해 뷰 일관성 기반의 자기 검증 학습 프레임워크를 제안합니다. 동일한 GUI 인스턴스의 다양한 뷰를 활용하여 GRPO 학습의 효율성을 높이고, 자기 검증 앵커를 통해 좌표 생성의 안정성을 확보합니다.
이종 철도 시스템의 복잡한 경로 최적화와 장애 대응을 위한 시계열 계획(Temporal planning) 프레임워크를 제안합니다. PDDL 2.1을 활용해 궤도 호환성 및 확률적 장애를 모델링하며, 자동화된 운영 계획 생성을 통해 안전성을 높입니다.
과학 실험 최적화를 위해 LLM의 창의성과 기존 최적화 도구의 안정성을 결합한 CARE 시스템을 제안합니다. 증거 기반의 감사 가능한 검토 과정을 통해 LLM이 생성한 정책을 검증하며, 벤치마크 테스트에서 기존 방식보다 뛰어난 성능 향상을 입증했습니다.
대규모 오디오-언어 모델(LALMs)의 추론 능력을 향상시키기 위해 중복을 제거하고 사고 사슬(CoT)을 포함한 새로운 데이터셋 AudioDER를 제안합니다. 음향 유사도 기반의 중복 제거와 Qwen3-30B를 활용한 데이터 구축을 통해 모델의 성능을 효과적으로 개선합니다.
웨어러블 및 스마트폰 데이터를 활용한 다중 시계열 행동 예측을 위해 6개의 딥러닝 아키텍처와 2개의 파운데이션 모델을 비교 연구했습니다. PatchTST가 우수한 성능을 보였으며, TimesFM과 같은 파운데이션 모델의 제로샷 성능과 개인화 미세 조정의 효과를 검증했습니다.
생성적 역학 모델에서 OOD 전이를 신뢰성 있게 탐지하기 위한 새로운 정규화 방법을 제안합니다. 제어 입력 변화에 대한 국소적 민감도를 촉진하여, 실제 예측 오차가 큼에도 OOD 신호가 억제되는 문제를 해결합니다.
베토벤의 월광 소나타 악장 구조와 머신러닝 아키텍처 간의 구조적 대응 관계를 계산적으로 분석한 연구입니다. 음악적 특징을 엔트로피, 임베딩, 메모리 아키텍처 관점에서 해석하고, 역 소니피케이션을 통해 정보의 카이랄성을 정량화했습니다.
환자 하위 그룹 간의 차이를 반영하기 위해 전문가 혼합(MoE) 프레임워크를 활용한 새로운 생존 예측 모델 AdaCSM을 제안합니다. 이 모델은 라우팅 기반 전문가 메커니즘을 통해 환자를 전문화된 예측기에 동적으로 할당하여 예측 성능과 해석 가능성을 높였습니다.
자기 개선형 VLM 학습 시 검증기의 품질이 작업별로 상이하여 모델 성능이 오히려 퇴보할 수 있음을 분석한 연구입니다. 검증기의 루브릭 정확도가 낮을 경우 DPO 학습이 오답을 강화하는 현상을 기계론적으로 설명합니다.
MiniMax는 초장기 컨텍스트 처리를 위한 새로운 블록 단위 희소 어텐션 기술인 MSA를 발표했습니다. GQA를 기반으로 설계된 MSA는 연산량을 획기적으로 줄이면서도 높은 성능과 GPU 실행 효율성을 유지합니다.
TextHOI-3D는 텍스트를 기반으로 손과 물체의 3D 상호작용 메쉬를 생성하는 새로운 프레임워크를 제안합니다. VQ 토큰 공간과 CLIP 기반 자기회귀 모델을 활용하여 다중 뷰 시각 토큰을 생성하고, 이를 통해 기하학적으로 정교한 3D 메쉬를 복원합니다.
음성 재구성 모델에 의한 워터마크 억제를 방지하기 위해 특징 정렬(Feature-Aligned) 방식을 제안합니다. 워터마크를 음성 특징 분포와 정렬하여 인지 불가능성을 유지하면서도 재구성 왜곡에 대한 강건성을 높였습니다.