Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
리저버 컴퓨팅(RC)을 활용하여 수작업 특징 추출 과정 없이 원시 오디오 신호를 직접 처리하는 프레임워크를 제안합니다. 다양한 RC 아키텍처를 비교한 결과, 병렬 방식이 낮은 복잡도로도 우수한 성능을 보임을 입증했습니다.
오픈 데이터를 활용하여 도시 전력망의 토폴로지와 계층 구조를 식별하는 프레임워크를 제안합니다. 그래프 기반 알고리즘과 지리공간 머신러닝을 결합하여 고전압 송전망부터 라스트 마일 배전망까지의 구조를 재구성합니다.
DataClaw0는 방대한 멀티모달 스트림을 사용자 의도에 맞춰 능동적으로 정제하고 구조화하는 에이전트 기반 데이터 맞춤화 프레임워크를 제안합니다. 생성적 의미 합성 기술을 통해 고품질 데이터셋을 구축하고, SFT와 GRPO를 결합하여 복잡한 정제 작업에 최적화된 모델을 구현했습니다.
Transformer 기반 상호작용 인지 궤적 예측 모델이 노이즈 데이터에 얼마나 민감하게 반응하는지 분석한 연구입니다. 실제 환경의 인지 불확실성과 위치 추정 오류가 예측 정확도를 급격히 저하시킬 수 있음을 실험적으로 증명했습니다.
강화학습을 위한 시간적 행동 트리(TBT)를 보상-페트리-넷(RPN)으로 해석하는 새로운 방법론을 제안합니다. TBT는 기존 행동 트리에 시간적 제약 조건을 통합하여 복잡한 로봇 작업을 효과적으로 모델링하며, 이를 통해 RL의 샘플 효율성과 학습 제어력을 향상시킵니다.
이종 이벤트 스트림을 처리하기 위해 자기지도 사전 학습을 결합한 계층적 트랜스포머 구조인 SOHET를 제안합니다. Booking.com의 사기 탐지 데이터와 EBES 벤치마크를 통해 기존 모델 대비 우수한 성능과 빠른 수렴 속도를 입증했습니다.
Multi-Head Attention Transformer와 온라인 학습을 결합하여 차량 수리 시간을 예측하는 딥러닝 프레임워크를 제안합니다. 정형 데이터 처리에 최적화된 어텐션 메커니즘을 통해 변수 간 상호작용을 효과적으로 추출하며, 실시간 데이터 변화에 대응할 수 있는 점진적 업데이트 전략을 포함합니다.
의료 영상 재식별(MedReID) 시 발생하는 지름길 학습 문제를 해결하기 위해 해부학적 구조 기반의 Graph-of-Differences(GoD)를 제안합니다. 해부학 그래프를 통해 상동 구조 간의 차이를 정렬함으로써 모델의 결정 근거를 명확히 하고 일반화 성능을 높였습니다.
의료 영상 분할을 위한 새로운 비지도 도메인 적응(UDA) 프레임워크인 ADualVUOT를 제안합니다. 이중 VAE와 연속 정규화 흐름(CNF)을 결합하여 표현력을 높이고, GGW 거리를 활용한 불균형 최적 운송으로 도메인 간 불일치를 해결합니다.
적대적 예제에 대한 모델의 취약성을 해결하기 위한 적대적 학습의 비용 문제를 다룹니다. 선형 모델과 달리 2층 네트워크 및 Wide-ResNets와 같은 복잡한 아키텍처에서는 적대적 위험이 단순한 규제화된 위험으로 환원될 수 없음을 증명합니다.
VLA 모델의 효율적인 로봇 제어를 위해 오디오 코덱 기술을 응용한 신경 행동 코덱(NAC)을 제안합니다. RVQGAN 구조를 활용하여 로봇 행동 궤적을 고충실도로 압축하며, 기존 VQ 기반 토크나이저보다 낮은 재구성 오차와 높은 작업 성공률을 보여줍니다.
TRIZ 이론을 LLM 프롬프팅에 통합하여 창의적인 3D CAD 모델을 생성하는 새로운 Text-to-CAD 프레임워크를 제안합니다. 기술적 모순을 해결하는 발명 원리를 활용해 구조적 무결성을 유지하면서도 질량을 감소시킨 다양한 디자인 대안을 생성할 수 있습니다.
본 논문은 비지도 얽힘 해제 표현 학습을 위해 기능적 관점의 직교성 제약을 제안합니다. 통계적 독립성이나 인과적 가정 없이도 자코비안의 직교성을 통해 비선형 생성 모델의 식별성을 확보할 수 있음을 증명합니다.
VLA 모델의 실세계 배포를 위해 실패 데이터 없이도 효율적으로 작업 실패를 탐지하는 VLA-FAIL 프레임워크를 제안합니다. LLMD와 ACC라는 두 가지 새로운 탐지 기법을 결합하여 계산 비용을 최소화하면서도 높은 정확도로 실패를 조기에 감지합니다.
원자 구조와 자연어를 통합하여 재료를 이해하고 생성하는 원자 단위 언어 모델(ALMs)을 소개합니다. 단일 언어 백본을 통해 결정 구조를 예측하고 최적화하며, 새로운 벤치마크인 ALM Bench를 함께 제안합니다.
IoMT 보안을 위해 경량 디지털 트윈과 연합 강화학습(PPO)을 결합한 LDT-FRL 프레임워크를 제안합니다. 시계열 어텐션과 허니팟 기만 기술을 통해 데이터 프라이버시를 보호하면서도 높은 위협 탐지 정확도를 달성했습니다.
평균화된 Adam 옵티마이저가 Adam 벡터장의 끌개인 0으로 수렴하는 과정을 분석한 논문입니다. 수렴 속도를 정량화하는 중심 극한 정리를 제시하며, 수렴 차수가 $n^{-1/2}$임을 증명했습니다.
희소 텐서 완성을 위해 그룹 수준 대조 학습을 결합한 새로운 신경망 텐서 분해 방식인 DCGC를 제안합니다. 이 모델은 이중 어텐션 메커니즘을 통해 복잡한 상호작용을 포착하고 데이터 희소성 문제를 효과적으로 해결합니다.
관계형 딥러닝(RDL)의 일반화 문제를 해결하기 위해 행 인코딩과 그래프 메시지 패싱을 분리한 모듈형 접근 방식을 제안합니다. 트랜스포머 기반의 범용 행 인코더를 통해 스키마에 구애받지 않는 행 임베딩을 생성하며, RelBench 벤치마크에서 뛰어난 성능을 입증했습니다.
대규모 혼합 정수 계획법(MIP) 문제를 가속화하기 위해 백도어 변수 개념과 머신러닝을 결합한 BIPC 프레임워크를 제안합니다. 백도어 변수를 예측하여 최적화 문제를 축소함으로써, 해의 품질을 유지하면서도 계산 시간을 대폭 단축할 수 있습니다.