Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
구별 불가능한 객체를 활용하여 확률적 그래픽 모델의 추론 속도를 높이는 리프팅된 인과 추론(LCI) 기술을 소개합니다. PCFGs를 통해 인과 지식을 통합하고, 기존 명제적 추론 대비 획기적인 속도 향상을 달성했습니다.
MLVC는 다양한 하드웨어 플랫폼에서 일관된 디코딩을 보장하는 하드웨어 강건형 신경망 비디오 코덱입니다. 하이퍼프라이어를 통해 장치 간 엔트로피 코딩 일관성을 확보하며, 실시간 속도와 높은 압축 효율을 동시에 달성했습니다.
교차 센서 확산 초해상도(Diffusion SR) 기술에서 합성 데이터와 실제 데이터 간의 도메인 간극이 모델 성능에 미치는 영향을 체계적으로 분석한 연구입니다. Sentinel-2와 PlanetScope 데이터를 활용해 다섯 가지 확산 아키텍처를 평가하고, 새로운 지표인 LPIPS-Sat을 제안합니다.
ToolPrivacyBench는 도구를 사용하는 LLM 에이전트의 프라이버시를 평가하기 위한 새로운 벤치마크입니다. 작업 완료 능력뿐만 아니라, 다중 도구 실행 과정에서 불필요한 정보가 노출되는 '목적 제한적 프라이버시 과다 공개'를 감사하는 데 중점을 둡니다.
신경 연산자(Neural Operators)의 예측을 해석하기 위한 새로운 기여도 산출 방법론인 OperatorSHAP를 제안합니다. 격자 크기에 구애받지 않는 격자 불가지론적(grid-agnostic) 특성을 가지며, 함수 공간에서의 이론적 프레임워크를 통해 효율적인 샤플리 값 추정을 가능하게 합니다.
JD.com이 대규모 이커머스 SKU 관리를 위해 LLM/VLM 기반의 산업 규모 플랫폼인 Oxygen AIIC를 공개했습니다. 이 플랫폼은 온톨로지 엔지니어링과 S2D 아키텍처를 통해 수백억 개의 아이템 지식을 효율적으로 생성하고 서비스합니다.
OSOR은 그림자나 반사 같은 비국소적 효과를 고려하면서도 단 한 단계의 디노이징만으로 객체를 제거하는 효율적인 확산 인페인팅 모델입니다. 불완전한 마스크에 강건하며, 기존 다단계 모델보다 최대 30배 빠른 추론 속도를 제공합니다.
미세 표정 인식을 위해 움직임 흐름과 적응형 얼굴 연결성을 공동 모델링하는 STAG 프레임워크를 제안합니다. 그래프 주의 네트워크와 트랜스포머를 결합하여 공간적·시간적 특징을 상호 정교화함으로써 일반화 성능과 해석 가능성을 높였습니다.
멀티홉 지식 그래프 질의응답(KGQA)의 탐색 공간 급증과 노이즈 문제를 해결하기 위해 온톨로지 가이드 프레임워크인 OPI를 제안합니다. OPI는 관계 중심 온톨로지 그래프와 양방향 검색 메커니즘을 통해 효율적이고 정확한 증거 경로 추론을 수행합니다.
BiDeMem은 이미지 복원 과정에서 설명 가능성을 확보하기 위해 제안된 양방향 열화 메모리 메커니즘입니다. 복원 특징과 입력 통계를 활용해 메모리 슬롯을 검색하며, 복원 품질 유지와 동시에 열화 정보를 반증 가능한 설명 메커니즘으로 제공합니다.
비선형 편미분 방정식(PDEs) 해결을 위해 기존 FNO를 확장한 고차 푸리에 신경 연산자(HO-FNO)를 제안합니다. n-선형 모드 믹싱을 통해 모드 간 상호작용을 포착하며, 기존 모델 및 트랜스포머 대비 뛰어난 성능을 입증했습니다.
PhysisForcing은 로봇 조작을 위한 물리적으로 일관된 비디오 생성 프레임워크입니다. 픽셀 및 시맨틱 수준의 정렬 손실을 통해 비디오 생성 모델의 물리적 불안정성을 해결하고, 로봇 제어를 위한 월드 시뮬레이션 성능을 크게 향상시켰습니다.
희소하고 불균형한 데이터 환경에서 그래프 기반 사기 탐지 성능을 높이기 위한 ADC-GNN 프레임워크를 제안합니다. 확산 가이드 특징 증강과 대조 학습을 결합하여 오버스무딩과 표현 희석 문제를 해결합니다.
본 연구는 참조 이미지의 변화에도 안정적인 결과를 생성하는 강건한 인컨텍스트 세그멘테이션(ICS)을 위한 CG-ICS 프레임워크를 제안합니다. MLLM 기반의 개념 추론과 SAM3를 활용하여 고수준의 의미론적 개념을 추출함으로써 기존 방식의 한계를 극복했습니다.
LLM 탈옥 공격이 안전 특징을 완전히 제거하는 대신 특정 어텐션 헤드를 선택적으로 억제한다는 연구 결과입니다. 공격 시 억제되는 ACH와 견고함을 유지하는 SAH를 식별하여 탈옥의 기계론적 메커니즘을 규명했습니다.
LLM의 추론 능력을 높이는 RLVR 과정에서 발생하는 모델 간 호환성 문제를 해결하기 위해 탠덤 강화학습(TRL)을 제안합니다. 시니어 모델과 주니어 모델이 공동으로 추론을 생성하며 학습함으로써, 주니어 모델이 이해하기 쉬운 사고 사슬을 형성하고 분포 드리프트를 줄입니다.
CPAgents는 심장 영상 특징으로부터 해석 가능한 복합 표현형을 자동으로 생성하는 에이전트 기반 프레임워크입니다. 분석가, 제안자, 검증자 역할을 하는 세 가지 에이전트를 통해 기존 PheWAS의 한계를 극복하고 질환 판별력을 크게 향상시켰습니다.
LLawCo는 체화된 다중 에이전트가 파트너 및 환경과 정렬될 수 있도록 협력 법칙을 학습하는 새로운 프레임워크입니다. 에이전트가 과거 실패를 분석하여 상위 수준의 행동 법칙을 도출하고, 이를 사고 사슬(CoT)에 통합하여 협력 효율성을 높입니다.
32년간의 스리랑카 이주 및 송금 데이터를 분석하여 거시경제 변수와의 상관관계를 연구했습니다. 머신러닝 모델을 통해 송금액을 예측하고, 환율과 유가가 송금 유입에 미치는 비대칭적 영향을 규명했습니다.
HAT-4D는 단안 비디오에서 다중 객체의 4D 상호작용을 재구성하는 에이전트 기반 프레임워크입니다. VLM과 인간 참여형 피드백을 결합하여 폐쇄 및 깊이 모호성 문제를 해결하며, Embodied AI 학습을 위한 고품질 데이터를 생성합니다.