Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
MLVC는 다양한 하드웨어 플랫폼에서 일관된 디코딩을 보장하는 하드웨어 강건형 신경망 비디오 코덱입니다. 하이퍼프라이어를 통해 장치 간 엔트로피 코딩 일관성을 확보하며, 실시간 속도와 높은 압축 효율을 동시에 달성했습니다.
교차 센서 확산 초해상도(Diffusion SR) 기술에서 합성 데이터와 실제 데이터 간의 도메인 간극이 모델 성능에 미치는 영향을 체계적으로 분석한 연구입니다. Sentinel-2와 PlanetScope 데이터를 활용해 다섯 가지 확산 아키텍처를 평가하고, 새로운 지표인 LPIPS-Sat을 제안합니다.
ToolPrivacyBench는 도구를 사용하는 LLM 에이전트의 프라이버시를 평가하기 위한 새로운 벤치마크입니다. 작업 완료 능력뿐만 아니라, 다중 도구 실행 과정에서 불필요한 정보가 노출되는 '목적 제한적 프라이버시 과다 공개'를 감사하는 데 중점을 둡니다.
신경 연산자(Neural Operators)의 예측을 해석하기 위한 새로운 기여도 산출 방법론인 OperatorSHAP를 제안합니다. 격자 크기에 구애받지 않는 격자 불가지론적(grid-agnostic) 특성을 가지며, 함수 공간에서의 이론적 프레임워크를 통해 효율적인 샤플리 값 추정을 가능하게 합니다.
OSOR은 그림자나 반사 같은 비국소적 효과를 고려하면서도 단 한 단계의 디노이징만으로 객체를 제거하는 효율적인 확산 인페인팅 모델입니다. 불완전한 마스크에 강건하며, 기존 다단계 모델보다 최대 30배 빠른 추론 속도를 제공합니다.
미세 표정 인식을 위해 움직임 흐름과 적응형 얼굴 연결성을 공동 모델링하는 STAG 프레임워크를 제안합니다. 그래프 주의 네트워크와 트랜스포머를 결합하여 공간적·시간적 특징을 상호 정교화함으로써 일반화 성능과 해석 가능성을 높였습니다.
멀티홉 지식 그래프 질의응답(KGQA)의 탐색 공간 급증과 노이즈 문제를 해결하기 위해 온톨로지 가이드 프레임워크인 OPI를 제안합니다. OPI는 관계 중심 온톨로지 그래프와 양방향 검색 메커니즘을 통해 효율적이고 정확한 증거 경로 추론을 수행합니다.
BiDeMem은 이미지 복원 과정에서 설명 가능성을 확보하기 위해 제안된 양방향 열화 메모리 메커니즘입니다. 복원 특징과 입력 통계를 활용해 메모리 슬롯을 검색하며, 복원 품질 유지와 동시에 열화 정보를 반증 가능한 설명 메커니즘으로 제공합니다.
비선형 편미분 방정식(PDEs) 해결을 위해 기존 FNO를 확장한 고차 푸리에 신경 연산자(HO-FNO)를 제안합니다. n-선형 모드 믹싱을 통해 모드 간 상호작용을 포착하며, 기존 모델 및 트랜스포머 대비 뛰어난 성능을 입증했습니다.
PhysisForcing은 로봇 조작을 위한 물리적으로 일관된 비디오 생성 프레임워크입니다. 픽셀 및 시맨틱 수준의 정렬 손실을 통해 비디오 생성 모델의 물리적 불안정성을 해결하고, 로봇 제어를 위한 월드 시뮬레이션 성능을 크게 향상시켰습니다.
희소하고 불균형한 데이터 환경에서 그래프 기반 사기 탐지 성능을 높이기 위한 ADC-GNN 프레임워크를 제안합니다. 확산 가이드 특징 증강과 대조 학습을 결합하여 오버스무딩과 표현 희석 문제를 해결합니다.
본 연구는 참조 이미지의 변화에도 안정적인 결과를 생성하는 강건한 인컨텍스트 세그멘테이션(ICS)을 위한 CG-ICS 프레임워크를 제안합니다. MLLM 기반의 개념 추론과 SAM3를 활용하여 고수준의 의미론적 개념을 추출함으로써 기존 방식의 한계를 극복했습니다.
LLM 탈옥 공격이 안전 특징을 완전히 제거하는 대신 특정 어텐션 헤드를 선택적으로 억제한다는 연구 결과입니다. 공격 시 억제되는 ACH와 견고함을 유지하는 SAH를 식별하여 탈옥의 기계론적 메커니즘을 규명했습니다.
LLM의 추론 능력을 높이는 RLVR 과정에서 발생하는 모델 간 호환성 문제를 해결하기 위해 탠덤 강화학습(TRL)을 제안합니다. 시니어 모델과 주니어 모델이 공동으로 추론을 생성하며 학습함으로써, 주니어 모델이 이해하기 쉬운 사고 사슬을 형성하고 분포 드리프트를 줄입니다.
CPAgents는 심장 영상 특징으로부터 해석 가능한 복합 표현형을 자동으로 생성하는 에이전트 기반 프레임워크입니다. 분석가, 제안자, 검증자 역할을 하는 세 가지 에이전트를 통해 기존 PheWAS의 한계를 극복하고 질환 판별력을 크게 향상시켰습니다.
LLawCo는 체화된 다중 에이전트가 파트너 및 환경과 정렬될 수 있도록 협력 법칙을 학습하는 새로운 프레임워크입니다. 에이전트가 과거 실패를 분석하여 상위 수준의 행동 법칙을 도출하고, 이를 사고 사슬(CoT)에 통합하여 협력 효율성을 높입니다.
HAT-4D는 단안 비디오에서 다중 객체의 4D 상호작용을 재구성하는 에이전트 기반 프레임워크입니다. VLM과 인간 참여형 피드백을 결합하여 폐쇄 및 깊이 모호성 문제를 해결하며, Embodied AI 학습을 위한 고품질 데이터를 생성합니다.
Flow Matching 모델의 훈련과 추론 간 불일치로 발생하는 노출 편향(Exposure Bias) 문제를 해결하기 위한 DEFAR 프레임워크를 제안합니다. 방향 및 주파수 적응형 피드백을 통해 모델이 스스로 편향을 교정하고 누락된 주파수 성분을 강화하도록 설계되었습니다.
이질적인 가치 제약 하에서 작동하는 완전 위임된 AI 협동조합을 위한 새로운 보상 할당 프레임워크를 제안합니다. 순회 학습(TL)을 활용하여 각 위임자의 가치 프로필에 부합하는 업데이트에만 신용을 부여하는 방식을 공식화합니다.
자율 코딩 에이전트가 공유 저장소에 미치는 생태계 수준의 리스크를 분석한 연구입니다. 개별 에이전트의 성능 평가를 넘어, 에이전트의 기여가 저장소 전체의 통합 마찰을 어떻게 증가시키는지 측정했습니다.