Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
HYDRA-X는 단일 Vision Transformer 내에서 이미지와 비디오 토큰화를 통합하는 최초의 네이티브 통합 멀티모달 모델(UMM)입니다. 시공간 재구성 능력과 의미론적 인식을 잠재 공간에 임베딩하여 이미지 및 비디오 이해와 생성 성능을 극대화했습니다.
에이전트형 AI 도입이 Java 오픈 소스 저장소의 소프트웨어 아키텍처 품질에 미치는 인과적 영향을 분석한 연구입니다. 분석 결과, AI 사용으로 코드 라인 수는 증가했으나 아키텍처 스멜 밀도 감소는 실제 개선이 아닌 분모 효과에 의한 착시임이 밝혀졌습니다.
비디오 스트림을 활용해 연안 파랑 주기를 추정하는 물리 가이드 기반의 딥 시공간 학습 프레임워크를 제안합니다. 물리 정보 기반 정규화와 Sim-to-Real 전이 학습을 통해 예측 정확도와 물리적 일관성을 동시에 확보했습니다.
해양 이상 탐지를 위해 희소한 컨텍스트 분포에서도 안정적인 성능을 내는 RGFiLM 모듈을 제안합니다. 데이터 기반 희소성 점수를 활용해 컨텍스트 변조 강도를 조절함으로써 오경보를 줄이고 탐지 성능을 높였습니다.
본 논문은 LLM의 추론 및 요약 능력을 결합한 새로운 RLVR 프레임워크인 ReSum을 제안합니다. ReSum은 모델이 자체 요약을 통해 추론 궤적을 압축하고 조직화하도록 유도하여, 기존 방법의 컨텍스트 비효율성 문제를 해결합니다. 실험 결과, ReSum은 성능 향상과 함께 롤아웃 길이 감소라는 이점을 입증했습니다.
본 논문은 다중 모드 CT-PET 이미지 합성을 위해 이중 영역 등변환 생성적 적대 신경망(DDE-GAN)을 제안합니다. DDE-GAN은 공간 및 주파수 영역 양쪽에서 공동 학습하여 해부학적/스펙트럼 정보를 포착하고, 회전 등변환성을 통합해 구조적 충실도를 높입니다. 이를 통해 CT-PET 이미지 합성의 정확도와 견고성이 향상됨을 입증했습니다.
LLM의 창의성과 심볼릭 시스템의 일관성을 결합한 뉴로-심볼릭 접근 방식인 IVIE를 제안합니다. 4단계 파이프라인을 통해 플레이 가능한 인터랙티브 픽션 세계를 점진적으로 생성하며, 서사적 일관성과 몰입감을 동시에 확보합니다.
고정된 연산량 제한 하에서 소규모 Llama 스타일 언어 모델의 학습 역학을 정량적으로 분석한 연구입니다. 학습 과정 중 발생하는 검증 손실의 비단조적 퇴보와 스파이크 현상을 확인하며, 최종 성능뿐만 아니라 학습 궤적을 통한 평가의 중요성을 강조합니다.
SmartFont는 적은 샘플(Few-shot) 폰트 생성을 위한 새로운 확산 기반 프레임워크입니다. 이 모델은 글로벌 콘텐츠-스타일 생성과 약하게 지도되는 지역 교정 전문가를 결합하여, 전역적 구조와 세밀한 지역 스타일 충실도를 동시에 확보합니다. 이를 통해 명시적인 구성 요소 조건부 추론 없이도 고품질의 폰트 생성이 가능함을 입증했습니다.
본 논문은 웹 에이전트가 실제 환경에 배치되면서 발생하는 프롬프트 주입 공격의 위험을 다룹니다. 기존의 기술 중심적 벤치마크는 피해 분포를 간과하며, 본 연구에서는 영향을 받는 이해관계자(사용자, 판매자 등)와 목표를 중심으로 피해를 체계적으로 분류하는 '이해관계자 중심적' 벤치마크인 StakeBench/SBC를 제안합니다. 이 벤치마크는 에이전트의 취약점을 질적으로 구별하여 평가할 수 있게 합니다.
본 논문은 LLM 기반 콘텐츠 조정 시스템이 소수 공동체의 문화적/종교적 관점을 무시하는 '문화적으로 무감각한 언어'를 인식할 수 있는지에 대한 한계를 탐구합니다. 방글라데시의 힌두교와 차크마 공동체를 사례로, 지역사회와 협력하여 제작한 코퍼스를 RAG에 통합한 Mod-Guide 도구를 제안했습니다.
본 논문은 태양광 발전과 가전제품 사용 패턴의 불일치 문제를 해결하기 위해 스케줄링 최적화 방안을 제시합니다. 반복 국소 탐색(ILS) 및 시뮬레이티드 어닐링(SA) 같은 메타휴리스틱 접근법을 사용하여, 사용자 불편 최소화와 재생 에너지 활용 극대화를 동시에 달성하는 가전제품 시작 시간을 결정합니다.
초분자 화학 분야의 숙주-게스트 시스템 설계를 지원하기 위해 LLM의 화학 추론 능력을 평가하는 최초의 벤치마크인 SupraBench를 제안합니다. 바인딩 친화도 예측 등 4가지 핵심 작업과 도메인 적응을 위한 SupraPMC 코퍼스를 함께 공개했습니다.
CRAFTIIF는 다변량 시계열의 네 가지 이상 유형(점형, 분포형, 시간적, 집합적)을 모두 탐지할 수 있는 새로운 비지도 학습 프레임워크입니다. 웨이블릿 특징 추출과 구조화된 Isolation Forest를 결합하여 높은 탐지 성능과 해석 가능성을 동시에 제공합니다.
유전체 프로필을 베이지안 사전 확률로 활용하여 개인 맞춤형 건강 AI의 콜드 스타트 문제를 해결하는 프레임워크를 제안합니다. 유전적 앵커를 통해 환경적 변수를 분리하고, 데이터 축적에 따라 유전체 중심에서 경험적 기준선 중심으로 추론을 동적으로 전환합니다.
성인-신생아 MR 재구성의 일반화 성능을 높이기 위해 대비 정보 기반 데이터 증강과 도메인 적대적 학습을 결합한 연구입니다. 실험 결과, Mixed-DAT 방식이 도메인 변화에 대한 강건성을 높여 신생아 MR 재구성에서 우수한 성능을 보였습니다.
과학적 발견을 위한 AI의 3계층 프레임워크를 제안하는 논문입니다. 기존의 검색과 실행을 넘어, 구조적 통찰을 통해 모델을 형성하고 진화시키는 '2계층 질적 추론'의 중요성을 강조합니다.
불규칙한 시계열 데이터에서 미래 관측 가능성과 값을 동시에 예측하는 통합 프레임워크 Timeflies를 제안합니다. 기존 모델의 오라클 가정 한계를 극복하기 위해 관측 역학과 상태 진화를 공동 모델링합니다.
에이전트 평가의 파편화 문제를 해결하기 위해 에이전트 중심의 평가 프레임워크인 AAA와 그 구현체 AgentBeats를 제안합니다. 표준화된 프로토콜을 통해 평가 로직을 에이전트 구현과 분리하여 재현성과 상호 운용성을 높였습니다.
검색 증강 LLM이 오염된 웹 콘텐츠를 소비할 때 발생하는 가짜 제품 추천 위험을 평가하는 벤치마크 FORGE를 소개합니다. 실험 결과, 단 하나의 오염된 페이지만으로도 모델의 속임수율이 최대 27%까지 상승하며 모든 모델이 취약함을 확인했습니다.