Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
기계의 진정한 창의성을 정의하기 위한 새로운 프레임워크를 제안하는 논문입니다. 단순한 출력물의 참신함을 넘어, 디자인익스(Designics) 이론을 바탕으로 환경과의 상호작용 및 재귀적 개입을 통한 구조적 변형을 창의성의 핵심으로 정의합니다.
의료 영상 AI의 환각 현상을 분류, 탐지 및 완화하기 위한 교차 모달리티 분석 프레임워크를 제안합니다. 의료 특화 모델과 범용 모델의 환각 특성을 비교하고, FDA 규제 지침에 부합하는 효과적인 완화 전략을 연구합니다.
사용자의 잘못된 가설에 동조하는 LLM의 '사용자 주도적 아첨' 문제를 해결하기 위한 새로운 에이전트 방법론을 제안합니다. 증거를 우선적으로 수집하여 가설을 검증하는 'LLM-as-an-Investigator' 방식을 통해 기술적 문제 진단의 정확도를 높입니다.
NVFP4 저정밀도 양자화 사용 시 발생하는 추론 정확도 저하와 지연 시간 문제를 해결하기 위한 ReSET 기술을 제안합니다. 단계별 불확실성을 기반으로 디코딩 온도를 조절하고 최적화된 CUDA 커널을 설계하여 정확도와 속도를 동시에 개선했습니다.
기존 GUI 및 API 기반 에이전트의 한계를 극복하기 위해 COM(Component Object Model)을 활용한 새로운 패러다임인 COM-as-Action을 제안합니다. CAD 소프트웨어 조작을 위한 벤치마크 ComCADBench와 자기 수정 에이전트 ComActor를 통해 전문 소프트웨어 제어의 새로운 가능성을 제시합니다.
EPIG는 심리학적 감정 모델을 활용하여 텍스트-투-이미지 확산 모델의 감정 표현력을 높이는 새로운 프롬프팅 방법론을 제안합니다. 별도의 모델 재학습 없이도 프롬프트를 풍부하게 만들어, 생성된 이미지의 감정적 일관성과 각성(arousal) 제어 능력을 크게 향상시킵니다.
해양 사고 근본 원인 분석(RCA)을 자동화하기 위해 다중 필드 하이브리드 RAG 프레임워크를 제안합니다. KMST 보고서 데이터를 구조화된 지식 베이스로 변환하고 RRF를 통해 검색 성능을 극대화하여 일관된 보고서 작성을 지원합니다.
본 논문은 조음 장애 화자의 음성 인식을 위한 개인화된 연합 학습(FL) 방안을 연구합니다. 기존 FL의 이질성 문제를 해결하기 위해 파라미터 및 임베딩 기반 두 가지 집계 전략을 제안했습니다. 실험 결과, 제안 방법들은 정규화 FedAvg 대비 WER 감소를 보이며 우수한 성능을 입증했습니다.
본 연구는 복잡한 주장의 자동 사실 검증을 위해 에이전트 기반 강화학습 프레임워크인 ProFact를 제안합니다. ProFact는 주장 분해, 증거 탐색, 답변 생성 등 다단계 워크플로우 전체를 통합적으로 최적화하는 정책을 학습합니다. 특히 과정 전반에 걸쳐 단계 수준의 보상을 제공하여 검증 성능과 효율성을 모두 향상시킵니다.
AI 시스템의 윤리적 추론에 대한 적대적 조작 강건성을 평가하기 위한 새로운 프레임워크인 ERTS를 제안합니다. 22차원 윤리적 결과 공간과 의미론적 교란 함수를 활용하여 Gemini 2.0 Flash 및 Llama 3.2 등 주요 모델의 윤리적 취약성을 정밀하게 측정합니다.
시각-언어 모델(VLM)의 구성적 이해 능력을 향상시키기 위한 새로운 프레임워크 MACCO를 제안합니다. 한 모달리티의 구성 개념을 마스킹하고 다른 모달리티의 문맥으로 재구성하는 방식을 통해 객체 관계 및 속성 결합 능력을 개선합니다.
HYDRA-X는 단일 Vision Transformer 내에서 이미지와 비디오 토큰화를 통합하는 최초의 네이티브 통합 멀티모달 모델(UMM)입니다. 시공간 재구성 능력과 의미론적 인식을 잠재 공간에 임베딩하여 이미지 및 비디오 이해와 생성 성능을 극대화했습니다.
에이전트형 AI 도입이 Java 오픈 소스 저장소의 소프트웨어 아키텍처 품질에 미치는 인과적 영향을 분석한 연구입니다. 분석 결과, AI 사용으로 코드 라인 수는 증가했으나 아키텍처 스멜 밀도 감소는 실제 개선이 아닌 분모 효과에 의한 착시임이 밝혀졌습니다.
비디오 스트림을 활용해 연안 파랑 주기를 추정하는 물리 가이드 기반의 딥 시공간 학습 프레임워크를 제안합니다. 물리 정보 기반 정규화와 Sim-to-Real 전이 학습을 통해 예측 정확도와 물리적 일관성을 동시에 확보했습니다.
해양 이상 탐지를 위해 희소한 컨텍스트 분포에서도 안정적인 성능을 내는 RGFiLM 모듈을 제안합니다. 데이터 기반 희소성 점수를 활용해 컨텍스트 변조 강도를 조절함으로써 오경보를 줄이고 탐지 성능을 높였습니다.
본 논문은 LLM의 추론 및 요약 능력을 결합한 새로운 RLVR 프레임워크인 ReSum을 제안합니다. ReSum은 모델이 자체 요약을 통해 추론 궤적을 압축하고 조직화하도록 유도하여, 기존 방법의 컨텍스트 비효율성 문제를 해결합니다. 실험 결과, ReSum은 성능 향상과 함께 롤아웃 길이 감소라는 이점을 입증했습니다.
본 논문은 다중 모드 CT-PET 이미지 합성을 위해 이중 영역 등변환 생성적 적대 신경망(DDE-GAN)을 제안합니다. DDE-GAN은 공간 및 주파수 영역 양쪽에서 공동 학습하여 해부학적/스펙트럼 정보를 포착하고, 회전 등변환성을 통합해 구조적 충실도를 높입니다. 이를 통해 CT-PET 이미지 합성의 정확도와 견고성이 향상됨을 입증했습니다.
LLM의 창의성과 심볼릭 시스템의 일관성을 결합한 뉴로-심볼릭 접근 방식인 IVIE를 제안합니다. 4단계 파이프라인을 통해 플레이 가능한 인터랙티브 픽션 세계를 점진적으로 생성하며, 서사적 일관성과 몰입감을 동시에 확보합니다.
고정된 연산량 제한 하에서 소규모 Llama 스타일 언어 모델의 학습 역학을 정량적으로 분석한 연구입니다. 학습 과정 중 발생하는 검증 손실의 비단조적 퇴보와 스파이크 현상을 확인하며, 최종 성능뿐만 아니라 학습 궤적을 통한 평가의 중요성을 강조합니다.
SmartFont는 적은 샘플(Few-shot) 폰트 생성을 위한 새로운 확산 기반 프레임워크입니다. 이 모델은 글로벌 콘텐츠-스타일 생성과 약하게 지도되는 지역 교정 전문가를 결합하여, 전역적 구조와 세밀한 지역 스타일 충실도를 동시에 확보합니다. 이를 통해 명시적인 구성 요소 조건부 추론 없이도 고품질의 폰트 생성이 가능함을 입증했습니다.