Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 연구는 전문가의 수동 모델 큐레이션 없이 LLM 가이드 트리 검색을 통해 질병 예측 소프트웨어를 자율적으로 생성, 평가 및 최적화하는 시스템을 제안합니다. 이 시스템은 인플루엔자, COVID-19, RSV 등 다양한 병원체에 대해 CDC의 표준 앙상블과 대등하거나 이를 능가하는 예측 성능을 보여주었습니다. 특히 데이터가 부족한 상황에서도 효과적이며, 역학 이론을 투명한 코드로 자동 변환하여 모델링의 병목 현상을 해결합니다.
GraphFlow는 에이전트 기반 AI 자동화 워크플로우의 신뢰성 문제를 해결하기 위해 설계된 시각적 워크플로우 아키텍처입니다. 이 시스템은 워크플로우 다이어그램을 실행 가능한 명세로 취급하여, 컴파일 시점에 계약(contracts)에 대한 증명 검사를 수행하고 재사용 가능한 자동화 결과물을 생성합니다. 런타임에는 이벤트 로그와 강제된 경계 설정을 통해 내구성 있는 실행과 엄격한 감사가 가능하며, 이를 통해 미션 크리티컬 프로세스의 신뢰성을 크게 향상시킵니다.
본 논문은 단일 위성 이미지로부터 거리 수준(street-level)의 포괄적이고 정확한 3D 장면을 생성하는 Sat3DGen 방법론을 제안합니다. 기존 모델들이 기하학적 충실도와 의미론적 다양성 사이에서 트레이드오프를 보이는 문제를 해결하기 위해, Sat3DGen은 새로운 기하학적 제약 조건과 투영 시점 학습 전략을 통합하여 '기하학 우선(geometry-first)' 패러다임을 강화했습니다. 이 방법론은 3D 정확도와 사진 실사성 모두에서 기존 최고 성능 모델 대비 비약적인 발전을 보여주었으며, 다양한 다운스트림 애플리케이션에 활용 가능함을 입증했습니다.
현미경 이미지를 이용한 생물학적 객체 분석은 중요하지만, 수동 작업은 비효율적이며 기존 딥러닝 기반 자동화 방식들은 다양한 실험 환경 설정에 적응하기 어려워 실질적인 활용성이 떨어지는 문제가 있었습니다. 이러한 문제를 해결하기 위해, 본 논문에서는 다양한 현미경 이미지 분석 설정 전반에서 세그멘테이션, 추적, 계수 등 주요 작업을 안정적으로 수행할 수 있는 최초의 즉시 사용 가능한 프레임워크인 MicroscopyMatching을 제안합니다. 이 프레임워크는 모든 분석 작업을 통합된 매칭 문제로 재정의하고, 사전 학습된 잠재 확산 모델(Latent Diffusion Models)의 강력한 매칭 능력을 활용하여 문제를 효과적으로 해결합니다.
MHSA(Mitigating Hallucinations via Steered Attention)는 대규모 시각-언어 모델(LVLMs)이 겪는 환각 문제를 완화하기 위해 제안된 경량 프레임워크입니다. 이 프레임워크는 LVLM의 교차 모달 어텐션 패턴을 학습하여 교정함으로써, 기존의 어텐션을 수정 없이 효과적으로 대체합니다. MHSA는 판별적 및 생성적 환각 모두를 완화하며, 모델의 신뢰성을 높이는 새로운 접근 방식을 제시합니다.
Viverra는 Text-to-Code 과정에서 발생하는 코드 정확성 보증의 한계를 해결하기 위해 개발된 시스템입니다. 이 시스템은 자연어 작업 설명이 주어졌을 때, LLM이 안전성 및 정확성 속성을 나타내는 후보 어설션(candidate assertions)과 함께 C 프로그램을 합성하도록 유도합니다. 이후 Viverra는 경계 모델 검사기 포트폴리오를 사용하여 이러한 어설션을 구성적이고 최선의 노력 방식으로 검증하며, 이는 코드 이해와 신뢰도를 높이는 데 기여합니다.
본 연구는 조영 증강 CT 이미지를 활용하여 난소암 환자의 선행 화학요법 반응을 예측하는 비침습적 딥러닝 프레임워크를 제안합니다. 이 모델은 자동 도출된 병변 마스크와 사전 학습된 이미지 인코더, 어텐션 기반 모듈을 결합하여 CT 슬라이스 표현을 볼륨 임베딩으로 통합합니다. 연구 결과, 개발된 아키텍처는 테스트 코호트에서 유의미한 예측 성능(ROC-AUC 0.73)을 보여주었으며, 이는 영상 기반 난소암 치료 전략 수립에 기여할 잠재력을 시사합니다.
본 연구는 자연계 시스템에서 복잡한 구조가 생성되는 '자기 조직화(self-organisation)' 과정에 초점을 맞추고, 이 과정이 초기 조건으로 오프로딩되는 정보의 역할을 탐구합니다. 이를 위해 자기 조직화 규칙과 사전 패턴을 공동 학습하는 새로운 모델을 제안하며, 신경 세포 자동자(NCA)와 SIREN을 결합하여 구현했습니다. 연구 결과, 사전 패턴과 자기 조직화 과정을 함께 학습시키는 것이 강건성, 인코딩 용량, 대칭성 깨짐 측면에서 개선 효과를 가져오며, 초기 조건이 단순히 목표 근사를 넘어 발달 역학에 편향(bias)을 주는 비자명한 관계가 있음을 보여줍니다.
본 논문은 장거리 멀티샷 비디오 생성의 핵심 과제인 엔티티 일관성 문제를 해결하기 위해 EntityBench라는 새로운 벤치마크를 제안합니다. 이 벤치마크는 실제 서사 미디어에서 유도된 140개 에피소드(2,491개 샷)로 구성되어 있으며, 다양한 재출현 간격과 명시적인 엔티티 스케줄을 제공합니다. 또한, 샷 내부 품질, 프롬프트 준수 정렬, 샷 간 일관성을 분리 평가하는 세 가지 기둥의 평가 스위트와 충실도 게이트를 포함하여 평가의 정확도를 높였습니다. 제안된 메모리 증강 생성 시스템인 EntityMem은 엔티티별 시각적 참조를 메모리 뱅크에 저장함으로써, 재출현 거리가 멀어지더라도 높은 캐릭터 일관성을 유지하는 성능을 입증했습니다.
본 논문은 생성형 비디오 모델의 핵심 과제인 물리적 타당성 및 기하학적 일관성을 정량적으로 평가하기 위한 새로운 프레임워크 PDI-Bench를 제안합니다. 기존의 주관적이거나 진단 능력이 부족했던 평가 방식과 달리, PDI는 세그멘테이션 및 포인트 트래킹을 통해 객체 중심 관측치를 얻고 이를 3D 월드 공간 좌표로 변환하여 기하학적 실패를 측정합니다. 이 프레임워크는 스케일-깊이 정렬, 3D 움직임 일관성, 3D 구조적 강성 세 가지 차원의 투영 기하학 잔차를 계산하며, 이를 통해 기존 지표로는 포착하기 어려웠던 물리적으로 근거 있는 실패 모드를 진단할 수 있습니다.
SemaTune은 제한된 언어 모델 가이드를 활용하여 정상 상태(steady-state) OS 튜닝을 수행하는 호스트 측 프레임워크입니다. 기존의 블랙박스 방식 컨트롤러들이 놓치던 정책 구조와 애플리케이션 메트릭 문제를 해결하기 위해, SemaTune은 노브 스키마, 텔레메트리, 현재 설정 및 과거 이력을 압축된 결정 컨텍스트로 변환합니다. 평가 결과, SemaTune은 기본 설정 대비 안정 단계 성능을 72.5% 향상시켰으며, 가장 강력한 비-LLM 베이스라인 대비 153.3% 향상시키는 뛰어난 성능을 입증했습니다.
본 논문은 대규모 언어 모델(LLMs)의 추론 시간 스케일링 과정에서 발생하는 샘플링 예산과 추론 품질 간의 트레이드오프 문제를 해결하기 위해 '이중 차원 일관성(Dual-Dimensional Consistency, DDC)'이라는 통합 프레임워크를 제안합니다. DDC는 신뢰도 가중 베이지안 프로토콜을 추세 인식 계층적 가지치기 메커니즘과 결합하여, 계산 자원을 고품질의 추론 경로에 집중시키고 합의 과정을 가속화하는 동시에 환각을 효과적으로 필터링합니다. 평가 결과, 이 방법은 기존 LLMs 대비 정확도를 유지하거나 능가하면서도 토큰 소비량을 10배 이상 절감할 수 있음을 입증했습니다.
EverAnimate는 시각적 품질과 캐릭터 정체성을 유지하며 장시간 애니메이션 비디오를 생성하기 위한 효율적인 사후 학습 방법입니다. 기존의 청크 기반 생성 방식은 누적된 드리프트(품질 저하 및 의미론적 일관성 상실) 문제를 겪기 쉬운데, EverAnimate는 지속적인 잠재 컨텍스트 메모리를 통해 이 흐름을 복원합니다. 이를 위해 '지속적 잠재 전파'와 '복원 흐름 매칭'이라는 두 가지 메커니즘을 결합하여 장시간 애니메이션의 일관성과 품질을 획기적으로 개선했습니다.
본 논문은 웹 에이전트가 프롬프트 인젝션 공격에 취약하다는 문제를 다루며, 이를 해결하기 위해 WARD(Web Agent Robust Defense against Prompt Injection)라는 실용적인 가드 모델을 제안합니다. WARD는 대규모 데이터셋인 WARD-Base와 전용 공격 데이터셋 WARD-PIG를 기반으로 구축되었으며, 적응형 적대적 공격 훈련 프레임워크 A3T를 통해 반복적으로 강화됩니다. 실험 결과, WARD는 높은 재현율과 낮은 오탐률을 유지하면서도 다양한 분포 변화 및 적대적 공격에 대해 강건함을 입증했습니다.
본 논문은 Spiking Neural Networks (SNNs) 분야에서 급증하는 다양한 학습 알고리즘들을 체계적으로 분류하는 포괄적인 분류 체계를 제시한다. 이 조사(Survey)는 Surrogate-gradient backpropagation, 로컬/3요소 학습 규칙 등 여러 접근 방식을 분석하며, 각 클래스를 계산 원리 및 로컬리티 특성 측면에서 심층적으로 다룬다. 또한, 재현 가능한 연구를 지원하기 위해 snnTorch 기반의 오픈 소스 벤치마킹 프레임워크인 NeuroTrain을 공개하여 SNN 학습 연구에 기여한다.
본 연구는 생성형 AI가 활용된 뉴스에서 AI 사용 사실을 알리는 공개 방식이 독자의 주의력과 인지 부하에 미치는 영향을 시선 추적(Eye-tracking)을 통해 분석했습니다. 연구 결과, 짧은 한 줄 형태의 공개 방식은 오히려 독자의 시각적 정밀 조사를 유발하여 주의력 비용을 높이는 반면, 상세한 공개 방식은 추가적인 부담을 주지 않는 것으로 나타났습니다. 이를 바탕으로 독자의 시선 패턴에 따라 투명도 수준을 조절하는 적응형 인터페이스 설계의 필요성을 제안합니다.
OpenDeepThink는 LLM 추론 성능 향상을 위해 쌍체 Bradley-Terry 비교를 활용하는 개체군 기반 테스트 시간 연산 프레임워크입니다. 이 방법은 매 세대마다 무작위 후보 쌍을 판정하고, 이를 집계하여 전역 순위를 생성합니다. 상위 4분의 3의 후보는 자연어 비판을 통해 변이되고 하위 4분의 1은 폐기되는 과정을 거칩니다. OpenDeepThink를 적용한 결과, Gemini 3.1 Pro 모델의 Codeforces Elo 점수가 유효하게 +405점 상승하는 성과를 보였습니다. 이 프레임워크는 재학습 없이 다양한 모델에 전이 가능하며, 객관적으로 검증 가능한 도메인에서 특히 효과적임을 입증했습니다.
본 글은 대규모 언어 모델(LLMs) 기반의 멀티 에이전트 시스템이 복잡한 작업 처리 시 병목 현상을 겪는 문제를 지적하며, 이를 해결하기 위한 분산 아키텍처인 APWA(Agent-Parallel Workload Architecture)를 제안합니다. APWA는 워크플로우를 상호 간섭하지 않는 독립적인 하위 문제로 분해하여, 교차 통신 없이 병렬 실행을 촉진하는 것이 핵심입니다. 이를 통해 고도로 병렬화 가능한 에이전트 워크로드의 높은 처리량과 확장성을 확보할 수 있습니다.
본 논문은 Agentic GraphRAG 시스템에서 인용의 충실성(fidelity)을 단순히 최종 답변의 출처 지원 수준을 넘어, 전체 지식 그래프 탐색 궤적(trajectory-level)에 대한 '출처(provenance)' 개념으로 확장하여 정의합니다. 에이전트가 답변을 생성하는 과정에서 방문한 모든 구조와 엔티티까지 설명할 수 있어야 진정한 인용의 충실성을 확보할 수 있습니다. 실험 결과, 인용된 증거는 필수적이지만, 정확한 답변은 인용되지 않은 탐색 컨텍스트 및 주변 그래프 구조에도 의존한다는 점을 밝혀내며, 향후 GraphRAG 시스템 설계에 중요한 시사점을 제공합니다.
Pelican-Unified 1.0은 학습 과정에서 '통합(unification)' 원칙을 적용한 최초의 Embodied Foundation Model입니다. 이 모델은 단일 VLM을 사용하여 장면, 지시 사항, 시각적 문맥 및 행동 이력 등 다양한 정보를 공유된 의미 공간에 매핑하고, 이를 통해 이해, 추론, 상상, 행동 네 가지 능력을 하나의 시스템으로 공동 최적화합니다. Pelican-Unified 1.0은 단일 체크포인트로 VLM 벤치마크 최고 성능과 WorldArena 1위 등 강력한 성능을 입증하며 통합 패러다임의 성공을 보여줍니다.