Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
DiffusionGemma의 추론 투명성을 변수 및 알고리즘 투명성 관점에서 분석한 연구입니다. 확산 모델 특유의 불투명한 직렬 깊이 문제를 해결하기 위해 해석 가능한 토큰 병목을 제안하며, 모델의 모니터링 가능성을 검증합니다.
LLM과 지식 그래프(Knowledge Graphs)를 결합하여 경제 시나리오를 분석하는 RAG 기반 AI 경제학자 프레임워크를 제안합니다. 에이전트가 직접 정량적 주장을 하는 대신, 모델 기반 계산과 검색된 증거를 연결하여 경제적 일관성과 추적 가능성이 높은 보고서를 생성합니다.
UAV의 정밀한 시각-언어 내비게이션을 위해 '보고 도달하기(see-and-reach)' 단계를 분리한 UAV-VLN-FOV 태스크와 3DG-VLN 프레임워크를 제안합니다. 3DG-VLN은 동적 3D 방향 단서를 활용해 시각적 그라운딩과 공간 정렬을 강화하여 목표 도달 성공률을 높였습니다.
기존의 요청-응답 방식 멀티 에이전트 시스템의 한계를 극복하기 위해 자율 이벤트 기반 오케스트레이션 연구를 제안합니다. 대규모 엔터프라이즈 환경에서 규모(scale)가 성능에 미치는 영향을 분석하고, 태스크 매니저 도입을 통해 효율성을 개선하는 방안을 다룹니다.
중환자실(ICU) 내 EEG 데이터에서 버스트-억제(BS) 패턴을 탐지하기 위한 EEG 파운데이션 모델(FMs)의 성능을 평가한 연구입니다. REVE-base 모델이 기존 베이스라인 대비 오류를 크게 줄이며 가장 우수한 성능을 보였으며, 미세 조정 전략의 효과를 입증했습니다.
Lean 증명 보조 도구를 활용하여 강화학습(RLVR) 과정에서 세밀한 프로세스 수준의 피드백을 제공하는 연구를 소개합니다. 결과 중심의 보상을 넘어 택틱(tactic) 수준의 검증된 신호를 통합함으로써 형식적 추론 성능을 크게 향상시켰습니다.
Diffusion Transformer의 연산 효율성을 높이기 위해 토큰을 병합하여 길이를 조절하는 새로운 가변 길이 토크나이저를 제안합니다. 기존의 절단 방식 대신 데이터 독립적인 학습 가능한 전역 병합을 도입하여 표현 정렬 문제를 해결하고 생성 품질을 개선했습니다.
VLM의 통합 아키텍처에 따른 시각적 토큰의 변환 과정을 연구합니다. 인컨텍스트 프롬프트 방식과 레이어별 주입 방식이 시각적 표현의 진화와 언어 공간 정렬에 미치는 차이를 분석합니다.
Flow 기반 생성 모델에서 미분 불가능한 목적 함수를 처리하기 위해 진화 알고리즘을 결합한 새로운 프레임워크를 제안합니다. 잔차 공간에서 자가 수분과 교차 수분 메커니즘을 통해 탐색과 착취의 균형을 맞추며, 이미지 및 과학 데이터셋에서 성능을 입증했습니다.
적층 제조 공정의 기공률 예측 및 파라미터 최적화를 위해 Multi-Head Attention을 통합한 Soft Actor-Critic(SAC) 알고리즘을 제안합니다. 기존 강화학습 방식보다 빠른 수렴 속도와 높은 보상 값을 통해 제조 결함을 최소화하는 성능을 입증했습니다.
IHUBERT는 벡터 기반 의미론적 중복 제거 기술을 적용하여 정제된 페르시아어 코퍼스로 학습된 새로운 사전 학습 언어 모델(PLM)입니다. RoBERTa-base 구조를 기반으로 하며, 다양한 NLU 벤치마크에서 뛰어난 성능을 입증했습니다.
Rectified Flow를 기반으로 지시어에 따라 오디오를 편집하는 하이브리드 2단계 확산 트랜스포머 아키텍처를 제안합니다. 저해상도 단계의 결합 주의 집중과 고해상도 단계의 교차 주의 집중을 교차 활용하여 효율성과 정밀도를 동시에 높였습니다.
센서리모터 월드 모델(SMWM)은 역역학 규제화를 통해 행동에 정렬된 잠재 월드 모델을 학습하는 새로운 방법론을 제안합니다. 이를 통해 표현 붕괴를 방지하고, 제어 가능한 환경 정보에 집중하여 안정적인 잠재 상태를 구축합니다.
자연어 생물학 실험 프로토콜을 로봇 제어 명령으로 변환하는 이중 에이전트 프레임워크를 제안합니다. 파서 에이전트와 이기종 LLM 검증 에이전트를 통해 프로토콜의 정확성을 검증하고 자기 수정 루프를 통해 실행 가능한 명령을 생성합니다.
ScaffoldAgent는 개방형 심층 연구(OEDR)를 위해 개요를 동적으로 최적화하는 프레임워크입니다. 효용 가이드 피드백을 통해 개요를 확장, 축소, 수정하며 검색 이득과 구조적 일관성을 극대화합니다.
이 논문은 로봇 동작 생성 시 이질적인 제어 주파수 문제를 해결하기 위해 주파수 인식 플로우 매칭(FAFM)을 제안합니다. DCT를 활용해 동작을 주파수 영역에서 모델링하고 시간 미분 정규화를 통해 연속적이고 부드러운 동작을 구현합니다.
정적 프롬프트의 한계를 극복하기 위해 교육적 특징을 기반으로 한 과목 인지 프롬프팅 시스템을 제안합니다. 시뮬레이션과 실제 고등학생 대상 테스트를 통해 적응형 프롬프트 라우팅이 교육 효율성을 높이고 상호작용 횟수를 줄임을 입증했습니다.
메타휴리스틱 최적화 도구의 탐색 동작을 제어하기 위한 추론 에이전트 제어 계층(RACL) 방법론을 제안합니다. RACL은 운영 메모리를 관찰하고 가설을 수립하여 최적화 도구의 내부 동작을 제어하며, 실험 결과 기존 정책 대비 우수한 성능을 입증했습니다.
BIM-Edit은 IFC 형식의 빌딩 정보 모델링(BIM) 데이터를 자연어로 편집하는 능력을 평가하기 위한 새로운 LLM 벤치마크입니다. 기하학적, 의미론적, 위상적 일관성을 기준으로 모델을 평가하며, 현재 LLM의 엔지니어링 설계 역량이 부족함을 보여줍니다.
LLM이 에세이 품질 정보를 은닉 표현 내에 선형적으로 인코딩한다는 사실을 입증한 연구입니다. 다양한 데이터셋과 모델을 통해 에세이 채점 뉴런을 식별하고, 레이어별 정보 분포와 해석 가능성에 대한 통찰을 제공합니다.