Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
다중 에이전트 및 일반 다체 시스템에서 에이전트의 권력과 반응 함수가 집단적 질서에 미치는 영향을 분석하는 프레임워크를 제안합니다. 시스템의 생산성, 안정성, 적응성 사이의 최적 균형점을 도출하며, 동기화가 시스템 취약성에 미치는 영향을 연구합니다.
멀티 에이전트 LLM 시스템 내에서 평가자 편향이 네트워크를 통해 전파되는 현상을 분석한 연구입니다. Contagion Networks 프레임워크를 통해 편향 확산 메커니즘을 측정하고, 평가 위원회 규모 확대를 통한 완화 전략을 제시합니다.
FreeStyle은 커뮤니티 LoRA 마이닝을 활용하여 스타일과 콘텐츠를 분리하여 제어하는 이중 참조 생성 프레임워크입니다. 어텐션 제약과 RoPE 변조 기술을 통해 스타일 참조의 의미론적 누출을 방지하고 높은 콘텐츠 충실도를 유지합니다.
본 연구는 인컨텍스트 데모의 구성이 LLM의 유해한 준수(harmful compliance)에 미치는 영향을 분석합니다. 양호한 데모와 유해한 데모가 서로 교체 불가능하며, 데모의 내용, 순서, 모델의 학습 방법론에 따라 탈옥 메커니즘이 다르게 작동함을 규명합니다.
AI 에이전트의 보안을 위해 확률적 술어와 상태 전이를 고려한 새로운 검증 프레임워크를 제안합니다. 분포 강건 최적화를 활용하여 술어 간 상관관계가 있더라도 정책 위반 확률의 건전한 상한선을 계산할 수 있습니다.
FlowEdit은 동결된 Flow-matching TTS 모델의 발음 오류를 해결하기 위한 평생 적응 프레임워크입니다. 가중치 업데이트 없이 Modern Hopfield Network를 활용한 에피소드 메모리에 교정 정보를 저장하여 고유 명사 발음을 개선합니다.
SARLO-80은 초고해상도 SAR 데이터, 정렬된 광학 이미지, 자연어 설명을 결합한 대규모 멀티모달 데이터셋입니다. 기존 저해상도 데이터셋의 한계를 넘어 복소수 값과 고유 기하 구조를 보존하여 물리적 근거를 둔 멀티모달 학습을 지원합니다.
DeepSWIP는 신경 기호 시스템인 DeepProbLog을 위한 새로운 반사실적 추론 프레임워크를 제안합니다. 신경 술어를 ProbLog 선택으로 축소하고 WMC를 적용하여 인과적 추론을 수행하며, 기존 방식 대비 2.14배 빠른 추론 속도를 보여줍니다.
스타일 캡션 기반 TTS 시스템에서 자연어 지시문이 음성 생성에 미치는 영향을 분석한 연구입니다. DAAM 프레임워크를 음성 확산 모델에 적용하여 토큰별 기여도를 시각화하고 스타일 조건화의 메커니즘을 규명했습니다.
분포 변화(Distribution Shift) 상황에서 Mixture-of-Experts(MoE) 모델의 보정 성능을 개선하는 연구를 다룹니다. 하드 라우팅과 소프트 라우팅 모델의 차이를 분석하고, 적대적 재가중치 방식을 통해 정확도와 보정 성능의 트레이드오프를 개선하는 방법을 제안합니다.
G2Rec은 생성형 추천을 위해 그래프 기반 사용자 공동 참여 모델링과 의미론적 토큰화를 통합한 확장 가능한 프레임워크입니다. 기존 방식의 확장성 문제와 부정확한 의미론적 표현을 해결하여 더욱 포괄적이고 정확한 사용자 관심사 모델링을 제공합니다.
DiffusionGemma의 추론 투명성을 변수 및 알고리즘 투명성 관점에서 분석한 연구입니다. 확산 모델 특유의 불투명한 직렬 깊이 문제를 해결하기 위해 해석 가능한 토큰 병목을 제안하며, 모델의 모니터링 가능성을 검증합니다.
LLM과 지식 그래프(Knowledge Graphs)를 결합하여 경제 시나리오를 분석하는 RAG 기반 AI 경제학자 프레임워크를 제안합니다. 에이전트가 직접 정량적 주장을 하는 대신, 모델 기반 계산과 검색된 증거를 연결하여 경제적 일관성과 추적 가능성이 높은 보고서를 생성합니다.
UAV의 정밀한 시각-언어 내비게이션을 위해 '보고 도달하기(see-and-reach)' 단계를 분리한 UAV-VLN-FOV 태스크와 3DG-VLN 프레임워크를 제안합니다. 3DG-VLN은 동적 3D 방향 단서를 활용해 시각적 그라운딩과 공간 정렬을 강화하여 목표 도달 성공률을 높였습니다.
기존의 요청-응답 방식 멀티 에이전트 시스템의 한계를 극복하기 위해 자율 이벤트 기반 오케스트레이션 연구를 제안합니다. 대규모 엔터프라이즈 환경에서 규모(scale)가 성능에 미치는 영향을 분석하고, 태스크 매니저 도입을 통해 효율성을 개선하는 방안을 다룹니다.
중환자실(ICU) 내 EEG 데이터에서 버스트-억제(BS) 패턴을 탐지하기 위한 EEG 파운데이션 모델(FMs)의 성능을 평가한 연구입니다. REVE-base 모델이 기존 베이스라인 대비 오류를 크게 줄이며 가장 우수한 성능을 보였으며, 미세 조정 전략의 효과를 입증했습니다.
Lean 증명 보조 도구를 활용하여 강화학습(RLVR) 과정에서 세밀한 프로세스 수준의 피드백을 제공하는 연구를 소개합니다. 결과 중심의 보상을 넘어 택틱(tactic) 수준의 검증된 신호를 통합함으로써 형식적 추론 성능을 크게 향상시켰습니다.
Diffusion Transformer의 연산 효율성을 높이기 위해 토큰을 병합하여 길이를 조절하는 새로운 가변 길이 토크나이저를 제안합니다. 기존의 절단 방식 대신 데이터 독립적인 학습 가능한 전역 병합을 도입하여 표현 정렬 문제를 해결하고 생성 품질을 개선했습니다.
VLM의 통합 아키텍처에 따른 시각적 토큰의 변환 과정을 연구합니다. 인컨텍스트 프롬프트 방식과 레이어별 주입 방식이 시각적 표현의 진화와 언어 공간 정렬에 미치는 차이를 분석합니다.
Flow 기반 생성 모델에서 미분 불가능한 목적 함수를 처리하기 위해 진화 알고리즘을 결합한 새로운 프레임워크를 제안합니다. 잔차 공간에서 자가 수분과 교차 수분 메커니즘을 통해 탐색과 착취의 균형을 맞추며, 이미지 및 과학 데이터셋에서 성능을 입증했습니다.