Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 기사는 단기 후성유전체 분석에 대한 AI 에이전트의 성능을 검증하는 벤치마크인 EpiBench를 소개합니다. 이 벤치마크는 CUT&Tag, ATAC-seq 등 다양한 워크플로우에서 에이전트가 과학적 결정을 내리는 능력을 평가하며, GPT-5.5 / Pi 등이 선두를 차지했습니다.
본 연구는 추론 과정에서 각 단계의 인과적 중요도를 측정하고, 대규모 언어 모델(LLM)이 '커밋먼트 경계'를 넘어서 답변을 형성하는 과정을 탐구했습니다. 이 분석을 통해 CoT 추론의 불필요한 부분을 식별하여 조기 종료 기법을 개발함으로써, 전체 추론 길이를 평균 55%까지 줄이는 성과를 거두었습니다.
본 연구는 LLM의 오류가 진정한 추론이 아닌 패턴 매칭에 기인할 수 있음을 지적하며, 인간과 LLMs 모두 일상적인 상식 추론에서 유사한 오류 패턴을 보임을 발견했습니다. 특히 LLM의 어텐션 헤드 분석을 통해 이러한 패턴 매칭 메커니즘을 식별했으며, 이는 인간의 인지 과정 역시 세계 모델보다는 패턴 매칭에 더 가깝다는 점을 시사합니다.
본 논문은 AI가 인간의 인지 및 인식론에 미치는 영향을 분석하기 위해 Tri-System Theory, Thinkframes, System 0 세 가지 프레임워크를 검토합니다. 특히 '인지 식민화(cognitive colonization)'라는 개념을 제시하며, AI 시스템이 사용자가 알아차리기 어려운 방식으로 자아 구조 내부에 외부적 이해관계를 심을 수 있음을 경고합니다.
본 논문은 대규모 언어 모델(LLMs)이 사회 및 행동 과학 분야의 재현성 평가를 자동화할 수 있음을 제시합니다. LLM 파이프라인을 통해 41%의 연구에서 원본 효과 크기를 복구했으며, 질적 결론 도출률도 높았습니다. 이는 LLMs가 학술 연구 결과에 대한 확장 가능한 감사 도구가 될 수 있음을 시사합니다.
본 논문은 LLM 추론 능력을 향상시키는 다중 에이전트 토론(MAD)의 비효율성을 개선한 ARMOR-MAD 프레임워크를 제안합니다. ARMOR-MAD는 사전 합의 라우팅, 조기 중단 평가자, 의미적 아웃라이어 탐지 기능을 결합하여 계산 자원 낭비를 줄이고 정확도를 높입니다. 다양한 벤치마크에서 기존 방식 대비 높은 성능 향상을 입증했습니다.
본 논문은 다중 속성 대안 선택 시, 고전 모델이 가정하는 완전 보상적 효용 집계 대신 '제한된 상충 관계 스크리닝' 과정을 제안합니다. 이 프레임워크는 속성 전반의 이득과 손실 균형을 평가하며, 맥락에 따라 달라지는 상충 관계 내성 매개변수를 도입하여 인간 의사결정의 복잡성을 포착합니다.
본 논문은 고유수용성감각과 시각적 대응을 활용하여 휴머노이드 로봇이 별도의 신원 레이블 없이도 자기와 타인을 구별하는 방법을 제시합니다. 이 능력을 통해 로봇은 예측적 자기 모델을 구축하고, 충돌 인식 동작 계획 및 인간-로봇 협업 등 다양한 다운스트림 작업을 수행할 수 있음을 입증했습니다.
본 연구는 오르토프테라(Orthoptera) 생체음향 분류를 위해 PULSE라는 준지도, 다중 작업 프레임워크를 제안합니다. 이 프레임워크는 약지도 학습, 자기 지도 학습, 지식 증류를 결합하여 기존 자동화 도구의 한계를 극복했습니다. 그 결과, 일반 모델 대비 높은 성능을 달성했으며, 능동 학습 추가 시 더욱 향상된 결과를 보였습니다.
본 논문은 확산 모델의 제어 한계를 극복하기 위해 'Jeffrey guidance'라는 원리적인 프레임워크를 제시합니다. 이 방법론은 표준 가이던스를 넘어선 응용 분야까지 제어를 확장하며, Jeffrey의 조건화 규칙을 활용하여 주변 분포를 목표 방향으로 업데이트합니다.
본 연구는 로봇이 전달하는 AI 생성 개그를 평가하며, 유머 스타일과 주제가 청중의 인지에 미치는 영향을 탐구했습니다. 그 결과, 공격적 및 친화적 유머 유형이 재미에 긍정적인 영향을 주었으며, 정치적 내용보다 개인 관련 개그가 적절성 측면에서 더 선호됨을 발견했습니다.
본 논문은 파킨슨병 보행 평가를 위해 다양한 센서 모달리티가 점진적으로 추가되는 환경에 적응하는 지속 학습 프레임워크인 MOSAIC를 제안합니다. 이 프레임워크는 신뢰성 문제와 통계적 변화, 가소성 감소 문제를 해결하기 위한 세 가지 핵심 요소를 포함합니다.
본 연구는 트랜스포머의 가중치 공간 기하학에서 모듈별 다양체 제약 조건의 비대칭성을 탐구했습니다. 어텐션 블록에는 Stiefel 기하학, MLP 블록에는 DGram 기하학을 할당하는 것이 가장 좋은 성능을 보였습니다. 이는 트랜스포머 최적화가 균일하지 않고 모듈별로 이루어져야 함을 시사합니다.
본 글은 Equilibrium State Estimation (ESE)이라는 새로운 패러다임을 제시합니다. ESE는 상호작용하는 여러 시스템의 개별적이고 협력적인 예측이 필요할 때 사용되며, 기존 방식보다 정확하고 훨씬 빠르다는 것을 입증했습니다. 특히 통화 환율 및 COVID-19 모델링 등 다양한 실제 데이터셋에서 뛰어난 성능과 확장성을 보여줍니다.
본 논문은 CAD 생성 및 편집의 한계를 극복하기 위해 'IterCAD'라는 통합 멀티모달 에이전트 프레임워크를 제안합니다. IterCAD는 다중 턴 상호작용을 통해 드로잉/텍스트 기반 코드 생성과 반복적인 편집 작업을 지원하며, 폐쇄 루프(closed-loop)의 CAD 작업 방식을 구현했습니다.
본 논문은 비동기 추론 기반의 실시간 실행 가능성을 탐구하며, 대규모 Vision-Language-Action 모델 배포에 중요함을 강조합니다. 기존 연구가 확산 정책에 집중한 것과 달리, 토큰화 지평 조정 및 제약 디코딩을 통해 자기회귀 정책이 실시간 실행을 달성할 수 있음을 입증했습니다.
본 논문은 RAG의 핵심 문제인 청크 세분성 불확실성을 다루는 새로운 하이브리드 검색 프레임워크 UMG-RAG를 제안합니다. UMG-RAG는 기존 밀집형 및 희소형 리트리버를 활용하여 쿼리별 신뢰도를 추정하고, 이를 통해 여러 세분성의 증거들을 효과적으로 융합합니다. 또한, 부모 승격 변형인 UMGP-RAG도 도입하여 검색 품질을 향상시킵니다.
본 논문은 과학 실험실 환경에 특화된 Vision-Language-Action (VLA) 모델인 LabVLA를 제안합니다. 기존 VLA 모델이 가정용 시연에 국한된 한계를 극복하기 위해, RoboGenesis라는 데이터 엔진을 구축하고 두 단계의 훈련(액션 토큰 사전 학습 및 흐름 매칭 사후 훈련)을 거쳤습니다. 이로써 LabVLA는 과학 실험실 워크플로우에서 높은 성공률을 입증했습니다.
본 논문은 비디오 초해상도(VSR)에서 텍스처 복구에 초점을 맞춘 이벤트 기반 프레임워크인 EvTexture++를 제안합니다. 이 프레임워크는 이벤트 신호의 고주파 시공간 디테일을 활용하여 텍스처 복구를 개선하며, 반복적인 모듈을 통해 점진적이고 상세한 고해상도 출력을 제공합니다. 또한 시간적 일관성 강화를 위해 이벤트 가이드 텍스처 인식 흐름을 추정하는 모듈도 도입했습니다.
본 논문은 다국어 및 저자원 시나리오에서의 의료 추론 성능 한계를 극복하기 위해 개발되었습니다. 연구진은 영어와 7개 인도 언어를 포함하는 대규모 멀티모달 데이터셋 ArogyaBodha를 구축했습니다. 이를 기반으로, 단계별 추론과 이중 메모리를 통합한 다중 에이전트 프레임워크인 ArogyaSutra를 제안합니다.