Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 웹 에이전트가 실제 환경에 배치되면서 발생하는 프롬프트 주입 공격의 위험을 다룹니다. 기존의 기술 중심적 벤치마크는 피해 분포를 간과하며, 본 연구에서는 영향을 받는 이해관계자(사용자, 판매자 등)와 목표를 중심으로 피해를 체계적으로 분류하는 '이해관계자 중심적' 벤치마크인 StakeBench/SBC를 제안합니다. 이 벤치마크는 에이전트의 취약점을 질적으로 구별하여 평가할 수 있게 합니다.
본 논문은 LLM 기반 콘텐츠 조정 시스템이 소수 공동체의 문화적/종교적 관점을 무시하는 '문화적으로 무감각한 언어'를 인식할 수 있는지에 대한 한계를 탐구합니다. 방글라데시의 힌두교와 차크마 공동체를 사례로, 지역사회와 협력하여 제작한 코퍼스를 RAG에 통합한 Mod-Guide 도구를 제안했습니다.
본 논문은 태양광 발전과 가전제품 사용 패턴의 불일치 문제를 해결하기 위해 스케줄링 최적화 방안을 제시합니다. 반복 국소 탐색(ILS) 및 시뮬레이티드 어닐링(SA) 같은 메타휴리스틱 접근법을 사용하여, 사용자 불편 최소화와 재생 에너지 활용 극대화를 동시에 달성하는 가전제품 시작 시간을 결정합니다.
초분자 화학 분야의 숙주-게스트 시스템 설계를 지원하기 위해 LLM의 화학 추론 능력을 평가하는 최초의 벤치마크인 SupraBench를 제안합니다. 바인딩 친화도 예측 등 4가지 핵심 작업과 도메인 적응을 위한 SupraPMC 코퍼스를 함께 공개했습니다.
CRAFTIIF는 다변량 시계열의 네 가지 이상 유형(점형, 분포형, 시간적, 집합적)을 모두 탐지할 수 있는 새로운 비지도 학습 프레임워크입니다. 웨이블릿 특징 추출과 구조화된 Isolation Forest를 결합하여 높은 탐지 성능과 해석 가능성을 동시에 제공합니다.
유전체 프로필을 베이지안 사전 확률로 활용하여 개인 맞춤형 건강 AI의 콜드 스타트 문제를 해결하는 프레임워크를 제안합니다. 유전적 앵커를 통해 환경적 변수를 분리하고, 데이터 축적에 따라 유전체 중심에서 경험적 기준선 중심으로 추론을 동적으로 전환합니다.
성인-신생아 MR 재구성의 일반화 성능을 높이기 위해 대비 정보 기반 데이터 증강과 도메인 적대적 학습을 결합한 연구입니다. 실험 결과, Mixed-DAT 방식이 도메인 변화에 대한 강건성을 높여 신생아 MR 재구성에서 우수한 성능을 보였습니다.
과학적 발견을 위한 AI의 3계층 프레임워크를 제안하는 논문입니다. 기존의 검색과 실행을 넘어, 구조적 통찰을 통해 모델을 형성하고 진화시키는 '2계층 질적 추론'의 중요성을 강조합니다.
불규칙한 시계열 데이터에서 미래 관측 가능성과 값을 동시에 예측하는 통합 프레임워크 Timeflies를 제안합니다. 기존 모델의 오라클 가정 한계를 극복하기 위해 관측 역학과 상태 진화를 공동 모델링합니다.
에이전트 평가의 파편화 문제를 해결하기 위해 에이전트 중심의 평가 프레임워크인 AAA와 그 구현체 AgentBeats를 제안합니다. 표준화된 프로토콜을 통해 평가 로직을 에이전트 구현과 분리하여 재현성과 상호 운용성을 높였습니다.
검색 증강 LLM이 오염된 웹 콘텐츠를 소비할 때 발생하는 가짜 제품 추천 위험을 평가하는 벤치마크 FORGE를 소개합니다. 실험 결과, 단 하나의 오염된 페이지만으로도 모델의 속임수율이 최대 27%까지 상승하며 모든 모델이 취약함을 확인했습니다.
실드 강화학습을 런타임 제약 메커니즘이 아닌, 시스템의 방어 가능성을 분석하는 설계 시점의 도구로 재정의합니다. 2인용 안전 게임을 통해 네트워크의 구조적 방어 가능성을 공식적으로 인증하고 분석하는 프레임워크를 제안합니다.
Agents-K1은 과학적 지식의 정밀한 추론을 위해 원시 문서를 에이전트 네이티브 지식 그래프로 변환하는 엔드 투 엔드 파이프라인입니다. 멀티모달 파서와 GRPO로 학습된 추출 백본을 통해 엔티티, 증거, 메커니즘 등을 포착하며, 대규모 과학 논문 데이터셋인 Scholar-KG를 구축했습니다.
SpatialClaw는 VLM 에이전트의 공간 추론 능력을 향상시키기 위해 코드를 액션 인터페이스로 사용하는 training-free 프레임워크입니다. 상태 유지형 Python 커널을 통해 에이전트가 단계별로 실행 가능한 코드를 작성하며 유연하게 공간 정보를 처리할 수 있도록 설계되었습니다.
RA-RFT는 단순한 의미적 유사성을 넘어 유추(Analogy)를 통해 모델의 추론 능력을 강화하는 새로운 사후 학습 프레임워크입니다. 골드-관련성 증류와 강화 미세 조정을 결합하여 수학적 추론 등 복잡한 작업에서 기존 방식보다 뛰어난 성능을 입증했습니다.
본 논문은 농경지와 같은 비정형 환경에서 강건한 장소 인식을 위해 이종 LiDAR 데이터의 조기 융합과 학습된 재순위 지정 전략을 결합한 MinkUNeXt-VINE++를 제안합니다. 이 방법은 두 센서의 장점을 활용하여 포괄적인 환경 표현을 제공하며, 특히 반복적이고 도전적인 환경에서 높은 성능 향상을 입증했습니다.
본 연구는 실내 비전 기반 위치 추정의 불확실성을 완화하기 위해 다중 카메라 데이터 융합에 측정 보정 기법을 도입했습니다. 단일 카메라 오류를 명시적으로 특성화하여 호모그래피, 사람 탐지, 모션 트래킹 등 구성 요소별로 오류 기여도를 정량화하는 접근 방식을 제시합니다. 이 방법은 특히 안정적이고 연속적인 모션 추정이 필요한 애플리케이션에서 궤적 분산을 크게 줄이는 효과를 입증했습니다.
클라우드 자원 활용률 저하 문제를 해결하기 위해 '예측 후 최적화' 패러다임이 주목받고 있습니다. 본 글은 기존 벤치마크의 한계를 극복하고자, 클라우드 자원 통합에 특화된 종단 간 벤치마크인 CloudCons를 제안합니다. 이 벤치마크는 다양한 워크로드 데이터셋을 활용하여 기반 모델의 예측 정확도와 실제 의사결정 유용성을 종합적으로 평가합니다.
AgentRivet은 대규모 언어 모델(LLM) 기반의 자동화 워크플로우로, 물리학 저널 논문에서 분석 정보를 추출하여 누락된 Rivet 루틴을 자동으로 생성하는 시스템입니다. 이 다단계 워크플로우는 중간 코드 및 물리학 검토를 거쳐 높은 수준의 유능한 코드를 생성함을 입증했습니다. OpenAI, Anthropic, Google 등 상용 LLM을 사용하여 ATLAS 및 CMS 실험 측정값에 대한 Rivet 루틴을 성공적으로 개발했으며, 이는 이론적 모델과 실제 측정값을 연결하는 데 기여합니다.
본 논문은 다자간 구두 대화에서 발화권 교대 문제를 해결하기 위해 역할극(role-playing) 음성 에이전트인 ModeratorLM을 제안합니다. 이 시스템은 스트리밍 기반의 음성 LLM과 CoT 추론을 통합했으며, RolePlayConv라는 대규모 합성 데이터셋을 구축했습니다. 실험 결과, 기존 방식 대비 발화권 교대 정밀도와 재현율이 크게 향상됨을 입증했습니다.