Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
음향 진동을 이용해 카메라의 물리적 안정화 메커니즘을 방해함으로써 컴퓨터 비전(CV) 모델의 성능을 저하시키는 적대적 공격 연구를 소개합니다. 가청 주파수 대역을 활용해 공격 거리를 확장하고 YOLO11 모델에 미치는 영향을 실험적으로 입증했습니다.
상충하는 여러 목적을 가진 다중 에이전트 환경에서 협력적 의사결정을 위한 PCMA 모델을 제안합니다. 에이전트 간의 선호도를 조정하여 팀 전체의 성능과 트레이드오프 조율 능력을 향상시키는 이론적 근거와 실험 결과를 제시합니다.
팔이 없는 이족 보행 바퀴 로봇의 낙하 회복을 위해 힘 유도 학습(FTSR) 프레임워크를 제안합니다. 제약 조건 강화학습과 교사-학생 아키텍처를 통해 외부 보조 힘에 의존하지 않고 스스로 자세를 회복하는 전략을 학습합니다.
생성형 추천 시스템에서 시간 정보가 결여된 시맨틱 ID의 한계를 극복하기 위한 ChronoID 프레임워크를 제안합니다. 시간 신호의 세 가지 차원을 활용하여 시간 인지적 시맨틱 ID 학습을 가능하게 하며, 새로운 벤치마크를 통해 그 효과를 검증합니다.
프로세스 마이닝의 딥러닝 모델을 위해 제어 흐름 구조를 반영하는 새로운 손실 함수 DIFF-ERO를 제안합니다. 기존 교차 엔트로피 방식의 한계를 극복하여 전역적 동작의 정확도를 높이고 구조적 정밀도와 재현율을 개선합니다.
시계열 프로토타입 학습의 관측 모호성과 이산적 구조의 한계를 해결하기 위해 Neural ODE 기반의 계층적 상미분 방정식 클러스터링 네트워크를 제안합니다. 이 모델은 연속적 역학을 통해 노이즈와 특징 트렌드를 분리하며, 불규칙한 시계열 데이터에서도 효과적인 장애 탐지가 가능합니다.
Hajj 성지 순례 장면의 데이터 부족 문제를 해결하기 위해 구조적 단서와 문맥적 속성을 활용하는 하이브리드 GAN 모델 Pix2Pix-Hybrid를 제안합니다. 이 모델은 고해상도 합성 데이터셋 CrowdH를 생성하여 군중 계수 모델의 성능을 향상시키는 데 기여합니다.
현실적인 사이버 보안 워크플로우를 평가하기 위한 최초의 개방형 다중 레인지 인프라인 AgentCyberRange를 소개합니다. 기존 벤치마크의 한계를 넘어 웹 익스플로잇부터 내부 침해 확대까지의 자율적 공격 능력을 측정합니다.
속성 그래프 쿼리를 통해 입력 그래프를 출력 그래프로 변환할 때, 출력 스키마를 추론하는 새로운 절차를 제안합니다. RDF 매핑과 기술 논리(DL) 추론기를 활용하여 복잡한 속성 그래프의 스키마 제약 조건을 효율적으로 관리합니다.
LLM 에이전트와 사용자 간의 정보 격차를 줄이기 위한 커뮤니케이션 정책을 연구한 논문입니다. 텍스트와 UI의 장점을 결합한 하이브리드 방식과 프롬프트 개선을 통해 정책을 스스로 발전시키는 CPE 프레임워크를 제안합니다.
Squeeze-Release는 가지치기(Pruning)와 최소화(Minimization)를 반복하여 모델의 구조적 중복성을 제거하는 새로운 연구입니다. 이를 통해 모델의 정확도를 유지하면서도 크기를 획기적으로 줄이는 정확한 구조적 재작성 방식을 제안합니다.
Edge-Cloud-Space 연속체 내 복합 AI 시스템의 SLO 준수를 위한 프레임워크 PLAIground를 제안합니다. CAIM 추상화와 Pixie 알고리즘을 통해 워크플로우 변경 없이 실행 중 최적의 모델을 동적으로 선택합니다.
VLA 모델의 경직된 추론 일정을 개선하기 위해 탄성 쿼리 강화학습(EQRL) 프레임워크를 제안합니다. 상태 난이도에 따라 계산 자원을 유동적으로 배분하여, 작업 성공률을 유지하면서도 추론 비용을 효율적으로 절감합니다.
과학적 발견 과정에서 가설 중복성으로 인한 병목 현상을 해결하기 위한 기하학적 이론을 제시합니다. LLM의 비국소적 제안이 효과를 발휘하기 위한 세 가지 기하학적 조건인 탐색 압축, 직교 탈출, 잔차 신호 정렬을 정의하고 이를 검증합니다.
Hy-Embodied-0.5-VLA(HyVLA-0.5)는 데이터 수집부터 모델 설계, 미세 조정, 강화학습, 실제 환경 배포까지 아우르는 엔드 투 엔드 로봇 학습 스택을 제안합니다. Vision-Language-Action(VLA) 모델을 통해 실제 환경에서의 로봇 제어 성능을 극대화하는 시스템을 다룹니다.
안전한 강화학습(Safe RL)에서 발생하는 진동 현상과 제약 조건 위반 문제를 해결하기 위한 CSPO 방법론을 제안합니다. 국소적 제약 조건 민감도를 정책 업데이트에 통합하여 KKT 해를 보존하고 더 빠른 안전 회복을 가능하게 합니다.
COMET은 슬롯 구조화된 잠재 공간에서 몬테카를로 트리 탐색(MCTS)을 수행하는 새로운 모델 기반 강화학습 알고리즘입니다. 트랜스포머 기반 월드 모델과 객체-인과 어텐션을 결합하여 작업 관련 엔티티에 집중된 의사결정을 가능하게 합니다.
오디오 딥페이크 탐지 모델의 사후 설명(post-hoc explanation) 방법론이 가진 취약성을 연구한 논문입니다. 심리음향학적 프레임워크를 통해 모델의 예측 결과는 유지하면서 설명 히트맵만 왜곡하는 공격 가능성을 입증했습니다.
LLM 에이전트가 GNN 도구를 사용할 때 스스로 판단하기보다 도구의 결과에 맹목적으로 의존하는 'GNN 앵무새' 현상을 분석한 연구입니다. 모델의 역량이 커질수록 오히려 도구에 대한 의존도가 높아지며, 이는 에이전트의 자율적 추론 능력을 저해할 수 있음을 경고합니다.
자율주행 엔드투엔드 플래너가 통계적 지름길에 의존하는 인과적 혼동 문제를 해결하기 위한 CADET 프레임워크를 제안합니다. 별도의 재훈련 없이도 사전 훈련된 모델의 가짜 의존성을 감사하고 수정할 수 있는 것이 특징입니다.