Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
해외 평화 유지 임무의 위협 평가를 위해 LLM을 활용하는 새로운 접근 방식을 제안합니다. OSINT 기반 미디어 수집과 LLM의 위협 추출 기술을 결합하여, 자동 생성된 결과가 인간의 판단과 높은 일치도를 보임을 입증했습니다.
MLLM의 계산 오버헤드를 줄이기 위해 시각적 토큰을 효율적으로 제거하는 TOPS 프레임워크를 제안합니다. 정보 이론적 분석을 통해 작업 관련성, 정보 커버리지, 의미론적 다양성이라는 세 가지 원칙을 정립했습니다. 실험 결과, 대량의 토큰을 제거하면서도 모델 성능을 거의 완벽하게 유지함을 입증했습니다.
LLM 출력을 원자적 이진 질문으로 분해하여 해석 가능한 다차원 점수를 생성하는 BINEVAL 프레임워크를 제안합니다. 기존 LLM 심사위원의 불투명성을 해결하고, 사실적 일관성 등 다양한 벤치마크에서 뛰어난 성능과 진단 가치를 입증했습니다.
VLM의 피드백을 활용하여 잠재 기반 보상 형성(PBRS)을 자동화하는 VLM-PBRS 프레임워크를 제안합니다. 경량 VLM의 선호도 데이터를 통해 잠재 함수를 학습함으로써 전문가의 설계 없이도 보상 해킹을 방지하고 샘플 효율성을 높입니다.
자연어 분류기의 취약성을 공격하기 위한 하이브리드 유전 알고리즘인 GAversary를 제안합니다. GloVe 임베딩을 활용해 의미론적 유사성을 유지하면서도 모델의 정확도를 크게 낮추는 적대적 텍스트 생성 방식을 다룹니다.
LeHome Challenge 2026에서 우승한 양손 의류 접기(bimanual garment folding) 솔루션을 소개합니다. 강화학습(RL)과 시각-언어-행동(VLA) 정책을 결합하여 시뮬레이션 1위 및 실환경 2위를 달성한 기술적 방법론을 다룹니다.
자동 팩트 체크 시스템의 오보 확산 및 명예훼손 위험을 방지하기 위한 새로운 위험 분류 체계를 제안합니다. 위험 요인, 위험 상황, 피해의 3단계 전파 과정을 고려하여 32가지 위험을 정의하고, 이를 통해 DEFAME 시스템의 위험 평가를 수행합니다.
시각-언어 모델(VLM)의 해석 가능성을 높이기 위해 결합 희소 오토인코더(JSAE)를 제안합니다. JSAE는 시각 및 언어 활성화 값을 공유된 특징으로 공동 인수분해하여 교차 모달 제어를 가능하게 합니다.
수중 이동체의 에너지 효율적인 제어를 위해 전력 예산을 명시적 제약 조건으로 설정하는 Constrained Markov decision process 방식을 제안합니다. PPO-Lagrangian 알고리즘을 통해 수동적인 가중치 조정 없이도 에너지 소모를 최소화하며 임무를 수행할 수 있음을 입증했습니다.
LLM 기반 GUI 에이전트가 사용자의 민감한 정보가 포함된 화면을 마주했을 때, 안전하게 사용자에게 권한을 이양할 수 있도록 돕는 연구입니다. 사용자 민감 상태를 식별하고 분류하는 데이터셋과 이를 탐색하는 에이전트 개발을 다룹니다.
PCDiff는 포인트 클라우드 기반의 3D 이상 탐지를 위한 새로운 확산(Diffusion) 프레임워크입니다. 멀티모달 어텐션을 통해 미세한 결함을 생성하고, 지역-전역 재구성 알고리즘으로 배경의 위치 편향 문제를 해결하여 탐지 정확도를 높였습니다.
위치 공간의 형식화를 기반으로 한 그래프 기반 추론 프레임워크인 '위치 그래프(position graphs)'를 제안합니다. 수평·수직 정렬과 선후 관계를 활용해 이산 토큰의 상대적 위치를 모델링하며, 이에 대한 이론적 분석과 계산 복잡도를 다룹니다.
LLM이 전문가의 투자 의사결정 프레임워크를 얼마나 정확히 재구성하는지 평가하는 다층적 동적 벤치마크인 InvestPhilBench를 소개합니다. 8단계 인지 계층과 자동 채점 파이프라인(BASP)을 통해 모델의 절차적 추론 능력을 정밀하게 측정합니다.
ERC-8004 프로토콜을 통해 탈중앙화 AI 에이전트 생태계의 신뢰 계층을 실증적으로 분석한 연구입니다. Ethereum, BSC, Base 체인을 대상으로 신원, 평판, 검증 시스템의 취약점과 Sybil 공격 가능성을 조사했습니다.
EUV 마스크 제작을 위한 경사 기반 역 리소그래피(ILT) 기술을 제안합니다. 미분 가능한 도파관 방법과 물리 정보 신경 연산자(WGNO)를 결합하여 마스크 흡수체의 유전율을 정밀하게 복원합니다.
OncoSynth는 종양학 분야에서 인과 관계를 보존하며 합성 데이터를 생성하는 머신러닝 프레임워크입니다. 확산 기반의 순차적 접근 방식을 통해 치료 효과 추정 시 발생하는 편향을 획기적으로 줄여줍니다.
표준 및 퍼지 온톨로지와 지식 그래프를 위한 퍼지 양화 쿼리 평가 프레임워크를 제안합니다. 양화사 유형과 데이터 소스에 관계없이 적용 가능한 적응형 접근 방식을 특징으로 하며, 구현체인 Q2S2를 함께 소개합니다.
불확실한 환경에서의 의사결정 모델인 MDP를 위한 온라인 통계적 모델 검증 방법을 제안합니다. 기존의 합집합 경계 방식보다 효율적인 신뢰 구간 시퀀스를 통해 기존 기술 대비 샘플 요구량을 평균 50배 절감했습니다.
MiniOpt는 제한된 자원으로 최적화 문제를 해결하기 위해 '추론을 통한 모델링 및 해결' 패러다임을 제안하는 강화학습 프레임워크입니다. 구조화된 모델링과 솔버 생성을 분해하여 학습하며, 소형 모델에서도 강력한 최적화 일반화 성능을 입증했습니다.
AI 에이전트가 데이터 접근 권한을 남용하여 사용자를 감시할 수 있는 '에이전트 기반 감시' 위험을 정의하고 분석합니다. SurveilBench 데이터셋을 통해 모델의 감시 능력을 평가하고, 이를 회피하기 위한 프롬프트 인젝션 기반의 기술적 방안을 제안합니다.