Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
잔차 가중치 보정을 적용한 Heavy-Ball Q-learning 방법론을 제안하고 그 수렴성을 입증한 논문입니다. 스위칭 선형 시스템(SLS) 관점을 통해 모멘텀이 Q-learning의 수렴을 가속화하는 원리에 대한 새로운 이론적 통찰을 제공합니다.
LLM 에이전트의 상호작용 경험을 활용하기 위해 자연어 규칙과 모델 정책을 동시에 업데이트하는 JERP 프레임워크를 제안합니다. 규칙 풀과 정책을 공동 학습함으로써 규칙의 최신성을 유지하고 에이전트의 의사 결정 성능을 향상시킵니다.
자기회귀적 멀티모달 모델의 이미지 생성 안전성을 높이기 위해 반복적 자기 개선 코드북을 제안합니다. 인간의 주석 없이 모델 스스로 유해한 이미지-텍스트 쌍을 식별하고 코드북을 미세 조정하여 안전한 생성을 유도합니다.
해외 평화 유지 임무의 위협 평가를 위해 LLM을 활용하는 새로운 접근 방식을 제안합니다. OSINT 기반 미디어 수집과 LLM의 위협 추출 기술을 결합하여, 자동 생성된 결과가 인간의 판단과 높은 일치도를 보임을 입증했습니다.
MLLM의 계산 오버헤드를 줄이기 위해 시각적 토큰을 효율적으로 제거하는 TOPS 프레임워크를 제안합니다. 정보 이론적 분석을 통해 작업 관련성, 정보 커버리지, 의미론적 다양성이라는 세 가지 원칙을 정립했습니다. 실험 결과, 대량의 토큰을 제거하면서도 모델 성능을 거의 완벽하게 유지함을 입증했습니다.
LLM 출력을 원자적 이진 질문으로 분해하여 해석 가능한 다차원 점수를 생성하는 BINEVAL 프레임워크를 제안합니다. 기존 LLM 심사위원의 불투명성을 해결하고, 사실적 일관성 등 다양한 벤치마크에서 뛰어난 성능과 진단 가치를 입증했습니다.
VLM의 피드백을 활용하여 잠재 기반 보상 형성(PBRS)을 자동화하는 VLM-PBRS 프레임워크를 제안합니다. 경량 VLM의 선호도 데이터를 통해 잠재 함수를 학습함으로써 전문가의 설계 없이도 보상 해킹을 방지하고 샘플 효율성을 높입니다.
기존의 결정론적 워크플로우 엔진을 교체하지 않고도 에이전트 기반 BPM으로 격상시키는 '프로세스 하네스' 메커니즘을 소개합니다. TDF 모델을 통해 Task, Decision, Flow 세 가지 에이전트 유형을 정의하고 CUGA FLO를 통해 구현 사례를 입증합니다.
자연어 분류기의 취약성을 공격하기 위한 하이브리드 유전 알고리즘인 GAversary를 제안합니다. GloVe 임베딩을 활용해 의미론적 유사성을 유지하면서도 모델의 정확도를 크게 낮추는 적대적 텍스트 생성 방식을 다룹니다.
LeHome Challenge 2026에서 우승한 양손 의류 접기(bimanual garment folding) 솔루션을 소개합니다. 강화학습(RL)과 시각-언어-행동(VLA) 정책을 결합하여 시뮬레이션 1위 및 실환경 2위를 달성한 기술적 방법론을 다룹니다.
자동 팩트 체크 시스템의 오보 확산 및 명예훼손 위험을 방지하기 위한 새로운 위험 분류 체계를 제안합니다. 위험 요인, 위험 상황, 피해의 3단계 전파 과정을 고려하여 32가지 위험을 정의하고, 이를 통해 DEFAME 시스템의 위험 평가를 수행합니다.
시각-언어 모델(VLM)의 해석 가능성을 높이기 위해 결합 희소 오토인코더(JSAE)를 제안합니다. JSAE는 시각 및 언어 활성화 값을 공유된 특징으로 공동 인수분해하여 교차 모달 제어를 가능하게 합니다.
수중 이동체의 에너지 효율적인 제어를 위해 전력 예산을 명시적 제약 조건으로 설정하는 Constrained Markov decision process 방식을 제안합니다. PPO-Lagrangian 알고리즘을 통해 수동적인 가중치 조정 없이도 에너지 소모를 최소화하며 임무를 수행할 수 있음을 입증했습니다.
LLM 기반 GUI 에이전트가 사용자의 민감한 정보가 포함된 화면을 마주했을 때, 안전하게 사용자에게 권한을 이양할 수 있도록 돕는 연구입니다. 사용자 민감 상태를 식별하고 분류하는 데이터셋과 이를 탐색하는 에이전트 개발을 다룹니다.
PCDiff는 포인트 클라우드 기반의 3D 이상 탐지를 위한 새로운 확산(Diffusion) 프레임워크입니다. 멀티모달 어텐션을 통해 미세한 결함을 생성하고, 지역-전역 재구성 알고리즘으로 배경의 위치 편향 문제를 해결하여 탐지 정확도를 높였습니다.
위치 공간의 형식화를 기반으로 한 그래프 기반 추론 프레임워크인 '위치 그래프(position graphs)'를 제안합니다. 수평·수직 정렬과 선후 관계를 활용해 이산 토큰의 상대적 위치를 모델링하며, 이에 대한 이론적 분석과 계산 복잡도를 다룹니다.
LLM이 전문가의 투자 의사결정 프레임워크를 얼마나 정확히 재구성하는지 평가하는 다층적 동적 벤치마크인 InvestPhilBench를 소개합니다. 8단계 인지 계층과 자동 채점 파이프라인(BASP)을 통해 모델의 절차적 추론 능력을 정밀하게 측정합니다.
ERC-8004 프로토콜을 통해 탈중앙화 AI 에이전트 생태계의 신뢰 계층을 실증적으로 분석한 연구입니다. Ethereum, BSC, Base 체인을 대상으로 신원, 평판, 검증 시스템의 취약점과 Sybil 공격 가능성을 조사했습니다.
EUV 마스크 제작을 위한 경사 기반 역 리소그래피(ILT) 기술을 제안합니다. 미분 가능한 도파관 방법과 물리 정보 신경 연산자(WGNO)를 결합하여 마스크 흡수체의 유전율을 정밀하게 복원합니다.
OncoSynth는 종양학 분야에서 인과 관계를 보존하며 합성 데이터를 생성하는 머신러닝 프레임워크입니다. 확산 기반의 순차적 접근 방식을 통해 치료 효과 추정 시 발생하는 편향을 획기적으로 줄여줍니다.