Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
kNNGuard는 LLM의 은닉 활성화(hidden activations)를 활용하여 미세 조정 없이도 작동하는 새로운 가드레일 기술을 제안합니다. 기존 방식보다 훨씬 빠른 속도로 안전 및 주제 이탈 프롬프트를 탐지하며, 높은 성능과 유연한 도메인 적응력을 제공합니다.
긴 문맥 추론 능력을 향상시키기 위해 증거 상태 변화에 보상을 주는 강화학습 프레임워크 Maven을 제안합니다. Maven은 증거의 추가, 연결, 삭제 행동에 따라 정교한 보상을 설계하여 모델이 효과적으로 증거를 탐색하도록 돕습니다.
본 논문은 절차적 콘텐츠 생성(PCG) 기법인 WFC와 진화적 탐색을 결합한 새로운 접근 방식을 제안합니다. WFC의 입력 예시를 진화시켜 생성된 레벨의 품질을 도메인 특화된 적합도 함수로 평가하며, 국소적 구조가 중요한 도메인에서의 효과를 입증했습니다.
SUNTA는 예측 오차(놀라움)를 기반으로 비디오 시퀀스를 계층적으로 분할하는 새로운 HSSM 접근 방식을 제안합니다. 분리된 학습 전략을 통해 계층적 붕괴 문제를 해결하며, 장기 비디오 예측 성능을 획기적으로 개선했습니다.
자율형 AI 에이전트의 신뢰성을 높이기 위해 검색 전 단계에서 지식의 무결성과 추적성을 보장하는 컨텍스트 거버넌스 계층인 ContextNest를 제안합니다. RAG 시스템에 버전 관리, 감사 추적, 결정론적 선택 기능을 결합하여 데이터의 출처와 최신성을 검증합니다.
Flow-matching 기반의 시각-언어-행동(VLA) 정책에서 모델 재학습 없이 테스트 시간 가이드를 적용하는 Guided Action Flow 프레임워크를 제안합니다. 동결된 SmolVLA 정책에 행동-청크 비평가를 결합하여 로봇 조작 작업의 성공률을 유의미하게 향상시켰습니다.
멀티모달 모델의 오디오 이해 및 생성을 위한 효율적인 vLLM 기반 추론 파이프라인을 제안합니다. 자기회귀 디코딩 확장과 온-GPU 음향 디코더 통합을 통해 단일 스트림 루프의 충돌 문제를 해결했습니다. 특히 CFG 구현 시 공동 스케줄링을 통해 처리량 저하 문제를 획기적으로 개선했습니다.
LLM 시스템에서 가드레일에 의한 차단과 모델 자체의 거부를 구분하는 블랙박스 정찰 방법론을 제안합니다. HTTP, 어휘, 타이밍 신호 모니터링을 통해 가드레일의 존재와 차단 카테고리를 높은 정확도로 탐지할 수 있음을 입증했습니다.
범용 LLM의 피트니스 코칭 한계를 극복하기 위해 개발된 도메인 특화 모델 FitOne을 소개합니다. Qwen3를 기반으로 3단계 사후 학습 파이프라인을 적용하여 전문 지식과 일반 역량을 동시에 강화했습니다.
코딩 에이전트가 과학적 머신러닝 논문의 계산적 주장을 재현할 수 있도록 설계된 'Paper-replication' 워크플로우를 소개합니다. 에이전트가 논문의 방법론을 재구성하고 실험 결과와 논문의 주장을 비교 검증하여 재현 보고서를 작성하는 과정을 다룹니다.
확산 모델의 샘플링 효율을 높이기 위해 타임스텝 할당을 학습하는 연속 시간 제어 방식인 ART를 제안합니다. 강화학습의 액터-크리틱 알고리즘을 활용한 ART-RL을 통해 최적의 샘플링 스케줄을 도출하며, 기존 파이프라인 변경 없이도 높은 샘플 품질과 일반화 성능을 입증했습니다.
A$^{2}$utoLPBench는 역 KKT 조건을 활용하여 자동으로 생성되는 선형 계획법(LP) 벤치마크입니다. 정적 데이터셋의 한계인 데이터 유출 문제를 해결하고, 난이도 조절이 가능하며 정답이 보장된 에이전트 평가 환경을 제공합니다.
임상 추론 능력을 정밀하게 평가하기 위해 전문가가 작성한 루브릭 기반의 새로운 평가 데이터셋을 제안합니다. GPT, Claude, Gemini 등 주요 프런티어 모델을 테스트한 결과, 모델들이 중요도가 높은 임상적 결정 기준을 충족하는 데 큰 어려움을 겪고 있음을 발견했습니다.
신경망의 가중치 공간을 분석하기 위해 추론 과정의 순차적 특성을 반영한 동적 신경 그래프 인코더(DNG-Encoder)를 제안합니다. 이를 통해 암시적 신경 표현(INR)의 분류 성능을 기존 대비 약 10% 향상시켰습니다.
의료 영상 분할의 해석 가능성과 효율성을 높이기 위해 라디오믹스 특징을 통합한 RadiomicNet 아키텍처를 제안합니다. MobileNetV2 기반의 경량 구조와 Radiomics Attention Gate를 통해 높은 성능과 임상적 해석 가능성을 동시에 달성했습니다.
UA-ChatDev는 멀티 에이전트 소프트웨어 개발 과정에서 발생하는 환각 전파 문제를 해결하기 위해 불확실성 인지 기능을 통합한 프레임워크입니다. 토큰 수준 로그 확률을 통해 에이전트의 응답 신뢰도를 평가하고, 불확실성이 높을 경우 검증 과정을 트리거하여 소프트웨어 품질을 높입니다.
본 연구는 인간-AI 팀워크에 관한 53편의 논문을 분석하여 심리학적 분류 체계를 기반으로 다섯 가지 주요 클러스터를 제시합니다. 연구된 팀 유형의 이질성을 지적하며, 향후 연구를 위한 체크리스트와 통합 가이드를 제안합니다.
Eticas AI는 파편화된 AI 리스크 분류 체계를 넘어, 리스크를 실제 측정하고 등급을 매길 수 있는 실행 가능한 개방형 인프라를 제안합니다. GPT-4를 대상으로 한 PII 유출 테스트를 통해 리스크를 정량화하고 시스템적 패턴을 식별하는 방법론을 제시합니다.
자율 통신 네트워크에서 AI 에이전트의 잘못된 의사결정 위험을 방지하기 위한 GRV(Guard Rail Validation) 프레임워크를 제안합니다. 다양한 가중치 차원을 통해 의사결정의 임계도를 결정하고, 그에 따른 단계별 검증 메커니즘을 적용합니다.
시각-언어 내비게이션(VLN)에서 저수준 동작 표현을 강화하기 위해 언어 조건부 흐름 필드를 예측하는 CoFL-S 프레임워크를 제안합니다. 연속 시간 Habitat 벤치마크를 통해 기존 베이스라인보다 뛰어난 성능과 실세계 제로샷 배포 가능성을 입증했습니다.