Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
EEG 기반 우울증 인식을 위해 뇌 네트워크의 계층적 구조를 포착하는 SA-HGNN 모델을 제안합니다. 쌍곡선 기하학을 활용하여 유클리드 공간의 한계를 극복하고 개인화된 뇌 네트워크 토폴로지를 동적으로 구축합니다.
LLM 에이전트 평가의 높은 비용과 복잡성을 해결하기 위해 프록시 벤치마크 프레임워크인 PACE를 제안합니다. 소수의 비에이전트 평가 항목만으로도 타겟 에이전트 벤치마크의 성능을 저렴하고 정확하게 예측할 수 있음을 입증했습니다.
분리형 LLM 서빙 환경에서 프리필 노드의 포화와 디코드 노드의 저활용 문제를 해결하기 위한 새로운 스케줄링 기법을 제안합니다. 디코드 노드에서 청크 단위 프리필을 수행하는 '부하 인지형 프리필 편향'을 통해 노드 간 KV-캐시 전송 지연을 제거합니다.
모델의 안전한 완성을 평가하기 위해 의도(intent)만을 변화시키는 통제된 프롬프트 벤치마크인 OpenSafeIntent를 제안합니다. 기존의 단일 프롬프트 평가 방식이 가진 한계를 지적하며, 의도 변화에 따른 모델의 안전성 교정 능력을 측정하는 것이 중요함을 강조합니다.
LLM의 위기 상황 대응 능력 중 교차 언어적 공감과 문화적 접지를 평가하기 위한 새로운 벤치마크 SPLIT을 제안합니다. 영어와 우크라이나어를 대상으로 Gemini, LLaMA, DeepSeek 모델의 성능을 비교 분석했습니다.
시공간적 상관관계가 있는 데이터셋에서 발생하는 데이터 누수와 숨겨진 층화 문제를 해결하기 위한 새로운 프레임워크를 제안합니다. SASP 분할 방식과 CDRO 최적화 기법을 통해 모델의 일반화 성능과 신뢰도를 향상시킵니다.
설명 가능한 AI(XAI)를 위해 최적 결정 트리의 가설 공간을 전역적으로 분석하는 ADTC 프레임워크를 제안합니다. 대수적 모델 카운팅(AMC) 개념을 도입하여 최적화, 카운팅, 샘플링 문제를 통합된 계산 방식으로 해결합니다.
kNNGuard는 LLM의 은닉 활성화(hidden activations)를 활용하여 미세 조정 없이도 작동하는 새로운 가드레일 기술을 제안합니다. 기존 방식보다 훨씬 빠른 속도로 안전 및 주제 이탈 프롬프트를 탐지하며, 높은 성능과 유연한 도메인 적응력을 제공합니다.
긴 문맥 추론 능력을 향상시키기 위해 증거 상태 변화에 보상을 주는 강화학습 프레임워크 Maven을 제안합니다. Maven은 증거의 추가, 연결, 삭제 행동에 따라 정교한 보상을 설계하여 모델이 효과적으로 증거를 탐색하도록 돕습니다.
본 논문은 절차적 콘텐츠 생성(PCG) 기법인 WFC와 진화적 탐색을 결합한 새로운 접근 방식을 제안합니다. WFC의 입력 예시를 진화시켜 생성된 레벨의 품질을 도메인 특화된 적합도 함수로 평가하며, 국소적 구조가 중요한 도메인에서의 효과를 입증했습니다.
SUNTA는 예측 오차(놀라움)를 기반으로 비디오 시퀀스를 계층적으로 분할하는 새로운 HSSM 접근 방식을 제안합니다. 분리된 학습 전략을 통해 계층적 붕괴 문제를 해결하며, 장기 비디오 예측 성능을 획기적으로 개선했습니다.
Flow-matching 기반의 시각-언어-행동(VLA) 정책에서 모델 재학습 없이 테스트 시간 가이드를 적용하는 Guided Action Flow 프레임워크를 제안합니다. 동결된 SmolVLA 정책에 행동-청크 비평가를 결합하여 로봇 조작 작업의 성공률을 유의미하게 향상시켰습니다.
멀티모달 모델의 오디오 이해 및 생성을 위한 효율적인 vLLM 기반 추론 파이프라인을 제안합니다. 자기회귀 디코딩 확장과 온-GPU 음향 디코더 통합을 통해 단일 스트림 루프의 충돌 문제를 해결했습니다. 특히 CFG 구현 시 공동 스케줄링을 통해 처리량 저하 문제를 획기적으로 개선했습니다.
LLM 시스템에서 가드레일에 의한 차단과 모델 자체의 거부를 구분하는 블랙박스 정찰 방법론을 제안합니다. HTTP, 어휘, 타이밍 신호 모니터링을 통해 가드레일의 존재와 차단 카테고리를 높은 정확도로 탐지할 수 있음을 입증했습니다.
범용 LLM의 피트니스 코칭 한계를 극복하기 위해 개발된 도메인 특화 모델 FitOne을 소개합니다. Qwen3를 기반으로 3단계 사후 학습 파이프라인을 적용하여 전문 지식과 일반 역량을 동시에 강화했습니다.
확산 모델의 샘플링 효율을 높이기 위해 타임스텝 할당을 학습하는 연속 시간 제어 방식인 ART를 제안합니다. 강화학습의 액터-크리틱 알고리즘을 활용한 ART-RL을 통해 최적의 샘플링 스케줄을 도출하며, 기존 파이프라인 변경 없이도 높은 샘플 품질과 일반화 성능을 입증했습니다.
A$^{2}$utoLPBench는 역 KKT 조건을 활용하여 자동으로 생성되는 선형 계획법(LP) 벤치마크입니다. 정적 데이터셋의 한계인 데이터 유출 문제를 해결하고, 난이도 조절이 가능하며 정답이 보장된 에이전트 평가 환경을 제공합니다.
임상 추론 능력을 정밀하게 평가하기 위해 전문가가 작성한 루브릭 기반의 새로운 평가 데이터셋을 제안합니다. GPT, Claude, Gemini 등 주요 프런티어 모델을 테스트한 결과, 모델들이 중요도가 높은 임상적 결정 기준을 충족하는 데 큰 어려움을 겪고 있음을 발견했습니다.
신경망의 가중치 공간을 분석하기 위해 추론 과정의 순차적 특성을 반영한 동적 신경 그래프 인코더(DNG-Encoder)를 제안합니다. 이를 통해 암시적 신경 표현(INR)의 분류 성능을 기존 대비 약 10% 향상시켰습니다.
의료 영상 분할의 해석 가능성과 효율성을 높이기 위해 라디오믹스 특징을 통합한 RadiomicNet 아키텍처를 제안합니다. MobileNetV2 기반의 경량 구조와 Radiomics Attention Gate를 통해 높은 성능과 임상적 해석 가능성을 동시에 달성했습니다.