Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 연구는 LLM 등 생성형 AI 모델의 신뢰성 확보에 필수적인 평가 과정에서 발생하는 재현성 위기를 다룹니다. 기존 방식은 인간 평가자의 주관적 편향과 변동성을 충분히 고려하지 못하며, 이는 실험 결과의 반복 가능성을 저해합니다. 이에 본 연구는 어노테이터의 행동을 현실적으로 모델링하기 위해 다층적 부트스트래핑(multi-level bootstrapping) 접근 방식을 제안하고, 데이터셋을 활용하여 통계적 유의성 확보에 필요한 항목 수($N$)와 항목당 응답 수($K$) 간의 트레이드오프를 분석합니다.
에이전트적 진화(Agentic evolution)는 후보 생성, 평가, 피드백을 통해 솔루션을 개선하는 강력한 패러다임이지만, 기존 방법들은 경직된 수동 설계 절차를 따르거나 장기적인 경로 이탈 위험이 있는 범용 에이전트로 구현되어 증거 정리 및 진화 주도 메커니즘에 안정적인 인터페이스가 부족하다. 본 논문은 이러한 한계를 해결하기 위해 '상호작용형 환경'을 공식화하고, 축적된 진화 컨텍스트를 프로세스 수준의 상태로 활용하는 AEvo라는 제어된 메타 편집(meta-editing) 프레임워크를 제안한다. AEvo는 메타 에이전트가 다음 후보를 직접 제안하는 대신, 향후 진화를 제어하는 절차나 에이전트 컨텍스트 자체를 편집함으로써 절차 기반 및 에이전트 기반 진화 모두를 조종하며 뛰어난 성능을 입증했다.
본 연구는 프롬프트된 언어 모델(Prompted Language Models)을 분류기로 사용하는 것이 제한적인 데이터 도메인에서 분류를 가능하게 하지만, 미세 조정(Fine-tuning)의 이점을 일부 놓친다고 지적합니다. 여러 분류 작업에 대해 훈련하는 것이 새로운 도메인에서의 성능 향상을 가져오며, 이는 인접한 도메인으로 부분적으로 일반화됨을 보여줍니다. 또한, 모델이 프롬프트를 따르지 못하는 에지 케이스를 식별하고, 일반적인 지시 이행 훈련과 분류 훈련을 혼합하여 이러한 일반화 실패를 완화할 수 있음을 제안합니다.
본 논문은 연속 함수의 수치적 최적화에 사용되는 차분 진화(DE) 알고리즘을 사원수 공간으로 확장한 새로운 QDE(Quaternion-Valued Differential Evolution) 알고리즘군을 제안합니다. 이 알고리즘군은 사원수의 대수적 및 기하학적 특성을 활용하는 여러 변이 전략을 포함하며, BBOB 벤치마크에서 기존의 실수 값 기반 DE보다 더 빠른 수렴 속도와 우수한 성능을 입증했습니다.
본 논문은 동일한 관찰(데이터)을 공유함에도 불구하고 사람들이 서로 다른 결론에 도달하는 현상을 상대방의 인지적 결함이 아닌, 추론 및 학습 과정 자체에 내재된 '비식별성(Non-identifiability)' 문제로 설명합니다. 이 비식별성은 추론 설정($ heta$)의 차이에서 오는 $ heta$-수준과, 반복적인 데이터 노출 및 업데이트 규칙으로 인해 세계 모델($W$) 자체가 분리되는 $W$-수준 두 가지 방식으로 체계화됩니다. 연구진은 이를 분석하기 위해 Reference, Exploration, Stabilization, Horizon 등으로 구성된 추론 프로필 $ heta$를 도입하고, AI 규제 논쟁 등 실제 사례에 적용하여 그 의미를 확장합니다.
본 논문은 기존 GUI 에이전트가 장기 과제에서 취약한 모델 중심적 상호작용 패러다임을 개선하기 위해 '실행 가능한 에이전트 메모리(EAM)'라는 구조화된 지식 그래프를 제안합니다. EAM은 상태 인식 DFS와 행동 그룹 마이닝을 통해 다단계 루틴을 압축하는 효율적인 메모리 구축 파이프라인을 포함합니다. 또한, Q-함수 모델 기반의 가치 안내 그래프 탐색을 도입하여 계획의 정확성을 높이고, AndroidWorld 등 실증 환경에서 기존 최신 모델 대비 높은 성능과 낮은 비용(GPT-4o 대비 6배 절감)을 입증했습니다.
본 논문은 결측 데이터 이론과 부분 관측 마르코프 결정 과정(POMDPs)을 통합한 새로운 하위 클래스인 missingness-MDPs (miss-MDPs)를 제안합니다. miss-MDP는 특정 시점에서 상태 특징이 누락될 확률을 지정하는 POMDP입니다. 연구진은 행동-관측 궤적 데이터셋에서 미지의 결측 함수를 학습하여, 근사적으로 정확한(PAC) 알고리즘을 통해 최적의 정책을 계산하는 방법을 제시합니다.
본 기사는 과학 논문의 인용 그래프가 누락된 연결로 인해 파편화되는 문제를 해결하기 위한 하이브리드 프레임워크를 제안합니다. 이 프레임워크는 인용 토폴로지 정보와 LLM 기반의 텍스트 유사성을 결합하여 의미론적 에지를 추가하고 기존 인용에 가중치를 부여함으로써 그래프를 증강합니다. 이를 통해 학문적 동질성을 유지하면서 파편화를 효과적으로 감소시키고, 구조적 해석 가능성을 갖춘 다중 스케일 조직화가 가능한 지표를 제공합니다.
본 논문은 무작위 지연이나 교차 태스크 환경에서 행동-상태 피드백의 시간적 대응 관계가 약화되는 문제를 해결하기 위해, 암시적 인과 그래프 모델링 기반의 전이 가능한 지연 인식 강화학습 방법을 제안합니다. 이 방법은 필드-노드 인코더와 메시지 전달 메커니즘을 사용하여 고차원 관측값에서 노드 수준의 의미를 가진 잠재 상태와 동적 인과 의존성을 학습합니다. 이를 통해 구조적 표현 및 환경 역학 지식을 습득하고, 상상 기반 행동 학습 및 계획을 통합하여 교차 태스크 전이와 빠른 적응 성능을 입증했습니다.
PriorZero는 LLM의 언어적 사전 지식과 세계 모델(World Model) 기반 계획을 결합하여 강화 학습 에이전트의 성능을 높이는 통합 프레임워크입니다. 기존 방식의 한계인 사전 지식과 환경 역학 간의 불일치를 해결하기 위해, MCTS 루트 노드에만 사전 지식을 주입하고 세계 모델 학습과 LLM 미세 조정을 분리하는 설계를 채택했습니다. 이를 통해 탐색 효율성과 최종 성능을 모두 개선하며 다양한 벤치마크에서 그 효과를 입증했습니다.
본 논문은 제약 조건이 여러 개의 분리된 구성 요소로 이루어진 복잡한 매니폴드 상의 샘플링 문제를 해결하기 위해 MASEM (Manifold Sampling via Entropy Maximization)이라는 방법을 제안합니다. 이 방법은 k-최근접 이웃 밀도 추정 기반으로 경험적 분포의 엔트로피를 최대화하는 재샘플링 기법을 사용합니다. 연구진은 평균장 분석을 통해 MASEM이 목표 분포와 경험적 분포 간의 KL-발산을 지수적으로 감소시키며, 로보틱스 벤치마크 등에서 기존 방법 대비 뛰어난 효율성과 성능을 입증했습니다.
본 논문은 언어 모델의 안전 정렬 문제를 밀도 비율 매칭(density ratio matching) 문제로 단순화하는 Bregman Safety Optimization (BSO)을 제안합니다. BSO는 복잡한 다단계 파이프라인이나 보조 모델 없이, 단일 단계 손실 함수를 통해 최적의 안전 정책을 증명 가능하게 회복할 수 있게 합니다. 이 방법은 기존 선호 최적화(preference optimization)를 확장하면서도 범용성을 유지하며, 안전성-유용성 트레이드오프 개선에 효과적임을 입증했습니다.
LLM이 장기 정보 축적 및 에이전트 시스템에서 효율적으로 작동하기 위해 $δ$-mem이라는 경량 메모리 메커니즘을 제안합니다. 이 방법은 고정된 Full-attention 백본을 델타 규칙 학습으로 업데이트되는 고정 크기의 상태 행렬로 보강하여 과거 정보를 압축합니다. $δ$-mem은 생성 과정 중 어텐션 계산에 저차원 수정을 적용함으로써, 적은 메모리 상태만으로도 기존 모델 대비 높은 성능 향상을 달성하며 특히 메모리 집약적인 벤치마크에서 큰 이점을 보여줍니다.
본 기사는 언어 모델 사후 학습 시 데이터 할당의 효율성을 높이는 '보상 밀도(reward-density)' 원칙을 제시합니다. 기존 방식이 간과했던 이 원칙은 희소한 시퀀스 수준 보상은 탐색에, 조밀한 토큰 수준 교사 보상은 행동 압축에 사용해야 함을 강조합니다. 연구진은 Qwen3 및 Llama 모델을 사용하여 검증 가능한 수학 문제에서 '브릿지(Bridge)'를 통한 증류 방식이 기존의 직접적인 GRPO보다 성능이 우수하며, 특히 학생 측 희소 RL 적용 전후로 그 효과가 극대화됨을 입증했습니다.
본 글은 LLM의 적응성 문제를 다루며, 기존의 파라미터 업데이트 방식(치명적 망각 위험)과 인컨텍스트 학습(성능 한계)의 단점을 극복하는 새로운 'fast-slow 학습 프레임워크'를 제안합니다. 이 프레임워크는 모델 매개변수를 '느린 가중치'(Slow Weights, 일반 추론 담당)와 최적화된 컨텍스트로부터 학습되는 '빠른 가중치'(Fast Weights, 태스크 특화 정보 흡수 담당)로 분리하여 관리합니다. Fast-Slow Training (FST)은 높은 샘플 효율성과 성능 점근선을 유지하면서도 치명적 망각을 최소화하고 지속적인 학습 능력을 보존하는 것이 핵심입니다.
본 연구는 미생물 공동체의 속성을 구성원들의 원시 DNA 서열만으로 예측할 수 있는지 탐구합니다. 세트 집계 게놈 임베딩(SAGE)과 게놈 언어 모델(GLMs)의 소수 샷 학습 능력을 활용하여, 미생물 공동체 수준의 풍부도 프로파일을 예측하는 새로운 접근 방식을 제시했습니다. 이 방법은 기존 생물정보학적 방법론 대비 개선된 일반화 성능을 보였으며, 공동체 수준 잠재 표현이 성능 향상에 기여함을 입증했습니다.
KAN-CL은 Kolmogorov-Arnold Networks(KANs)의 스플라인 파라미터화 특성을 활용하여 지속 학습 시 발생하는 치명적 망각 문제를 해결하는 새로운 프레임워크입니다. 매듭(Knot) 단위의 세밀한 중요도 가중 앵커링과 백본 정규화(bbEWC)를 결합하여, 기존 방식 대비 망각을 획기적으로 감소시키고 높은 정확도를 유지합니다.
AI 시스템의 투명성과 신뢰성을 높이기 위해 특징 집합의 그래프 이론적 정식화를 활용한 새로운 XAI 알고리즘인 FAMeX를 제안합니다. FAMeX는 특징 간의 연관성을 기반으로 하는 Feature Association Map(FAM)을 모델링의 기초로 삼습니다. 실험 결과, FAMeX는 분류 작업에서 기존의 PFI 및 SHAP보다 우수한 특징 중요도 측정 성능을 보여주었습니다.
본 논문은 멀티모달 대규모 언어 모델(MLLM)의 시각 잠재 추론 과정에서 발생하는 불안정성을 진단하고, 이를 해결하기 위한 새로운 프레임워크인 GAP (Granular Alignment Paradigm)를 제안합니다. 기존 방법들이 특징 공간 불일치로 인해 신뢰도가 떨어지는 문제를 안고 있었는데, GAP는 세 가지 수준(특징, 컨텍스트, 용량)에서 시각 잠재 추론을 정렬하여 모델의 성능과 안정성을 크게 향상시킵니다.
본 논문은 이산 액션 공간을 가진 강화학습(RL) 작업에서 온라인 미세 조정을 수행하는 새로운 방법인 DRIFT를 제안합니다. DRIFT는 오프라인으로 사전 학습된 연속 시간 마르코프 체인(CTMC) 정책을 장점 가중 이산 흐름 매칭 손실로 업데이트하여, 유용한 기존 지식을 보존하면서도 새로운 상호작용으로부터 성능을 개선할 수 있게 합니다.