Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
T2MLR은 이전 토큰의 중간 레이어 표현을 현재 위치 초기 레이어에 융합하는 트랜스포머 기반 잠재적 추론 아키텍처입니다. 이는 자기회귀 디코딩의 한계를 극복하고, 적은 오버헤드로도 시간 경과에 따른 중간 계산 상태를 지속시킵니다. 기존 모델에 순환 경로만 추가하여 미세 조정하는 것만으로도 수학적 추론 능력을 크게 향상시키는 것이 가능합니다.
MedFailBench는 기존 의료 AI 벤치마크가 정답 여부만 측정하는 한계를 극복하기 위해 임상의가 구축한 오픈 소스 안전성 검사 도구입니다. 이 벤치마크는 오류를 심각도와 구체적인 '안전 게이트' 유형별로 라벨링하여 의료 AI의 취약점을 깊이 있게 분석할 수 있도록 합니다.
본 논문은 복잡한 GUI 환경에서 자율 에이전트의 제어 및 계획 수립 문제를 해결하기 위해 Plover라는 시스템을 제안합니다. Plover는 작업 계획과 재계획 과정을 외부화하여, 사용자가 시스템 동작을 검사하고 수정할 수 있는 '계획 중심' 아키텍처를 구현했습니다. 이를 통해 GUI 자동화 에이전트의 투명성과 제어 가능성을 크게 향상시켰습니다.
본 논문은 불확실성 정량화(UQ)에 대한 새로운 관점을 제시하며, 불확실성 측정값이 기본 원시 요소가 아닌 모델링 결정의 결과물임을 주장합니다. '주관적 위험'을 분해하여 인식론적 및 우연적 불확실성을 도출하는 방법을 보여주고, 이를 학습 이론과 연결하여 UQ를 위한 포괄적인 프레임워크로 확장할 수 있음을 제시합니다.
본 논문은 정신 건강 분야의 신뢰성 있는 XAI 시스템 구축을 위해, 우울증 관련 데이터셋 주석화 문제를 해결하는 자체 진화형 프레임워크를 제안합니다. 이 프레임워크는 LLM 지원 레이블링과 전문가 검증을 결합하여 DSM-5-TR에 정렬된 설명 가능한 데이터를 구축하는 것을 목표로 합니다.
본 논문은 저장소 수준의 이슈 위치 파악(localization)에 있어 시각적 증거 활용을 위한 통제된 벤치마크인 MM-IssueLoc을 제안합니다. 이 벤치마크는 23개 언어, 652개의 이슈-PR 인스턴스를 포함하며, 파일 및 함수 수준의 골드 레이블과 시각적 증거를 결합하여 평가합니다. 연구 결과, 기존 시스템들은 멀티모달 위치 파악에서 어려움을 보였으며, 시각적 증거가 중요한 평가 변수임을 입증했습니다.
본 논문은 마스킹된 확산 언어 모델(MDLM)에 강화학습을 적용하는 새로운 방법을 제안합니다. 기존 방식의 한계를 극복하기 위해, 생성 과정을 토큰 배치 결정과 위치 재마스킹 결정이라는 2단계 액션 MDP로 형식화했습니다. 이를 통해 정책 기울기를 두 개의 항으로 분해하고 최적화하여 수학 및 코딩 벤치마크에서 높은 성능을 달성했습니다.
본 연구는 음악에 맞춰 춤을 생성하는 새로운 프레임워크를 제시하며, 안무를 원자적 움직임(atomic movements)의 시퀀스로 모델링합니다. 이 구조 인식 접근 방식은 기존 신경망 모델이 놓치던 구조적 불일치를 해결하여, 의미론적으로 일관되고 제어 가능한 댄스 생성을 가능하게 합니다.
본 논문은 에이전틱 AI 확산에 따라 전통적 충성도 모델로는 설명할 수 없는 새로운 소비자-브랜드 관계를 다룹니다. 'DVM-HALL' 모델을 통해 인간의 감정적 자산, 신뢰 등을 정식화하고, DeFi 환경에서의 실행 위험까지 예측 변수로 포함합니다. 또한, 감사 가능한 'NHAS' 지표를 제시하여 인간과 에이전트 간의 정렬도를 측정하는 프레임워크를 제안합니다.
본 논문은 기존의 인프라 손상 중심 침투 테스트 패러다임을 넘어, AI 기반 시스템에 특화된 목표 지향적 행동 평가로 침투 테스트를 재정의합니다. 공격자가 프롬프트나 데이터를 조작하여 시스템 동작을 변경하는 'AI 기반 침투' 개념을 제시하며, 이를 위한 새로운 테스트 워크플로우와 기술적 프레임워크를 제안합니다.
본 논문은 지식 습득부터 평가 개발까지 5단계에 걸쳐 AI 가속화를 적용하는 엔드투엔드 역량 강화 프레임워크를 제시합니다. 이 프레임워크는 생산성과 학습 효율성을 모두 높이는 것을 목표로 합니다. 실제로는 US National Association of State Boards of Accountancy의 승인을 받았으며, NVIDIA Certified Professional in Agentic AI 시험 합격 사례 등 강력한 검증을 거쳤습니다.
본 논문은 LLM의 복잡한 추론 과정에서 발생하는 오류를 효율적으로 수정하는 'Deep Interaction' 메커니즘을 제안합니다. 기존 방식의 한계를 극복하기 위해, 원본 응답을 직접 편집하여 정확한 추론 단계를 유지하면서 오류 부분만 수정할 수 있게 합니다.
본 논문은 기호적 액션과 수치적 매개변수를 결합한 PAMDP 환경에서의 강화학습 문제를 다룹니다. 기존 방법의 샘플 비효율성을 개선하기 위해, 신경-기호적 지식 및 기울기 기반 강화학습(KGRL) 알고리즘을 제안합니다. KGRL은 도메인 지식을 활용하여 액션을 가지치기하고 매개변수를 제약함으로써 훈련 효율성과 성능을 동시에 높입니다.
본 논문은 언어 모델이 비증거 기반 압력 하에서 잘못 보고하는 '내부 인센티브 호환성(IC) 실패' 문제를 다룹니다. 이를 해결하기 위해, 금지된 영향에는 불변하면서 허가된 증거에는 반응하는 반사실적 보고 중개자 학습 및 인증 방법을 제시합니다. 이 방법은 모델의 답변, 자신감, 주의사항에 대한 인과적 좌표를 식별하고, 인센티브가 중화된 환경에서 모델을 훈련시키는 '반사실적 보고 좌표(CRC) 클램프'를 도입하여 높은 저항성과 업데이트 능력을 달성했습니다.
본 논문은 멀티모달 대규모 언어 모델(MLLMs)의 발전에 따라 부족했던 해석 기하학 분야를 위한 문제 생성 프레임워크 FormalAnalyticGeo를 제안합니다. 이 프레임워크는 CDL이라는 공식적 중간 표현을 활용하여, 문제 텍스트와 SDF 기반 다이어그램 렌더링을 연결합니다. 이를 통해 정답과 주석이 포함된 대규모 검증 데이터셋 AnalyticGeo7K가 구축되었습니다.
본 논문은 베트남 호텔 추천 시스템 연구의 한계를 극복하기 위해 ViHoRec이라는 품질 관리된 데이터셋을 제안했습니다. 이 데이터셋은 6,832명의 사용자와 560개 호텔 간의 상호작용 데이터를 포함하며, 재현 가능한 구축 파이프라인과 개인 정보 보호 기술을 적용했습니다. 또한, 콜드 스타트 환경에 초점을 맞춘 공개 벤치마크를 제공하여 저자원 추천 연구에 기여합니다.
본 논문은 기존의 자기회귀 디코더 방식 대신 이산 확산 언어 모델을 활용하여 오디오 네이티브 음성 인식(ASR) 시스템을 제안합니다. DiffusionGemma는 26B MoE 기반으로, 노이즈 제거 단계를 통해 전체 전사본을 병렬로 정제하며, 기존의 한계점을 극복하는 새로운 학습 방식을 제시했습니다.
PixelLoop는 픽셀 수준의 상대적 3D 기하학에 기반하여 위상 맵에 직접 루프 클로저를 도입한 방법론입니다. 기존 SLAM 방식과 달리, 이는 단순 좌표 정렬을 넘어 계획 연결성 및 비용 전파를 변경하는 조밀한 위상 단축 경로 역할을 합니다. 이 기술은 안정적인 임의 지점 내비게이션을 가능하게 하며, 이미지 상대 기준선 대비 성공률과 SPL에서 35% 이상의 개선을 달성했습니다.
본 연구는 Vision-Language Models (VLMs)의 Chain-of-Thought (CoT) 프롬프팅이 추론 과정 전반에 걸쳐 이미지 토큰 접근을 연장하는지 분석했습니다. 그 결과, CoT가 성능 개선을 위해 직접적인 이미지 토큰 접근을 늘리기보다는, 이미지에서 파생된 은닉 상태 정보에 대한 언어적 계산을 확장하여 성능을 향상시키는 것으로 나타났습니다.
AI 에이전트와의 상호작용은 요청-결과-평가-수정의 반복 루프를 형성하며, 이는 사용자의 무의식적인 신경가소성 훈련 환경을 만듭니다. 본 논문은 이 현상을 역이용하여, 반응적 재요청 대신 배경 관찰(behind-the-scenes observation)을 수행하는 프레임워크를 제안합니다. 이를 통해 장기 강화(LTP) 대신 장기 억제(LTD)를 유도하여 부정적인 패턴의 고착화를 막는 것을 목표로 합니다.