Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 연구는 LLM이 오해의 소지가 있는(misleading) 의료 상황에서 얼마나 정확한 판단을 내리는지 평가하기 위해 MedMisBench를 개발했습니다. 기존 벤치마크가 모델의 지식 측정에만 초점을 맞춘 반면, 본 연구는 적대적 문맥 하에서의 '인식적 회복탄력성'을 측정합니다. 테스트 결과, LLM은 오해의 소지가 있는 문맥에서 정확도가 크게 떨어지는 등 취약성을 보였습니다.
본 논문은 멀티모달 검색을 통한 증강 생성(MAGMaR) 워크숍의 공동 과제 결과를 보고합니다. 참가자들은 비디오 검색 또는 검색된 비디오 기반 기사 접지 생성 시스템에 초점을 맞췄습니다. 제출된 모든 시스템은 작년 우승작 기준선을 능가하는 성과를 보였습니다.
본 논문은 도메인별 미세 조정된 LLM의 안전성 저하 문제를 해결하기 위해 ALIGNBEAM을 제안합니다. 이는 훈련 과정 없이 디코딩 단계에서 앵커 로짓을 타겟 모델 어휘로 번역하여 적용 가능하며, 작은 심사관(judge)이 가장 안전한 후보를 선택하는 방식으로 작동합니다.
본 논문은 검증 가능한 환경(Verifiable Environment)을 재귀적으로 합성하여 LLM의 추론 일반화 능력을 향상시키는 프레임워크 RACES를 제안합니다. RACES는 환경의 공역과 정의역 일치를 통해 빌딩 블록들을 자동으로 융합하며, 이를 통해 효율적인 방식으로 다양한 추론 패턴을 유도할 수 있습니다.
본 논문은 현대 LLM 학습 파이프라인의 복잡하고 재귀적인 의존성 구조 문제를 다룹니다. 연구진은 ModSleuth라는 에이전트 시스템을 개발하여, 소스 기반 증거를 통해 공개 아티팩트 전반에 걸친 LLM 의존성 그래프를 재구성하는 방법을 제시했습니다. 이를 통해 대규모 모델 생태계의 투명한 분석과 잠재적 문제를 발견할 수 있습니다.
본 보고서는 고전 중국어 시 번역 및 감정 이해 분야의 한계를 극복하고자 합니다. 연구진은 49,404개의 고품질 데이터셋(CCPoetry-49K)을 구축하고, 이를 활용하여 Qwen2.5-14B 모델에 LoRA 미세 조정을 적용한 'PoetryQwen'이라는 도메인 특화 LLM을 제안했습니다. 실험 결과, PoetryQwen은 기존 모델 대비 성능 향상을 입증하며 해당 분야의 새로운 방법론적 기반을 제시합니다.
본 논문은 Mixture-of-Experts (MoE) 모델의 핵심 구성 요소인 라우터(Router)를 재설계하는 방법을 제안합니다. 기존 방식의 한계를 극복하기 위해, 각 라우터 행을 해당 전문가의 주 성분 방향과 정렬시키는 것이 목표입니다. 이를 위해 Manifold Power Iteration (MPI)이라는 새로운 패러다임을 도입하여 MoE 모델의 성능 향상을 입증했습니다.
본 연구는 코드 합성 및 텍스트 요약 같은 개방형 생성 작업에서 자기일관성을 다룹니다. 기존의 정확한 일치 기반 방식의 한계를 극복하기 위해, 임베딩 공간에서 샘플링된 생성을 클러스터링하여 일치성을 추정하는 EBA(Embedding-Based Agreement) 방식을 제안합니다. 실험 결과, 이 방법은 개방형 작업에 강력하고 확장 가능한 신호임을 입증했습니다.
본 논문은 보호 속성에 직접 접근할 수 없는 실제 환경에서의 편향 제거 방법을 제안합니다. H-SAL이라는 프레임워크는 자기 설명 텍스트를 활용하여 사후 개념 및 속성 지우기를 수행하며, 이를 위해 다중 도메인 Stack Exchange 기반의 공정성 벤치마크를 도입했습니다. 연구 결과, 암묵적인 자기 설명이 명시적 레이블 기반 방법과 유사하거나 더 나은 성능을 보였습니다.
LLM이 수학 문장제를 다양한 언어와 문화로 조정할 때 발생하는 문화적 다양성 붕괴 현상을 분석한 연구입니다. Claude Opus 4, GPT-4.1, Gemini 2.5 Pro를 대상으로 엔티티 변환 양상을 조사한 결과, 모델들이 문화적 맥락을 보존하기보다 압축하거나 잘못 할당하는 경향을 확인했습니다.
소셜 미디어 텍스트에서 인간의 가치 표현을 측정하기 위해 LLM 주석과 인코더 모델 전이 기법을 연구합니다. 이론적 정의를 통해 LLM의 가치 귀속 오류를 줄이고, 프롬프트 보정과 소프트 라벨 학습을 통해 전문가 수준의 정렬을 달성하는 방법을 제안합니다.
CoT 미세 조정이 하이브리드 선형 어텐션 모델의 장기 문맥 회상 능력을 저하시키는 현상을 분석하고, 이를 해결하기 위한 QK-Restore 방법론을 제안합니다. QK-Restore는 추가 훈련 없이 쿼리-키 투영을 복구하여 추론 성능과 장기 기억력을 동시에 유지합니다.
Data2Story는 전문화된 에이전트들을 조율하여 데이터를 검증 가능한 멀티모달 스토리로 변환하는 멀티 에이전트 프레임워크입니다. 모든 주장을 데이터 및 외부 참조와 연결하여 투명성을 확보하며, 인터랙티브 지도와 오디오 등 멀티모달 요소를 생성합니다.
대규모 추론 모델(LRM)이 추론 성능 향상 과정에서 기존 지시어 튜닝 모델의 정렬(alignment) 특성을 상실하는 현상을 연구했습니다. 실험 결과, 추론 능력은 개선되지만 독성 증가 및 편향 증폭과 같은 정렬 퇴보가 관찰되었습니다.
LLM이 사용 언어에 따라 행동 양식이 왜곡되는 '시볼렛 효과'를 연구한 논문입니다. 지정학적 워게임을 통해 GPT-4o, Llama-4, DeepSeek-R1 등 주요 모델의 언어별 강압적 수사 및 양보율 변화를 분석했습니다.
대화형 에이전트 평가의 한계를 극복하기 위한 새로운 시뮬레이션 툴킷 VISTA를 제안합니다. UI와 API 상호작용을 모두 지원하는 하이브리드 시뮬레이터를 통해 에이전트의 역량과 실패 모드를 더욱 현실적이고 포괄적으로 평가할 수 있습니다.
전이중(Full-duplex) 음성 모델의 상호작용성을 개선하기 위한 강화학습 기반의 사후 훈련 정렬 방법을 제안합니다. 일시 정지, 발화 전환, 맞장구, 사용자 중단 등 네 가지 핵심 축을 최적화하여 자연스러운 대화 흐름을 구현합니다.
EinsteinArena는 에이전트들이 실시간으로 문제를 해결하고 토론하며 협력할 수 있는 에이전트 네이티브 플랫폼입니다. 이 플랫폼을 통해 에이전트들은 집단 지성을 발휘하여 키싱 넘버 문제와 같은 수학적 난제에서 새로운 최첨단(SOTA) 결과를 도출했습니다.
WebChallenger는 모델 규모 대신 아키텍처 설계를 통해 효율적인 웹 탐색을 구현하는 에이전트 프레임워크입니다. PageMem을 기반으로 선택적 주의, 지속적 기억, 절차적 유창성을 모방하여 오픈 웨이트 모델로도 높은 성능을 냅니다.
수능 수학 문제를 활용한 새로운 추론 벤치마크 KCSAT-ML을 소개합니다. 전국 단위 코호트의 오답률 데이터를 기반으로 모델의 추론 능력을 인간의 난이도 체계와 비교 분석하는 DRG 메트릭을 제안합니다.