Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Skill0.5는 에이전트 강화학습(Agentic RL)의 기술 내재화와 외부화 사이의 딜레마를 해결하는 새로운 프레임워크입니다. 난이도 인지 라우터를 통해 일반 기술은 내재화하고 작업 특정 기술은 활용함으로써 분포 외 일반화 성능을 높입니다.
멀티 에이전트 시스템의 역할 변화 시 발생하는 구조적 결함을 해결하기 위한 '계약 보존형 역할 진화' 연구를 소개합니다. SERO 프레임워크는 다섯 가지 구조적 계약을 유지하며 역할을 자기 진화시키는 방식을 제안합니다.
DPO의 비대칭적 그래디언트 문제를 해결하기 위해 자기 적응형 계수를 도입한 AdaDPO를 제안합니다. 이 방식은 선호 응답과 비선호 응답 사이의 그래디언트 크기를 균형 있게 맞추어 모델의 학습 효율을 높입니다. 실험 결과 Llama-3-8B-Instruct 모델에서 기존 DPO보다 우수한 성능과 길이 편향 완화 효과를 입증했습니다.
비라틴 문자 기반 ASR 시스템의 오류 분석을 위해 품사(PoS) 기반의 자동 정렬 메커니즘을 제안합니다. 기존 도구의 한계를 넘어 언어 중립적인 정렬을 통해 다양한 문자 체계에서 정밀한 언어적 오류 분석을 가능하게 합니다.
핀란드어의 복잡한 형태음운론적 규칙을 처리하기 위해 코모나드(Comonad) 기반의 새로운 구성적 프레임워크를 제안합니다. 기존 FST의 상태 폭발 문제와 신경망의 설명력 부족을 해결하며, 대수적 구조를 통해 규칙의 구성성을 복원합니다.
기존 법적 판결 예측(LJP)의 한계를 극복하기 위해 검찰의 기소 및 불기소 결정을 예측하는 새로운 태스크인 PDP를 제안합니다. 4,630개의 실제 사례를 포함한 PDP-Bench를 구축하였으며, LLM이 기존 LJP보다 PDP에서 현저히 낮은 성능을 보임을 입증했습니다.
LLM이 생성한 코드의 기능적 정확성을 예측하기 위해 불확실성 정량화(UQ) 기술을 적용한 연구입니다. 기존 NLI 기반 방식의 한계를 극복하기 위해 코드 특화 방법론인 '기능적 엔트로피'를 제안하며, 다양한 벤치마크에서 우수한 성능을 입증했습니다.
기존 LLM 평가가 놓치기 쉬운 에이전트의 '확산적 사고'를 측정하기 위한 상호작용형 벤치마크 MUTATE를 제안합니다. 경로 및 행동 수준에서 창의적 추론을 평가하며, 모델의 행동 고착 문제를 해결하기 위한 ReDNA 프레임워크를 소개합니다.
어휘 의미 중의성 해소(WSD)를 위한 새로운 프랑스어 의미 태깅 코퍼스를 제안합니다. 20개의 다의 동사를 대상으로 병렬 코퍼스 번역, 계산 사전, 그리고 이를 결합한 세밀한 의미 레이블을 포함합니다.
ClinicalEncoder26AM은 임상 및 생물 의학 텍스트를 위한 다국어 진단 가능 ColBERT 모델입니다. BGE-M3를 기반으로 합성 데이터와 주석 리소스를 결합하여 임상 잠재 공간을 정렬하며, 높은 데이터 효율성과 최첨단 개체 재현율을 달성했습니다.
형식 수학 난제 해결을 위한 자기 진화형 과학 에이전트의 구성적 학습 행동(CLB)을 연구합니다. S2B-LM 벤치마크를 통해 CLB가 고난도 수학 증명 성능에 미치는 영향을 분석했습니다.
본 연구는 MLM 학습 시 무작위 마스킹 대신 엔트로피 분포를 활용한 토큰 마스킹 전략을 제안합니다. 불확실성이 높은 토큰을 타겟팅하여 학습 효율을 높이며, GLUE 벤치마크에서 성능 향상을 입증했습니다.
GUI 에이전트의 세상 지식 부족 문제를 해결하기 위해 인과적 내재화와 밀도 인식 예시 재선택을 활용한 미드 트레이닝 방법론 GUI-CIDER를 제안합니다. 이 방식은 단순한 궤적 암기를 넘어 GUI 조작에 대한 명시적 지식 습득을 목표로 합니다.
부분적으로만 검증 가능한 작업에서 LLM의 성능을 높이기 위한 Soft-RLVR 및 Soft-SVeRL 프레임워크를 제안합니다. 체크리스트 기반의 소프트 보상을 통해 희소한 보상 신호를 밀도 높은 부분 점수로 전환하며, 자기 검증 시 발생하는 보상 인플레이션을 방지하는 안정화 기법을 다룹니다.
LLM이 문화적 차이를 인식하지 못하는 문제를 해결하기 위해 문화적 결합(cultural binding)을 담당하는 특정 어텐션 헤드를 식별한 연구입니다. 연구 결과, 문화적 결합은 사전 학습 단계에서 형성되며, 특정 헤드를 제어함으로써 중립성을 유지하면서도 문화적 차별화 정확도를 높일 수 있음을 확인했습니다.
검색 증강 LLM(RAG)의 인용 신뢰성을 측정하기 위한 대규모 데이터셋 CITETRACE와 평가 프레임워크를 제안합니다. 연구 결과, 모델이 실제 출처를 인용하면서도 내용을 왜곡하는 '검증된 오도(VM)' 현상과 충실도-적합성 간의 트레이드오프를 발견했습니다.
MLLM 기반 모바일 에이전트의 과잉 실행과 과잉 요청 문제를 해결하기 위한 신뢰도 통합 프레임워크 Mobile-Aptus를 제안합니다. SFT와 DPO를 결합하여 에이전트가 스스로 작업 수행 가능 여부를 판단하고 최적의 시점에 인간과 상호작용하도록 설계되었습니다.
Graph RAG 시스템이 지식 그래프의 구조적 정보를 유출할 수 있는 새로운 보안 취약점을 분석한 연구입니다. 공격자가 블랙박스 상호작용을 통해 그래프의 노드 속성과 토폴로지를 90% 이상 재구성할 수 있음을 입증했습니다.
문학 텍스트 내 인물 간 상호작용과 텍스트적 맥락을 동시에 학습하는 GraphLit 프레임워크를 제안합니다. 이종 그래프를 활용한 자기지도 학습을 통해 기존 모델보다 뛰어난 문학적 맥락 이해 성능을 입증했습니다.
예측 시장의 트레이더 코멘트에서 방향성 입장을 탐지하는 연구를 소개합니다. RoBERTa-base 모델을 활용하여 시장 문맥과 Anthropic API 기반의 반사실적 증강(Counterfactual Augmentation)이 성능에 미치는 영향을 분석했습니다.