Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
대화형 에이전트의 메모리 유형이 응답 품질에 미치는 영향을 분석한 연구입니다. 메모리의 기능적 역할에 따른 분류 체계를 제시하고, 사용자 중심의 평가 프레임워크를 통해 메모리 유형이 응답의 정확성과 개인화에 미치는 차별적 효과를 규명합니다.
인도 마니푸르 지역의 저자원 언어인 Tangkhul-English 간의 신경망 기계 번역 연구를 다룹니다. ByT5-large와 mT5-small 모델을 활용하여 성능을 비교하고, 데이터 부족 및 도메인 편향 문제를 분석합니다.
Sarashina2.2-TTS는 일본어의 한자 다음(Kanji Polyphony) 문제를 해결하기 위해 설계된 LLM 기반 TTS 시스템입니다. 대규모 데이터 스케일링과 상용 한자를 포함한 타겟 데이터 증강을 통해 높은 읽기 정확도와 제로샷 화자 유사도를 달성했습니다.
영어로 번역된 불교 삼장(Tipitaka) 전체를 대상으로 계산 스타일로메트리 분석을 수행한 연구입니다. Zipf 분포, 어휘 다양성(MATTR), 숫자-단어 밀도 등을 통해 경, 율, 논의 언어적 특성과 번역 간의 차이를 규명했습니다.
문학 작품을 임베딩 공간의 점으로 간주하여, 원작에서 속편으로의 변화를 기하학적 연산으로 분석하는 연구입니다. PCA를 통해 문학적 변환을 해석 가능한 축으로 분해하여 작품의 구조적 변화를 정량화합니다.
다국어 대규모 언어 모델(LLMs)의 독성 탐지 및 완화 전략을 종합적으로 조사한 연구입니다. 언어적·문화적 맥락에 따른 안전성 불균형 문제를 다루며, 다양한 위협 모델과 완화 기술을 분류합니다.
체코어 텍스트의 상호 참조(Coreference) 및 담화 관계(Discourse Relations)를 분석하기 위한 두 개의 새로운 코퍼스를 소개합니다. 주석자 간의 불일치와 그 근거를 포함하여 텍스트 이해의 개인차와 모호성을 탐구합니다.
LLM 에이전트의 월드 모델링을 위해 단순한 다음 관측 예측 대신, 에이전트의 의사결정에 필요한 역학을 포착하는 AAWM 방식을 제안합니다. 실험을 통해 의사결정 지향적 학습 목표가 기존 방식보다 더 효과적인 학습 신호를 제공함을 입증했습니다.
확산 기반 TTS 모델의 급격한 운율 및 피치 변화 모델링 문제를 해결하기 위해 적응형 진동 유도 편향을 도입한 OscillaTTS를 제안합니다. 선형 바이패스를 통해 신호 안정성을 유지하며 제어 가능한 주기적 변조를 구현하여 음성 표현력을 높였습니다.
본 연구는 일본어 방언을 대상으로 LLM과 SLM의 방언 강건성을 평가합니다. 실험을 통해 SLM의 강건성이 텍스트 기반 모델의 성능과 상관관계가 있음을 밝히고, 방언 데이터 학습 및 음성 인코더 미세 조정이 성능 향상에 기여함을 입증했습니다.
PolicyAlign은 고품질 감독 데이터 없이 자연어 정책만으로 LLM을 안전하게 정렬하는 새로운 프레임워크를 제안합니다. 정책 위반 지시문을 합성하고 온-정책 자기 증류를 통해 모델의 안전성을 높이며, 일반적인 성능 저하를 최소화합니다.
Speech LLM 구축 시 발생하는 음성 인코더와 LLM 간의 구조적 불일치를 해결하기 위한 연구입니다. 음성 번역 목적 함수를 사전 학습에 통합하여 언어 불가지론적 표현을 학습함으로써 교차 모달 통합 성능을 개선합니다.
LLM 에이전트의 스캐폴딩인 하네스 설계와 사후 학습 간의 상호작용을 분석한 연구입니다. 하네스를 제어 가능한 설계 차원으로 취급하여, 환경 변화(OOD) 상황에서도 에이전트가 견고하게 적응할 수 있는 하네스 인지적 사후 학습의 중요성을 입증합니다.
언어 모델의 메모리 손실이 잘못된 결론을 확신하게 만드는 '취약한 메모리(brittle memory)' 현상을 분석합니다. 근거를 유지하고 결론을 버리는 '근거 우선 정책(source-first policy)'을 통해 메모리 압축 시에도 교정 가능성을 회복할 수 있음을 입증했습니다.
학습 알고리즘의 일반화 능력을 샘플별 전이 거리로 측정하는 'Generalization Spectrum' 프레임워크를 제안합니다. 기존의 단일 점수 평가 방식에서 벗어나, 학습된 지식이 얼마나 멀리 확장되는지를 다각도로 분석합니다.
본 연구는 라벨이 없는 데이터를 활용하여 중국어 자기지도 음성 모델이 방언의 조음 특징을 어떻게 표현하는지 분석합니다. 언어 중립적 프로빙 파이프라인을 통해 방언별 조음 특징의 해독 가능성과 층별 표현 역학의 차이를 규명했습니다.
LLM 탈옥 및 프롬프트 주입 판정에 사용되는 자동화된 판정관(Automated Judge)의 신뢰성을 검증한 연구입니다. 전용 분류기와 LLM-as-a-judge가 각각 과잉 탐지 및 불안정한 재현율 문제를 겪으며, 적대적 공격에 취약함을 밝혀냈습니다.
온라인 리뷰에서 별점과 서술형 텍스트의 감성이 일치하지 않는 '감성-별점 불일치' 현상을 분석한 연구입니다. 트랜스포머 기반 파이프라인을 통해 불일치 패턴을 분류하고, 별점이 텍스트 감성의 완벽한 정답 레이블이 될 수 없음을 경고합니다.
전통적인 HMM-GMM 방식의 한계를 극복하기 위해 소프트 동적 계획법(Soft Dynamic Programming)을 활용한 완전 미분 가능한 신경망 기반의 음소 정렬 모델을 제안합니다. 이 모델은 인코더와 디코더 구조를 통해 음소 정체성과 경계를 정밀하게 탐지하며, 기존 SOTA 기술보다 뛰어난 성능과 언어 일반화 능력을 보여줍니다.
LLM의 수학적 추론 실패를 유발하는 특정 토큰인 '클리프 토큰(Cliff Token)'을 정의하고 식별하는 연구를 소개합니다. 클리프 토큰을 제거하거나 Cliff-DPO를 통해 최적화함으로써 모델의 추론 정확도를 크게 향상시킬 수 있음을 입증했습니다.