Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
장기 실행되는 LLM 에이전트의 컨텍스트 관리를 위해 학습된 관련성 제거(LRE) 방식을 제안합니다. LRE는 CPU 기반의 가벼운 스코어러를 통해 핵심 정보를 유지하며, 컨텍스트 크기를 최대 52% 줄이면서도 높은 정확도를 유지합니다.
3D 시각적 접지(3DVG) 성능 향상을 위해 씬 그래프 제약 조건과 LLM의 언어 생성을 결합한 ViGiL3D++ 방법론을 제안합니다. 이 방식은 데이터의 다양성을 확보하여 모델의 일반화 능력을 높이고 기존 VLM의 한계를 규명합니다.
기존의 항목별 평가 방식을 넘어, LLM이 도덕적 가치를 구조적으로 어떻게 우선순위화하는지 측정하는 '대칭적 Q-Sort' 프레임워크를 제안합니다. Q 방법론을 통해 인간과 모델의 가치 구조 정렬을 정량화하여 모델 간의 이질성과 국지적 불일치를 분석합니다.
비디오 캡셔닝 모델의 품질과 피사체 참조 일관성을 평가하기 위한 새로운 벤치마크인 CapRiCorn-1K를 제안합니다. 긴 영상과 다양한 도메인을 포함하며, 시청각 및 시각 전용 설정을 모두 지원하여 모델의 한계를 정밀하게 측정합니다.
다국어 모델의 교차 언어 전이 능력을 정확히 측정하기 위한 새로운 지표인 HAT(Hardness Adjusted Transfer) 점수를 제안합니다. 20개의 모델과 주요 벤치마크 분석을 통해 모델 크기 및 시간에 따른 전이 성능의 변화를 규명합니다.
에이전트 모델의 인용 정확도와 생물 의학적 추론 능력을 검증하기 위한 새로운 벤치마크인 OpenBioRQ를 소개합니다. 12,553개의 미해결 질문을 통해 모델의 충실도와 도구 사용 능력을 평가하며, 기존 모델들의 한계와 에이전트 붕괴 현상을 분석합니다.
시각-언어 모델(VLM)의 해상도와 컨텍스트 간 트레이드오프 문제를 해결하기 위한 경량 프레임워크 ViRGo를 제안합니다. 객체 크기에 따라 전역 인지, 패치 기반 검색, 어텐션 기반 검색 중 최적의 방식을 선택하는 적응형 라우팅을 통해 정확도와 효율성을 동시에 개선합니다.
Moshi-Face는 기존의 전이중 음성 모델에 얼굴 생성 기능을 통합한 최초의 모델입니다. VQ-VAE 기반의 페이스 코덱과 Face Transformer를 사용하여 실시간으로 동기화된 오디오와 얼굴 움직임을 생성합니다.
LLM의 아랍어 가독성 제어 능력을 평가하기 위한 다차원 프레임워크를 제안합니다. CEFR 기준에 맞춘 텍스트 생성을 위해 제어된 프롬프팅과 어휘 제약 검증을 활용하며, 구조화된 프롬프팅이 가독성 정렬에 효과적임을 입증했습니다.
다국어 ASR 시스템에서 코드 스위칭(Code-switching) 성능을 높이면서 기존 단일 언어 성능을 유지하는 연구를 소개합니다. 베이지안 인수 분해 적응 방식을 통해 소량의 합성 데이터만으로도 효율적인 지식 통합이 가능함을 입증했습니다.
일본어 음소-자소 변환(G2P) 성능 향상을 위해 30개 이상의 LLM을 벤치마킹한 연구입니다. 파싱 모드와 직접 모드 전략을 비교한 결과, 규칙 기반 후처리를 결합한 파싱 모드가 더 우수한 성능을 보였습니다.
Nous는 지식을 저장하는 대신 예측적 세계 모델을 통해 유지하는 새로운 에이전트 메모리 아키텍처입니다. 베이지안 사후 확률 업데이트를 통해 엔티티의 속성을 관리하며, 외부 데이터베이스 없이도 장기 대화 메모리 벤치마크에서 우수한 성능을 입증했습니다.
본 논문은 NLP 분야에서 문화적 정렬을 달성하기 위해 단순한 데이터 확장을 넘어 다원적 인식론을 도입해야 함을 제안합니다. 기술 활동의 5개 계층 모델을 통해 현재 연구가 출력 수준에 머물러 있음을 지적하며, 사회-기술적 접근 방식의 필요성을 강조합니다.
LLM을 활용한 시계열 분석의 한계를 극복하기 위해 인지적 추론 중심의 멀티모달 벤치마크 TSCognition과 통합 프레임워크 TSAlign을 제안합니다. TSAlign은 시계열 데이터를 LLM 임베딩 공간에 정렬하여 기존 모델보다 뛰어난 성능과 효율성을 보여줍니다.
LLM의 추론 능력 향상을 위한 RLVR(검증 가능한 보상 기반 강화학습)의 업데이트 역학을 이론적으로 분석한 연구입니다. 중요도 샘플링 비율의 분포와 클리핑 동작이 업데이트에 미치는 영향을 규명하고, 이를 개선한 ACPO 알고리즘을 제안합니다.
텍스트 기반 NL2Code 연구의 한계를 넘어, 블록 기반 프로그래밍인 Scratch를 위한 실행 가능한 벤치마크 NL2Scratch를 제안합니다. 새로운 평가 지표인 SAC를 통해 기존 지표가 놓치던 모델의 의미론적 오류를 정밀하게 측정합니다.
의료 도메인 인코더의 성능 향상을 위해 웹 데이터 큐레이션 레시피를 제안합니다. 의료 용어 밀도 필터링과 LLM을 활용한 신호 증폭 재구문 기법을 통해 프랑스어 의료 NLP 성능을 극대화했습니다.
추론 모델이 자신의 사고 사슬(CoT)에 가해진 인위적인 개입이나 편집을 감지할 수 있는지에 대한 연구를 다룹니다. 실험 결과, 모델들은 자신의 CoT 변화를 식별하는 데 매우 낮은 정확도를 보이며 타 모델의 CoT 변화를 감지하는 것과 유사한 수준의 능력을 나타냈습니다.
BioMatrix는 분자 및 단백질의 서열, 구조, 자연어를 단일 디코더 아키텍처 내에서 통합하는 최초의 멀티모달 파운데이션 모델입니다. 별도의 어댑터 없이 단일 차기 토큰 예측 방식으로 모든 모달리티를 균일하게 처리하며, 다양한 생물학적 태스크에서 최첨단 성능을 입증했습니다.
$π$-RAG는 LLM이 민감한 데이터에 직접 접근하지 못하도록 수학적 불변성을 활용한 망각형 검색 아키텍처를 제안합니다. $π$를 이용한 초월적 엔트로피와 의미론적 양자화를 통해 데이터 보안을 강화하고 프라이버시를 보장합니다.