Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 언어 모델의 표현 분산에 대한 새로운 이론적 관점을 제시합니다. 클래스 내 분산을 '정보 저장소'로 해석하고, 거대 카테고리 구조가 차지하는 정보 비중이 매우 낮음을 분석했습니다. 특히 토큰 내 컨텍스트가 대부분의 정보를 담당하며, 이와 관련된 하한선(converse floor) 법칙을 증명하여 모델의 작동 원리를 설명합니다.
본 연구는 저자 판별(Authorship verification) 증거 강도를 정량화하는 방법을 제시하며, 기존 방법이 요구하던 별도의 보정 모델 없이 우도비(likelihood ratios)를 도출할 수 있는 두 가지 새로운 정규화 기법을 제안합니다. 이 기법들은 특히 긴 텍스트에서 발생할 수 있는 과대평가를 완화하여 법의학적 분석의 접근성과 투명성을 높입니다.
Freya-TTS는 높은 신뢰성과 효율성을 갖춘 대화형 합성 TTS 모델입니다. 1억 8,320만 개의 파라미터를 가진 DiT 기반으로 작동하며, 터키어에 최적화되어 있습니다. 이 모델은 자원 제한적인 환경에서도 실시간 성능을 보여주며, 오픈 소스로 공개되었습니다.
본 논문은 8개 유형론적으로 다양한 언어에 걸쳐 관용적이고 비유적인 의미를 포착하는 개념 네트워크 기반 프레임워크를 제시합니다. 이 프레임워크는 인지-언어학적 특징을 활용하여 관용구가 언어가 아닌 개념 스키마에 따라 군집화됨을 밝혀냈습니다. 교차 언어 전이 실험 결과, 개념적 근접성만으로 높은 번역 등가물을 식별할 수 있음을 입증했습니다.
본 논문은 QANTA 2026 공동 챌린지를 위해 작업별 멀티모달 질의응답(EMM-QA) 에이전트 아키텍처를 제안합니다. 이 시스템은 불확실성 속 답변 결정(Tossup)과 정확한 증거 기반 선택(Bonus)이라는 두 가지 과제를 다룹니다. 특히, 신뢰도 보정 및 도메인 특화 추론 정책에 중점을 둔 경량의 에이전트 전략을 통해 높은 성능을 달성했습니다.
본 연구는 영어 중심의 바이트 레벨 토크나이저가 벵골어와 같은 형태론적으로 풍부한 언어에서 자기회귀적 붕괴를 유발하는 문제를 분석했습니다. 이를 해결하기 위해 네이티브 스크립트 기반의 BanglaBERT WordPiece 어휘집을 이식하고 임베딩 행렬 크기를 조정하는 새로운 파이프라인을 제안합니다. 그 결과, WER과 RTF 측면에서 높은 성능 개선을 입증하며 크로스 스크립트 적응에 활용 가능한 청사진을 제시했습니다.
본 논문은 LLM 에이전트의 추론 능력 향상을 위해 경매 메커니즘을 도입한 프레임워크 Agora를 제안합니다. 기존 방식들이 단순 매칭에 의존하는 한계를 극복하고, 작업을 전문가 모델 및 도구에 동적으로 할당하여 가장 유능한 솔버에게 라우팅되도록 합니다.
LLM-as-Judge의 신뢰성은 평가자 변경에 따라 측정값이 달라지는 '평가자 교체 모호성' 문제를 안고 있습니다. 본 연구는 다양한 판단 데이터셋에서 Qwen3 모델 확장 및 MiniMax API 이동 등 두 가지 업그레이드 경로를 비교 분석했습니다. 그 결과, 더 강력한 평가자가 위치 편향과 장황함 편향을 줄이기는 하지만 완전히 제거하지 못하며, 보고서에 상세한 감사 추적 기록이 필요함을 강조합니다.
본 연구는 LLM 기반의 건강 챗봇 개발 시 실제 환자 대화 데이터를 분석했습니다. 커뮤니케이션 패턴과 감정 표현의 높은 다양성을 발견했으며, 이를 반영한 환자 시뮬레이터를 개발하여 현실성이 높음을 입증했습니다. 또한, 커뮤니케이션 스타일이 응급도 평가 성능에 큰 영향을 미침을 밝혀내며, 실제 환경 배포 시 시스템 설계의 복잡성 수용 필요성을 강조합니다.
본 논문은 LLM의 효율적인 경량화를 위해 PALS (Percentile-Aware Layerwise Sparsity)라는 새로운 가지치기 기법을 제안합니다. PALS는 활성화 크기의 분위수를 기반으로 계층별 희소성을 조정하여, 기존 방법들보다 더 나은 성능과 낮은 퍼플렉서티를 달성함을 보여줍니다. 또한, 기울기 기반 할당 방식의 한계점도 제시했습니다.
기존 LLM 벤치마크가 실제 데이터 분석 환경을 반영하지 못하는 문제를 지적하며, 정부 공개 데이터를 기반으로 DataGovBench를 소개합니다. 이 벤치마크는 복잡한 질문에 답하는 Table QA와 전문가 수준의 통찰력을 발견하는 Table Insight 두 가지 작업을 포함하여 LLM 평가의 새로운 기준을 제시합니다.
본 논문은 전이중(full-duplex) 음성 언어 모델(SLMs)의 핵심 과제인 모달리티 간섭 문제를 다룹니다. 연구진은 이 문제가 깊은 매개변수 공간 공유에서 발생하는 기울기 충돌 때문임을 밝혀냈습니다. 이에 따라, 모달리티 분리 및 의미 일관성을 유지하는 계층적 전이중 프레임워크 Lychee-FD를 제안합니다.
TiCodec은 시불변 표현 추출(TIRE) 모듈을 통해 음성 콘텐츠에서 화자 및 환경 정보를 분리하는 신경망 음성 코덱 연구입니다. 중간 레이어의 상호 보완성을 활용한 Dual-TIRE 구조를 제안하며, 스트리밍 환경에서도 성능 저하 없이 저지연 음성 처리가 가능함을 입증했습니다.
LLM이 생성할 남은 출력 길이를 내부적으로 추정하고 있다는 연구 결과입니다. 은닉 상태를 통한 선형 프로빙 결과, 모델은 응답의 전체 길이를 예측할 수 있는 내부 표현을 가지고 있음이 확인되었습니다.
LLM의 계보 추적과 관리를 위해 가중치 스펙트럼 밀도를 활용한 '스펙트럼 시그니처' 지표를 제안합니다. 이 방식은 데이터 없이도 모델의 고유 특성을 포착하며, 대규모 모델 코퍼스의 효율적인 분석과 클러스터링을 가능하게 합니다.
SMM4H-HeaRD 2026 태스크의 일환으로 TCGA 병리 보고서를 활용해 TNM 병기를 예측하는 연구입니다. ClinicalBERT, BioBERT 등 임베딩과 LightGBM, WRN 모델을 활용하여 다중 레이블 분류 성능을 분석했습니다.
Graph-RAG의 신뢰성을 확보하기 위해 추출, 구축, 추론 단계를 단계별로 계측하는 TRIAGE 프레임워크를 소개합니다. 이 프레임워크는 지식 그래프의 구현, 검증, 사용 단계를 독립적인 지표로 평가하여 실패 지점을 정확히 찾아냅니다.
LLM이 의미 없는 필러 토큰을 사용하여 내부적으로 추론을 수행하는 현상을 분석한 연구입니다. DeepSeek V3와 Kimi K2 모델을 통해 필러 토큰 내의 은닉 상태에서 계산 흔적을 추출하고 복구하는 비지도 디코딩 파이프라인을 제안합니다.
언어 모델이 문화적 현상을 정량화할 때, 모델과 데이터, 평가 방식이 문화적 현실을 단순히 기록하는 것이 아니라 능동적으로 구성한다는 점을 논합니다. 카렌 바라드의 '행위적 절단' 개념을 통해 모델 설계가 문화적 경계를 획정하는 과정을 분석합니다.
MER-TRANS 2026의 스페인어 쉬운 읽기(Easy-to-Read) 생성 태스크를 위한 HULAT2 시스템을 소개합니다. LangGraph 기반의 멀티 에이전트 워크플로우와 신호 유도형 라우팅을 통해 기존 베이스라인보다 우수한 성능을 입증했습니다.