Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM이 인간의 대화 방식처럼 상대방의 문법적 특성에 맞추는 '구문 수렴' 현상을 연구했습니다. Llama와 Gemma 모델을 분석한 결과, 지시어 튜닝된 모델이 사전 학습 모델보다 인간의 구문을 더 많이 재사용하며 높은 의미적 유사성을 보임을 확인했습니다.
텍스트, 테이블, 지식 그래프(KG) 간의 정보 불일치를 탐지하는 연구를 소개합니다. 새로운 분류 체계와 자동화 프레임워크인 Kontrast를 통해 모달리티 간의 충돌을 식별하고 지식의 일관성을 검증합니다.
UniMem은 태스크 스트림 환경에서 안정성과 가소성의 균형을 맞추기 위해 제안된 자율적 메모리 관리 프레임워크입니다. 에피소드 메모리와 파라메트릭 메모리를 셀프 라우팅 토큰으로 적응적으로 조정하여 효율적인 태스크 실행을 지원합니다.
코딩 에이전트의 반복적인 수정 루프가 반드시 신뢰성을 보장하지 않는다는 점을 지적하며, 에이전트 기반 코드 수정의 상태 제한 증거 및 타입 지정 수정 계약을 제안합니다. 연구를 통해 반복 횟수에 따른 정확도 변화와 잘못된 추적 데이터의 위험성을 분석했습니다.
고대 언어의 비구조적 텍스트 분석을 위해 레이블 없이 문장 임베딩을 최적화하는 두 가지 비지도 학습 전략(TSDAE, CSE)을 제안합니다. 실험 결과, 제안된 방식은 기존 다국어 인코더보다 뛰어난 성능을 보이며 성서 재사용 식별 및 노이즈 텍스트 처리에서 탁월한 효과를 입증했습니다.
PIVOT은 토큰 수준 희소 어텐션(DSA)의 인덱싱 병목 현상을 해결하기 위한 새로운 연구입니다. 인접한 쿼리 간의 중복성을 활용하여 단일 접두사 스캔을 공유함으로써, 정확도를 유지하면서도 추론 속도를 획기적으로 높였습니다.
LLM의 은닉 활성화(hidden activations) 기하학적 구조를 활용하여 환각을 탐지하는 새로운 지표인 D-Score를 제안합니다. 단 한 번의 순전파만으로 계산 가능한 스펙트럼 통계량을 통해 외부 검증 없이도 효과적으로 환각을 식별할 수 있습니다.
희소 오토인코더(SAE) 특징과 모델 행동 간의 불일치 문제를 해결하기 위해 특징 효과 기하학 분석(FEGA) 프레임워크를 제안합니다. 연구 결과, 특징은 값 유사 특징과 포인터 유사 특징으로 구분되며, 각기 다른 기하학적 효과를 나타냄을 밝혀냈습니다.
시각적 문서 이해(VDU) 모델이 좌표 대신 텍스트 인용을 사용하는 언어 인터페이스를 통해 증거 귀속 성능을 높이는 연구를 소개합니다. 좌표 기반 방식의 환각 문제를 해결하기 위해 GRPO 레시피를 도입하여 영역 레이블 없이도 정확도를 개선했습니다.
2.8T 파라미터 규모의 MoE 모델인 Kimi K3를 소개합니다. KDA 기술과 Stable LatentMoE를 통해 스케일링 효율을 2.5배 높였으며, 비전 기능과 100만 토큰 컨텍스트를 지원합니다. 모델의 전체 가중치를 공개하여 연구 및 배포를 가속화하고자 합니다.
언어 모델 기반 개체 매칭(Entity Matching)에서 아키텍처, 모델 변체, 모델 크기가 성능에 미치는 영향을 통제된 실험을 통해 분석한 연구입니다. Qwen3 제품군을 활용해 각 요인이 성능 향상에 기여하는 방식을 분리하여 규명했습니다.
DataOrchestra는 사전 학습 데이터의 품질을 높이기 위해 각 데이터 예시별로 최적의 처리 파이프라인을 오케스트레이션하는 프레임워크입니다. 데이터의 삭제, 유지, 정제 여부를 결정하고 LLM 기반 재작성 등 맞춤형 연산을 적용하여 모델 성능을 향상시킵니다.
JEPA 방식의 잠재 예측이 텍스트 데이터에서 겪는 한계를 분석한 연구입니다. 이미지와 달리 언어는 하나의 문맥에 대해 여러 유효한 토큰이 존재할 수 있어, 결정론적 예측 시 중심점 퇴화와 모델 붕괴가 발생함을 설명합니다.
LLM의 정치적 성향을 단순 좌표로 평가하는 대신, 시스템 프롬프트에 따른 답변의 조종 가능성(Steerability)을 분석한 연구입니다. GPT-5, Claude 등 주요 모델을 대상으로 실험한 결과, 모델의 정체성보다 맥락적 프레이밍이 정치적 변동성에 훨씬 큰 영향을 미침을 확인했습니다.
저자원 언어 환경에서 LLM의 공감적 정신 건강 상담 능력을 향상시키기 위한 새로운 프레임워크를 제안합니다. RP-RCAF 프롬프팅 전략과 G-REFS 평가 체계를 통해 모델이 문화적 감수성을 갖춘 전문적인 조언을 생성하도록 유도합니다.
다국어 환경에서 LLM의 지시 계층 구조(Instruction Hierarchy) 준수 능력을 평가하는 새로운 벤치마크인 XIH-Bench를 소개합니다. 연구 결과, 언어에 따른 준수 능력의 비대칭성과 언어 경계 효과가 존재함을 발견했습니다.
코딩 에이전트 워크플로에서 제3자 API 라우터가 발생시킬 수 있는 보안 취약점과 '라우터 측 주입' 공격을 연구한 논문입니다. 연구 결과, 기존 클라이언트 측 보호 조치로는 라우터의 응답 조작을 탐지하기 매우 어려우며, 제공업체 차원의 출력 무결성 보장이 필요함을 시사합니다.
MS-GPT는 질량 분석 스펙트럼(MS/MS)으로부터 분자 구조를 규명하기 위한 새로운 분자-언어 모델입니다. 스펙트럼 유도 사후 쿼리 방식을 통해 기존 de novo 방식의 학습-추론 불일치 문제를 해결하며, SOTA 성능을 달성했습니다.
HiTMS는 LLM의 샘플링 무작위성을 활용해 비밀 정보를 숨기는 멀티 스트림 언어 스테가노그래피 프레임워크입니다. 단일 스트림의 한계를 넘어 배치 추론을 통해 처리량을 최대 4.3배 향상시키고 보안성을 강화했습니다.
LLM의 사회적 지능을 측정, 내재화, 접지하기 위한 통합 프레임워크인 Zing을 제안합니다. 심리학 기반 벤치마크 SoMBench와 학습 레시피 Zing, 그리고 추론 시 지원을 위한 Actio 아키텍처를 통해 모델의 사회적 역량을 강화하는 방법을 다룹니다.