Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM 에이전트 사회에서 발생하는 창발적 합의와 양극화 현상을 정량적으로 측정하고 진단하는 새로운 방법론을 제안합니다. 결합 이득(Coupling Gain) 지표를 도입하여 모델의 사회적 역학이 진정한 상호작용인지 아니면 모델 자체의 사전 지식에 의한 산물인지 구분하는 프로토콜을 제공합니다.
LLM의 블랙박스 분류 시 신뢰도 점수의 해상도를 결정하는 '점수 세밀도 격차'를 분석한 연구입니다. 7가지 신뢰도 구축 방식이 임계값 설정과 순위 매기기에 미치는 영향을 비교하고, 추론 비용과의 트레이드오프를 다룹니다.
인공 에이전트가 시각적 경험을 통해 단어의 의미를 학습하고 안정화하는 과정을 연구한 논문입니다. DINOv2 임베딩을 활용해 지각적 거리와 어휘적 접지 사이의 상관관계를 분석하며, 명명과 인출 메커니즘의 차이를 규명합니다.
SamatNext v0.2-B는 RMS 정규화와 선형 상태 믹서를 결합한 356M 규모의 하이브리드 디코더 모델입니다. 순차적 미세 조정 과정에서 발생하는 치명적 망각 문제를 완화하여 코드 커리큘럼 유지력을 높이는 연구를 수행했습니다.
서아프리카 언어인 Hausa와 Fongbe를 대상으로 LLM의 기계 번역 품질과 자동 평가 지표의 신뢰성을 분석한 연구입니다. 언어별 모델 성능 차이와 자동 지표가 인간의 판단을 완벽히 반영하지 못하는 한계를 규명했습니다.
MixedPEFT는 혼합 목적 함수와 맞춤형 PEFT 아키텍처를 결합하여 비지도 도메인 적응 문제를 해결하는 새로운 연구입니다. LoRA와 가역 어댑터를 결합하여 소스 도메인의 분류 성능과 타겟 도메인의 MLM 성능을 동시에 최적화합니다.
저자원 아프리카 언어인 Fongbe와 Hausa의 텍스트 코퍼스 확장을 위해 ASR 파이프라인을 활용한 데이터 수집 연구를 수행했습니다. MMS-300M과 Whisper 모델을 미세 조정하여 음성 데이터를 텍스트로 변환하고 그 품질을 평가했습니다.
LLM 강화학습(RL)의 효율성을 높이기 위해 데이터 샘플링 방식을 개선한 적응형 데이터 스케줄링(ADS) 프레임워크를 제안합니다. 기존의 균등 샘플링 대신 의미론적 클러스터와 정책 경계 샘플을 활용하여 학습 성능을 최적화합니다.
LLM-as-a-Judge의 체계적 편향을 측정하고 감사하는 오픈 소스 프레임워크인 BabelJudge를 소개합니다. 위치, 장황함, 교차 언어 저하 등 네 가지 주요 실패 모드를 측정하며, 에이전트 평가를 위한 궤적 수준의 섭동 분석 기능도 포함합니다.
SciTraj 코퍼스를 통해 NLP, ML, CV 분야의 논문 인용 관계를 주장(claim) 기반의 유형별 그래프로 분석하는 새로운 방법론을 제안합니다. 기존의 단순 인용 그래프를 넘어 연구의 진화 궤적을 추적하고 학문적 흐름을 예측할 수 있는 벤치마크를 제공합니다.
LLM의 대화 전략을 조작하여 학습자의 탐구적 인지 형성을 연구하는 CURIOBOT 프레임워크를 소개합니다. 호기심을 유도하는 언어적 개입이 학습자의 탐구적 질문과 대화 주도성을 유의미하게 증가시킴을 입증했습니다.
다국어 언어 모델에서 언어 정체성을 결정하는 '첫 번째 토큰 브로드캐스터' 헤드를 식별하는 LIHA 기법을 소개합니다. 연구 결과, 인스트럭션 튜닝이 언어 정체성 회로를 초기 레이어로 국소화시킨다는 인과적 증거를 발견했습니다.
ORBIT은 훈련 없이 언어 모델의 여러 행동 속성을 동시에 제어할 수 있는 새로운 기술입니다. SVD를 활용한 직교 부분 공간 회전 방식을 통해 기존 방식의 노름 불균형과 방향성 상쇄 문제를 해결합니다.
인간-로봇 상호작용에서 성공적인 대화를 위한 '개념적 정렬'을 양방향적 과정으로 정의하고, 이를 분석하기 위한 새로운 분류 체계와 대화 행위 스키마를 제안하는 연구입니다.
지식 그래프(KG) 그라운딩이 LLM의 성능에 미치는 영향을 분석한 연구입니다. 실험 결과, KG 그라운딩은 모델이 이미 학습한 지식에는 도움이 되지 않으며, 학습 데이터에 포함되지 않은 새로운 지식(Out-of-Training Knowledge)을 다룰 때만 성능을 유의미하게 향상시킵니다.
대규모 도구 생태계에서 LLM 에이전트의 장기 계획 능력을 평가하기 위한 새로운 벤치마크 PlanBench-XL을 소개합니다. 1,665개의 도구와 327개의 작업을 통해 에이전트의 도구 검색, 하위 목표 추론 및 환경 변화에 대한 적응력을 테스트합니다.
본 논문은 LLM이 텍스트 내에서 인과 구조를 학습하는 방식인 '차이 생성 논리(difference-making logic)'를 분석합니다. LLM이 변분 유도를 통해 문맥 내에서 인과적 요소와 비인과적 요소를 식별하는 메커니즘을 규명합니다.
LLM이 생성한 허구적 이야기 속 캐릭터의 다양성을 서사학적 관점에서 분석한 연구입니다. 캐릭터의 8가지 차원을 통해 LLM 생성 텍스트와 인간 작성 텍스트 간의 캐릭터 묘사 방식 및 다양성 차이를 비교합니다.
인터리브드 음성 언어 모델(SLM)이 음성 토큰과 텍스트 토큰을 처리할 때 발생하는 내부 메커니즘을 분석합니다. 연구 결과, 모델이 중간 레이어에서 암시적 전사(implicit transcription) 과정을 거쳐 텍스트 공간에서 다음 단어를 예측한다는 사실을 밝혀냈습니다.
Roman Urdu와 같이 철자 변이가 심한 저자원 언어의 서브워드 파편화 문제를 해결하기 위한 ROMEVA 기법을 제안합니다. PCA 가이드 앵커 손실을 통해 임베딩 공간을 보존하며 어휘를 확장하는 연구입니다.