Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 기사는 팔레스타인-이스라엘 분쟁 관련 소셜 미디어 담론의 입장 탐지 공동 과제 StanceNakba 2026을 발표합니다. 이 과제는 행위자 수준(영어)과 교차 주제 수준(아랍어) 두 가지 하위 과제를 포함하며, 트랜스포머 기반 모델이 효과적임을 입증했습니다.
깊은 검색 에이전트의 훈련을 위해 단축 경로(shortcut)를 방지하는 새로운 데이터 합성 프레임워크인 FORT를 제안합니다. FORT는 구조적 복잡성 대신 실제 검색 난이도를 보장하는 4가지 위험 요소를 제어하여 고품질의 훈련 데이터를 생성합니다. 이를 통해 훈련된 FORT-Searcher는 까다로운 벤치마크에서 최고 수준의 성능을 기록했습니다.
본 논문은 SMILES 문자열 기반 분자 언어 모델이 겪는 지역성 격차 문제를 해결하기 위해 MolGram이라는 조건부 $n$-gram 메모리 모듈을 제안합니다. 이 모듈은 해시 조회를 통해 화학적으로 의미 있는 지역 패턴을 학습된 임베딩으로 매핑하여 은닉 상태에 동적으로 주입함으로써 모델의 성능을 개선했습니다.
본 연구는 대규모 언어 모델(LLMs) 사전 학습 코퍼스에 포함될 수 있는 민감 개인 정보(SCPI)를 일본어 텍스트에서 탐지하는 방법을 제시합니다. 특히 일본의 개인정보보호법(APPI) 기준 '특별한 주의가 필요한 개인정보'에 초점을 맞추었습니다. LLM 기반 주석을 활용하여 데이터셋을 구축하고, 이를 바탕으로 SCPI 분류 머신러닝 모델을 훈련하여 효과적인 탐지 성능을 입증했습니다.
LLM의 벤치마크 점수가 모델의 실제 지식이 아닌 형식 준수 능력에 의해 왜곡되는 문제를 해결하기 위해 소프트 프롬프트 튜닝을 제안합니다. 매우 적은 파라미터 최적화만으로 베이스 모델의 기저 지식을 정확하게 측정할 수 있는 공정한 평가 방식을 제공합니다.
희소 자동 인코더(SAE)의 특징 안정성을 연구하여, 특징이 시드에 따라 어떻게 재현되는지 분석합니다. 안정적인 특징은 재구성 및 예측에 핵심적인 역할을 하는 반면, 불안정한 특징은 재현 가능한 낮은 랭크의 부분 공간에 집중되어 있음을 밝혀냈습니다.
의료 시각-언어 모델(LVLM)의 과학적 추론 능력을 향상시키기 위한 대규모 멀티모달 의료 추론 코퍼스인 OpenMedReason을 소개합니다. 논문 기반의 고충실도 추론 과정을 통해 모델의 진단 정확도와 근거 제시 능력을 동시에 개선합니다.
본 자료는 정치적 담론 속 엔티메메(Enthymemes) 탐지를 위한 새로운 데이터셋과 방법론을 제시합니다. 1,482개의 트윗에 대해 다섯 명의 주석가가 레이블 변동성을 연구하도록 설계되었으며, 구조화된 주석 지침을 통해 해석적 특성을 유지하면서도 객관적인 분석이 가능하게 합니다.
LLM 기반 에이전트를 위한 환경 엔지니어링의 라이프사이클을 모델링, 합성, 평가, 응용 관점에서 체계적으로 조사한 논문입니다. 환경 합성 패러다임과 에이전트-환경 공동 진화 경로를 분석하며 미래 연구 방향을 제시합니다.
LLM의 절차적 지식 주입 시 발생하는 비용과 지연 시간을 줄이기 위한 새로운 압축 프레임워크 SKIM을 제안합니다. SKIM은 기술의 복잡도에 따라 적응형 다중 해상도 소프트 토큰을 생성하여 성능을 유지하면서도 효율적인 압축을 가능하게 합니다.
제로샷 NLP 프레임워크를 활용해 금융 뉴스의 주가 예측 가능성을 조사한 연구입니다. 실험 결과 제로샷 방식은 하락 변동 예측에 취약함을 보였으나, XAI를 통한 설명 가능성 신호는 예측의 신뢰도를 구분하는 데 유효함을 입증했습니다.
기존 LLM 편향 연구는 외부 주체로서 모델이 인구통계학적 그룹을 평가하는 '제3자 감사'에 머물러 있었습니다. 본 논문은 실제 사용 환경에서 발생하는 사용자 중심의 상호작용 맥락을 포착하기 위해 '상황적 상호작용 감사(SIA)' 프레임워크를 제안합니다. SIA는 사용자의 암묵적인 신호가 LLM 응답의 품질, 내용, 어조에 미치는 영향을 연구하는 새로운 접근 방식입니다.
본 연구는 LLM의 출력을 제어하는 다양한 조건화(conditioning) 방법을 체계적으로 분석했습니다. 그 결과, 효과적인 조향 방법들이 유창성 저하를 초래하며, 활성화 조향은 명령어 기반 모델에서 성능이 떨어지는 경향을 발견했습니다. 또한, 개념 주입에는 프롬프팅과 지도 미세 조정이 좋으나, 개념 제거에는 한계가 있음을 제시합니다.
본 논문은 추측 디코딩(Speculative Decoding, SD)의 효율성을 높이기 위해 모델 내부 라우팅을 활용한 새로운 검증 방식을 제안합니다. VIA-SD는 토큰의 신뢰도에 따라 직접 수용, 슬림 서브모델 재생성, 전체 모델 검증 등 다단계 처리를 수행하여 LLM 추론 비용을 획기적으로 줄입니다.
본 연구는 확산 대규모 언어 모델(dLLMs)의 한계를 분석하고, 기존 무작위 마스킹 전략 대신 어텐션 기반 디노이징 및 최적화 프레임워크인 AGDO를 제안합니다. AGDO는 토큰 간의 어텐션 의존성을 활용하여 훈련과 최적화 과정을 개선하며, 추론 성능 향상에 기여함을 입증했습니다.
다회차 대화의 품질을 평가하기 위해 정보 이론을 기반으로 '의미론적 진전'을 측정하는 새로운 지표를 제안합니다. 임베딩 공간에서의 불확실성 감소를 통해 대화의 정보 축적을 계산하며, 기존 LLM 기반 평가 방식보다 효율적이고 재현 가능합니다.
범용 코딩 에이전트의 성능을 공정하게 평가하기 위한 새로운 벤치마크인 Claw-SWE-Bench를 소개합니다. 이 벤치마크는 다양한 에이전트 하네스(claws)를 동일한 조건에서 비교할 수 있도록 설계되었으며, 어댑터 설계와 모델 선택이 코딩 작업 성능에 미치는 영향을 분석합니다.
RL 학습 과정에서 MTP의 수락률 저하 문제를 해결하기 위해 거부 샘플링을 결합한 Bebop 연구를 제안합니다. 모델 엔트로피 변동을 완화하는 새로운 TV 손실 함수를 통해 추론 처리량을 최대 25% 향상시키고 학습 속도를 가속화합니다.
본 논문은 긴 문서를 효율적으로 처리하기 위해 Doc-to-Atom(Doc2Atom)이라는 구성적 파라미터 메모리 프레임워크를 제안합니다. 이 방법은 문서를 의미론적 지식 원자(knowledge atoms)로 분해하고, 각 원자를 독립적인 마이크로-LoRA 어댑터와 출처 검색 키로 컴파일합니다. 추론 시 쿼리 라우터를 통해 관련 원자만 선택하여 전용 어댑터를 구성함으로써 메모리 효율성과 성능을 동시에 개선했습니다.
본 논문은 장기 다중 턴 대화에서 발생하는 누적된 비용과 정보 손실 문제를 해결하기 위해 Context-Driven Incremental Compression (C-DIC)을 제안합니다. C-DIC는 대화를 수정 가능한 맥락적 스레드로 간주하고, 경량의 검색-수정-쓰기 백 루프를 통해 메모리를 업데이트하여 장기 행동 안정성을 높입니다. 또한, TBPTT를 조정하여 턴 간 의존성 학습을 개선했습니다.