Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM의 기원을 식별하기 위해 유도된 결정 영역(induced decision regions)을 활용하는 새로운 방법론인 Stemma를 제안합니다. 기존 블랙박스 방식의 한계를 극복하여 모델의 변형이나 배포 환경에서도 높은 정확도로 모델 계보를 추적할 수 있음을 입증했습니다.
3B 파라미터 규모의 멀티모달 안전 분류기인 Shieldstral을 소개합니다. 이 모델은 텍스트 안전 벤치마크에서 대형 모델을 능가하며, 콘텐츠 중재를 이진 질의응답 방식으로 통합하여 높은 효율성을 보여줍니다.
LLM의 내부 잠재 변수를 제어하기 위해 추론 시점의 활성화 편집 대신 입력 프롬프트를 최적화하여 특정 특징을 억제하는 연구를 소개합니다. Llama 모델을 통해 평가 인지 잠재 변수를 억제하는 실험을 진행했으나, 활성화 읽기 가능성이 반드시 행동 제어 가능성으로 이어지지는 않는다는 한계를 발견했습니다.
불규칙한 임상 시계열 데이터(ICTS)를 효과적으로 처리하기 위한 멀티모달 LLM 추론 프레임워크 ClinPRISM을 제안합니다. 다중 척도 인코더와 증류 기술을 통해 데이터의 희소성과 비동기성 문제를 해결하며, 높은 효율성과 성능을 동시에 달성했습니다.
물리학, 천체물리학 분야의 연구 제안서 작성 및 평가에서 LLM의 역량을 조사한 연구입니다. LLM은 인간과 대등한 수준의 계획서를 생성할 수 있으나, AI 검토자는 AI가 작성한 제안서에 편향된 높은 점수를 주는 경향이 확인되었습니다.
실제 임상 현장의 복잡성을 반영하기 위해 개발된 다회차 멀티모달 임상 진단 평가 벤치마크 ClinMM-Bench를 소개합니다. 15개의 MLLMs를 평가한 결과, 모델들이 진단 방향은 식별하나 신뢰할 수 있는 추론 생성에는 한계가 있음을 확인했습니다.
LLM이 인간의 대화 방식처럼 상대방의 문법적 특성에 맞추는 '구문 수렴' 현상을 연구했습니다. Llama와 Gemma 모델을 분석한 결과, 지시어 튜닝된 모델이 사전 학습 모델보다 인간의 구문을 더 많이 재사용하며 높은 의미적 유사성을 보임을 확인했습니다.
텍스트, 테이블, 지식 그래프(KG) 간의 정보 불일치를 탐지하는 연구를 소개합니다. 새로운 분류 체계와 자동화 프레임워크인 Kontrast를 통해 모달리티 간의 충돌을 식별하고 지식의 일관성을 검증합니다.
UniMem은 태스크 스트림 환경에서 안정성과 가소성의 균형을 맞추기 위해 제안된 자율적 메모리 관리 프레임워크입니다. 에피소드 메모리와 파라메트릭 메모리를 셀프 라우팅 토큰으로 적응적으로 조정하여 효율적인 태스크 실행을 지원합니다.
코딩 에이전트의 반복적인 수정 루프가 반드시 신뢰성을 보장하지 않는다는 점을 지적하며, 에이전트 기반 코드 수정의 상태 제한 증거 및 타입 지정 수정 계약을 제안합니다. 연구를 통해 반복 횟수에 따른 정확도 변화와 잘못된 추적 데이터의 위험성을 분석했습니다.
고대 언어의 비구조적 텍스트 분석을 위해 레이블 없이 문장 임베딩을 최적화하는 두 가지 비지도 학습 전략(TSDAE, CSE)을 제안합니다. 실험 결과, 제안된 방식은 기존 다국어 인코더보다 뛰어난 성능을 보이며 성서 재사용 식별 및 노이즈 텍스트 처리에서 탁월한 효과를 입증했습니다.
PIVOT은 토큰 수준 희소 어텐션(DSA)의 인덱싱 병목 현상을 해결하기 위한 새로운 연구입니다. 인접한 쿼리 간의 중복성을 활용하여 단일 접두사 스캔을 공유함으로써, 정확도를 유지하면서도 추론 속도를 획기적으로 높였습니다.
LLM의 은닉 활성화(hidden activations) 기하학적 구조를 활용하여 환각을 탐지하는 새로운 지표인 D-Score를 제안합니다. 단 한 번의 순전파만으로 계산 가능한 스펙트럼 통계량을 통해 외부 검증 없이도 효과적으로 환각을 식별할 수 있습니다.
희소 오토인코더(SAE) 특징과 모델 행동 간의 불일치 문제를 해결하기 위해 특징 효과 기하학 분석(FEGA) 프레임워크를 제안합니다. 연구 결과, 특징은 값 유사 특징과 포인터 유사 특징으로 구분되며, 각기 다른 기하학적 효과를 나타냄을 밝혀냈습니다.
시각적 문서 이해(VDU) 모델이 좌표 대신 텍스트 인용을 사용하는 언어 인터페이스를 통해 증거 귀속 성능을 높이는 연구를 소개합니다. 좌표 기반 방식의 환각 문제를 해결하기 위해 GRPO 레시피를 도입하여 영역 레이블 없이도 정확도를 개선했습니다.
2.8T 파라미터 규모의 MoE 모델인 Kimi K3를 소개합니다. KDA 기술과 Stable LatentMoE를 통해 스케일링 효율을 2.5배 높였으며, 비전 기능과 100만 토큰 컨텍스트를 지원합니다. 모델의 전체 가중치를 공개하여 연구 및 배포를 가속화하고자 합니다.
언어 모델 기반 개체 매칭(Entity Matching)에서 아키텍처, 모델 변체, 모델 크기가 성능에 미치는 영향을 통제된 실험을 통해 분석한 연구입니다. Qwen3 제품군을 활용해 각 요인이 성능 향상에 기여하는 방식을 분리하여 규명했습니다.
DataOrchestra는 사전 학습 데이터의 품질을 높이기 위해 각 데이터 예시별로 최적의 처리 파이프라인을 오케스트레이션하는 프레임워크입니다. 데이터의 삭제, 유지, 정제 여부를 결정하고 LLM 기반 재작성 등 맞춤형 연산을 적용하여 모델 성능을 향상시킵니다.
JEPA 방식의 잠재 예측이 텍스트 데이터에서 겪는 한계를 분석한 연구입니다. 이미지와 달리 언어는 하나의 문맥에 대해 여러 유효한 토큰이 존재할 수 있어, 결정론적 예측 시 중심점 퇴화와 모델 붕괴가 발생함을 설명합니다.
LLM의 정치적 성향을 단순 좌표로 평가하는 대신, 시스템 프롬프트에 따른 답변의 조종 가능성(Steerability)을 분석한 연구입니다. GPT-5, Claude 등 주요 모델을 대상으로 실험한 결과, 모델의 정체성보다 맥락적 프레이밍이 정치적 변동성에 훨씬 큰 영향을 미침을 확인했습니다.