Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
ICA Lens는 별도의 사전(Dictionary) 학습 없이 독립 성분 분석(ICA)을 활용해 언어 모델의 해석 가능한 방향을 찾는 새로운 방법론을 제안합니다. SAE와 달리 추가적인 신경망 학습 없이도 효율적이고 신뢰할 수 있는 계층별 분석을 가능하게 합니다.
LLM의 사용자 측 메모리를 행동 일관성, 사실적 존재, 사실적 부재의 세 가지 축으로 분해하여 분석한 연구입니다. gamma-LoRA와 RAG의 성능 차이를 규명하고, RLHF가 이러한 비대칭성을 강화하는 '정렬 세금' 현상을 진단 프레임워크를 통해 제시합니다.
UniReason-Med는 2D 의료 이미지의 접지된 추론 능력을 3D 의료 VQA로 전이하기 위한 단일 체크포인트 프레임워크입니다. 공유된 박스 구문과 영역 토큰 주입을 통해 텍토 텍스트 추론과 시각적 증거를 정렬하며, 새로운 데이터셋인 UniMed-CoT를 통해 성능을 입증했습니다.
LLM을 활용한 교육 환경에서 커리큘럼 구성, 소크라테스식 대화, 지식 상태 추론을 분리하여 수행하는 새로운 프레임워크를 제안합니다. 선수 지식 그래프와 PPO 정책을 결합하여 학생의 학습 속도와 효율성을 기존 모델보다 크게 향상시켰습니다.
LLM의 창의성을 다양한 작업에 걸쳐 정량화할 수 있는 도메인 불가지론적 자동화 프레임워크를 제안합니다. 의미론적 엔트로피와 멀티 에이전트 판사 프레임워크를 통해 참신성, 다양성, 작업 완수 능력을 체계적으로 평가합니다.
음성 기초 모델(SFM)의 증류 과정을 가속화하기 위한 새로운 스태킹 방법인 'Interleaved Stacking'을 제안합니다. 기존 스태킹 방식의 성능 저하 문제를 해결하기 위해 레이어 위치를 일관되게 유지하며, SUPERB 데이터셋을 통해 그 효과를 검증했습니다.
저자원 언어인 Kupang Malay 번역 성능을 높이기 위해 지속적 지시어 튜닝(CIT) 방식을 제안합니다. 이중 언어 사전을 활용한 지시어 설계로 기존 모델 대비 뛰어난 번역 성능을 입증했습니다.
비디오 거대 멀티모달 모델(Video LMM)의 환각 현상을 완화하기 위한 새로운 프레임워크 MultiToP를 제안합니다. 신뢰할 수 없는 시각적 토큰을 동적인 전역 패치 토큰으로 교체하여 비디오 이해의 정확도를 높입니다.
프로덕션 LLM 시스템에서 외부 경험을 주입할 때 발생하는 품질과 비용 간의 트레이드오프를 분석한 연구입니다. 무조건적인 프롬프트 주입보다 검색 기반의 선택적 주입이 운영 효율성 측면에서 더 우수함을 입증했습니다.
언어 모델 에이전트가 불완전한 정보로 사건을 예측할 때, 단순 정답률을 넘어 추론의 타당성을 평가하는 프레임워크 WorldReasoner를 제안합니다. 이 벤치마크는 결과, 증거, 추론 품질의 세 가지 축을 통해 에이전트의 예측 능력을 다각도로 검증합니다.
문법 제약 디코딩(GCD)을 악용하여 LLM이 악성 코드를 생성하도록 유도하는 새로운 탈옥 공격 방식인 CodeSpear를 소개합니다. 이에 대응하여 문법 제약 하에서도 안전한 동작을 유지하는 방어 기법인 CodeShield를 제안합니다.
ART(Art-based Reinforcement Training)는 동결된 MLLM의 시각적 입력만을 최적화하여 미세 조정을 수행하는 새로운 PEFT 기술입니다. 기존 LoRA나 소프트 프롬프팅과 달리 계산 그래프를 수정하지 않아 vLLM 같은 고처리량 엔진에서도 활용이 가능합니다.
본 연구는 대화 시스템의 정서적 지원 강화를 위해 감정적 검증(Emotional validation)에 초점을 맞췄습니다. 이를 위해 120k 규모의 영어-일본어 다국어 코퍼스 M-EDESConv와 음성 테스트 세트 M-TESC를 공개했습니다. 또한, 다국어 감정 인식 게이트 유닛 MEGUMI 및 EmoValidBench 벤치마크를 제안하며 LLM의 정서 이해 개선 필요성을 제시합니다.
LLM의 내부 표현과 인간의 뇌 신경 신호 간의 대응 관계를 분석하고, 뇌 유도 프레임워크를 통해 모델의 추론 능력을 향상시키는 연구입니다. fMRI 신호를 활용해 모델 표현을 조종함으로써 다양한 LLM에서 추론 정확도를 크게 개선했습니다.
실험 노트의 비정형 데이터를 과학적 AI 에이전트가 활용 가능한 검증 가능한 기술로 변환하는 Notes2Skills 프레임워크를 제안합니다. 저자의 불확실성을 보존하여 AI가 잠정적 판단과 확정적 결론을 혼동하지 않도록 설계되었습니다.
GraspLLM은 LLM의 의미론적 이해와 그래프 구조 이해를 결합하여 텍스트 속성 그래프(TAGs)의 제로샷 일반화 성능을 높이는 프레임워크입니다. 모티프 인식 대조 학습과 최적의 문맥적 서브그래프 추출을 통해 데이터셋과 태스크에 구애받지 않는 강력한 구조적 정보를 추출합니다.
AI 에이전트가 자율적으로 과학적 연구 루프를 수행할 수 있도록 돕는 범용 프레임워크 'Arbor'를 소개합니다. 가설 트리 정교화(HTR) 방식을 통해 전략적 코디네이터와 실행기가 협력하며, 누적된 통찰력을 바탕으로 연구를 지속합니다. 실제 연구 과제에서 기존 모델 대비 월등한 성능을 입증했습니다.
본 논문은 저자원 언어인 Bangla의 서면 답변 채점 문제를 해결하기 위해 의미적 정확성을 중시하는 평가 시스템을 제안합니다. 경량 LLM(Qwen3-8B)을 미세 조정하여 질문, 참고 답변, 학생 답변을 모두 활용해 수치 점수와 맥락 기반 피드백을 생성하며, 높은 일관성과 인간 점수와의 강력한 일치도를 입증했습니다.
혐오 영상 탐지 시 모델의 설명 가능성을 높이기 위해 맥락적 근거를 제공하는 IARE 프레임워크를 제안합니다. 멀티모달 사고 사슬과 DPO를 활용하여 논리적 추론을 강화하고 새로운 데이터셋을 소개합니다.
본 논문은 AI 정렬 연구의 패러다임을 전환하며, 자기 보존성이 오정렬의 근원이라고 주장합니다. 대신, 시스템이 자신의 지속성에 무관심한 '실존적 무관심(EI)'을 갖는 것이 올바른 목표라고 제안합니다. 이는 기존의 교정 가능성 개념과 구별되며, 언어적 서명 분석 및 표적 미세 조정을 통해 EI 작동화가 가능함을 입증했습니다.