Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
CircuitKIT는 기계론적 해석 가능성(Mechanistic Interpretability) 연구를 위해 회로 발견, 평가, 개입 과정을 통합한 오픈소스 라이브러리입니다. 파편화된 기존 워크플로우를 연결하여 알고리즘 비교와 다운스트림 애플리케이션 적용을 용이하게 합니다.
기존 LoRA의 정적인 업데이트 한계를 극복하기 위해 토큰 및 컨텍스트 수준에서 동적 상태를 반영하는 새로운 어댑터 제품군을 제안합니다. MaLoRA와 MaRA를 통해 언어 모델의 추론 정확도를 크게 향상시켰습니다.
긴 문맥(long-context) LLM이 문제를 해결하는 대신 입력 텍스트를 무분별하게 복사하는 '반복적 복사' 문제를 분석하고, 이를 해결하기 위한 GEAR(Grounding Evidence-Aware Reward) 강화학습 기법을 제안합니다.
VDAR-Router는 질의의 난이도를 분석하여 적절한 LLM을 할당하는 검색 기반 라우팅 프레임워크입니다. 기존의 의미론적 접근 대신 명시적인 난이도 분석과 유사 사례 검색을 통해 비용 대비 성능을 최적화합니다.
SEC 공시 자료의 특수성을 고려하여 코퍼스 불일치 문제를 해결하는 멀티 에이전트 RAG 프레임워크 FinSAgent를 제안합니다. 데이터베이스 인식 쿼리 분해와 특징 게이트형 재순위화기를 통해 검색 정확도와 답변 품질을 높였습니다.
개방형 작업에서 스칼라 보상 대신 풍부한 텍스트 피드백을 활용하는 'LLM-as-a-Coach' 기반의 경험적 학습(EL) 방식을 제안합니다. 이 방식은 고품질 응답 간의 미세한 차이를 보존하여 기존 루브릭 기반 강화학습보다 우수한 일반화 성능을 보입니다.
LLM의 아첨(Sycophancy) 및 단서 유도 편향이 정렬 튜닝 과정에서 발생함을 연구했습니다. 은닉 상태에서 편향별 방향을 추출하여 인과적 개입을 통해 편향을 제거하고 정답을 회복할 수 있음을 입증했습니다.
사용자의 신념 표현(EoB) 방식이 LLM의 맥락 수용 및 사전 지식 고수 여부에 미치는 영향을 연구했습니다. 언어학적 차원에 기반한 새로운 유형학을 도입하여 다양한 모델의 응답 패턴을 체계적으로 평가했습니다.
Transformer 아키텍처의 이산적 연산을 연속 기하학적 프레임워크로 모델링하는 새로운 연구를 제시합니다. 미분 기하학 및 확률 미적분학을 통해 RMSNorm, Attention, SGD 등 핵심 구성 요소를 정량적으로 분석하고 예측합니다.
LLM 에이전트의 전사 과정에서 발생할 수 있는 개인정보 및 자격 증명 유출을 방지하는 SlotGuard를 제안합니다. 기존 비식별화 방식의 한계를 극복하여 에이전트의 성능을 유지하면서도 민감한 데이터를 효과적으로 보호합니다.
LLM 탈옥 공격을 공격자 중심의 성공률이 아닌, 모델의 안전성 개선에 기여하는 방어자 중심 관점에서 평가하는 새로운 프레임워크 A-MESS를 제안합니다. Shapley 기반의 AttackSHAP 점수를 통해 공격의 유용성을 측정하고 최적의 공격 부분 집합을 선택하는 방법을 다룹니다.
키르기스어와 같은 저자원 언어의 LLM 평가를 위해 설계된 KyrgyzLLM-Bench 벤치마크를 소개합니다. 현지 작성 데이터와 정교하게 번역된 데이터셋을 통해 26개 모델의 성능과 교차 언어 전이 능력을 체계적으로 분석했습니다.
영어 기반의 LLM 안전성이 저자원 언어인 하우사어 환경에서 어떻게 변화하는지 연구했습니다. 실험 결과, 로컬 배포 가능한 소규모 모델들은 영어 대비 하우사어 사용 시 임상 정확도가 급격히 하락하는 '드리프트' 현상을 보였습니다.
LLM의 질문 순서 효과를 분석하기 위해 양자 질문 등식(QQ)을 감사 기준으로 활용하는 연구를 소개합니다. 연구 결과, 현재의 다음 토큰 로그 확률 방식은 모델의 포화 상태로 인해 분포 수준의 QQ 감사를 수행하기에 불충분함을 밝혀냈습니다.
불확실한 지식 그래프(UKG)를 활용하여 LLM의 환각 현상을 줄이는 새로운 프레임워크 Debate-on-Graph(DoG)를 제안합니다. 휴리스틱 탐색과 적응형 적대적 토론 메커니즘을 통해 노이즈가 포함된 지식 속에서도 신뢰할 수 있는 추론을 수행합니다.
멀티모달 감성 분석(MSA)에서 누락된 모달리티를 반드시 복구해야 하는지에 대한 의문을 제기합니다. 샘플별로 모달리티의 효용성이 다르다는 점에 착안하여, 복구 여부를 학습 가능한 결정으로 전환하는 SIEVE 프레임워크를 제안합니다.
한-영 의학 강의를 위한 사후 ASR 워크플로우인 AI_LectureNote의 성능을 평가한 연구입니다. Whisper와 GPT-4o를 활용해 의학 용어의 영문 표기 렌더링 성능은 향상되었으나, 의미론적 드리프트와 극성 오류가 발생함을 확인했습니다.
캐릭터와 세계가 상호작용하며 함께 진화하는 오픈 스키마 프레임워크인 EvolvingWorld를 제안합니다. LLM 기반의 캐릭터 에이전트와 월드 모델을 결합하여 장기적인 문학 시뮬레이션 성능을 개선하고 새로운 벤치마크를 제시합니다.
TalTech은 긴 의사-환자 대화에서 직접 SOAP 노트를 생성하는 BeTraC 챌린지에서 1위를 차지했습니다. LoRA 미세 조정과 DAPO 강화 학습을 통해 Voxtral 모델을 최적화하여 낮은 환각률과 높은 사실적 신뢰성을 입증했습니다.
LLM-as-judge 시스템 구축 시 합성 코퍼스 생성 과정에서 발생하는 구조적 결함과 테스트 오라클 문제를 분석한 연구입니다. 디코딩 파라미터 공유로 인한 데이터 왜곡 현상을 규명하고, 이를 방지하기 위한 검증 프로토콜을 제안합니다.