Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
SkillPyramid는 AI 에이전트가 경험을 재사용 가능한 자산으로 변환할 수 있도록 돕는 계층적 기술 통합 프레임워크입니다. 자가 진화 메커니즘을 통해 새로운 기술을 구성하고 검증하며, 기존의 정적인 기술 풀을 동적인 진화 시스템으로 전환합니다.
의료 시각-언어 모델(VLM)이 비영어권 환경에서 보이는 강건성을 평가하기 위해 인도네시아어 방사선 VQA 데이터셋인 IndoRad-VQA를 제안합니다. 연구 결과, 영어와 인도네시아어 간에 8%에서 25%의 성능 격차가 발생함을 확인했습니다.
언어 모델에서 특정 지식을 안전하게 삭제하기 위해 임베딩 레이어에 개입하는 EMBER 기술을 제안합니다. 희소 행렬 분해를 통해 토큰 임베딩의 개념 관련 특징을 정밀하게 제거하여, 기존 방식보다 재학습에 대한 강건성을 크게 높였습니다.
법률 QA 시스템의 RAG 성능 향상을 위해 의미적 유사성 대신 섭동 기반 귀속 점수를 활용한 재순위화(Re-ranking) 기법을 제안합니다. 이 방식은 인용 충실도와 전문가 답변과의 정렬을 개선하며, 모델 불가지론적인 학습 신호를 제공함을 입증했습니다.
Entropy Gate는 LLM의 불필요한 토큰을 제거하여 의미적 충실도를 유지하며 압축하는 새로운 프레임워크입니다. 열역학적 개념인 엔트로피 억제를 활용해 토큰의 정보 에너지를 계산하고, 이를 기반으로 효율적인 컨텍스트 관리를 수행합니다.
이주 뉴스 프레임 분석을 위해 Llama3-8B와 구조화된 사고 사슬(SCoT) 프롬프팅을 활용하는 연구를 소개합니다. 로컬 오픈 소스 LLM을 통해 데이터 프라이버시와 재현성 문제를 해결하며, 모델의 추론 과정을 투명하게 공개하여 인간의 해석을 지원합니다.
HybridThinker는 CoT 압축 시 발생하는 정보 손실 문제를 해결하기 위해 압축된 메모리 토큰과 일시적 사고 단계를 병행 사용하는 새로운 연구를 제안합니다. 하이브리드 학습 체계를 통해 모델이 메모리 토큰을 효과적으로 활용하도록 유도하며, 기존 압축 방식 대비 높은 정확도를 달성했습니다.
KletterMix는 고품질 독일어 언어 모델 학습을 위해 설계된 사전 학습 및 어닐링용 코퍼스입니다. 최첨단 영어 데이터셋을 독일어로 번역하여 구축되었으며, 문서의 구조와 주제적 다양성을 유지하면서도 원본과의 비교가 가능하도록 설계되었습니다.
희소 MoE 모델에서 사실적 회상이 발생하는 메커니즘을 분석하기 위해 '전문가 인지적 인과적 추적' 방법론을 제안합니다. Qwen 및 Mixtral 모델 실험을 통해 특정 전문가가 정보 국지화에 기여하거나 다수 전문가의 연합이 필요함을 입증했습니다.
LLM을 활용한 저자원 언어 기계 번역 성능 향상을 위해 문법적 추론 흔적(Reasoning Traces)을 활용하는 연구를 제안합니다. 실험 결과, 추론 시 가이드로 활용하는 것이 학습 데이터로 사용하는 것보다 번역 성능 향상에 더 효과적임을 확인했습니다.
LLM 내 미지의 백도어 공격을 방어하기 위해 언러닝(unlearning)의 일반화 가능성을 연구합니다. 특정 트리거를 제거하는 것만으로도 명시적으로 타겟팅되지 않은 다른 백도어까지 억제할 수 있음을 입증했습니다.
본 연구는 다국어 멀티모달 거대 언어 모델(MLLM)의 적대적 강건성과 안전 정렬을 체계적으로 분석합니다. 12개 언어를 대상으로 실험한 결과, 공격의 교차 언어 전이성과 저자원 언어에서 발생하는 '실패에 의한 안전(safety-by-failure)' 현상을 규명했습니다.
본 연구는 언어 모델을 통해 관용구의 분해 가능성과 통사적 유연성 사이의 관계를 분석합니다. 실험 결과, 관용구의 안정화는 단순 빈도보다 분해 가능성이 더 강력한 영향을 미친다는 것을 입증했습니다.
Transformer 아키텍처의 성능을 높이기 위해 입력 의존적 필터를 사용하는 동적 단기 컨볼루션(Dynamic Short Convolutions)을 제안합니다. 이 방식은 국소성 편향을 유지하면서 표현력을 높여 연상 회상 작업과 언어 모델링 성능을 크게 향상시킵니다.
시각적 지시어 튜닝이 LLM의 중간 의미론적 레이어에 시각적 특징을 어떻게 임베딩하고 정렬하는지 분석합니다. 연구 결과, 튜닝은 초기 레이어를 우회하여 중간 레이어를 시각-언어 처리의 핵심으로 활용하며, 이를 통해 효율적인 멀티모달 통합이 가능함을 입증했습니다.
실제 개발자와 에이전트 간의 세션을 반영한 새로운 벤치마크 프레임워크인 RealClawBench를 소개합니다. 재구성된 실행 환경과 결정론적 검증 메커니즘을 통해 실제 워크로드의 복잡성을 자동화된 평가로 전환합니다.
본 연구는 Masked Diffusion Models(MDMs)에서의 지식 편집 가능성을 탐구합니다. 기존의 '위치 파악 후 편집' 방식이 MDM에서도 유효한지 분석하며, 다중 토큰 편집 시 발생하는 성능 저하 원인을 규명하고 이를 해결하기 위한 교정 방법을 제안합니다.
추론 모델의 긴 출력으로 인한 메모리 병목을 해결하기 위해 가치 인지형 확률적 KV 캐시 제거 방식인 VaSE를 제안합니다. VaSE는 크기가 큰 가치 상태를 보호하고 확률성을 도입하여 기존 방식보다 높은 정확도와 압축 효율을 제공합니다.
Skill-RM은 이기종 평가 기준을 통합하기 위해 보상 모델링을 재사용 가능한 '에이전트 기술'로 재정의하는 새로운 프레임워크입니다. 보상 계산을 구조화된 에이전트 작업으로 처리하여 다양한 증거를 동적으로 선택하고 집계함으로써 기존 모델보다 뛰어난 성능을 보여줍니다.
IWSLT 2026 제출을 위해 개발된 Canary 모델은 AlignAtt 정책을 활용하여 동시 음성-텍스트 번역을 구현합니다. 1B 파라미터 규모의 소형 모델임에도 불구하고 저지연 및 고지연 환경 모두에서 기존 베이스라인 대비 뛰어난 번역 품질을 보여줍니다.