Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 LLM 앙상블의 성능 향상 잠재력을 인정하면서도, 전통적인 방식이 수반하는 높은 계산 비용 문제를 해결하기 위해 '혼합 모델과 유사한 앙상블(ME)'을 제안합니다. ME는 전체 앙상블 분포를 명시적으로 계산할 필요 없이, 토큰 생성 단계마다 확률적으로 단일 모델을 선택하여 사용하는 방식으로 작동합니다. 이 접근 방식은 기존 앙상블 방법과 수학적으로 동등하면서도 호출 비용을 크게 줄여 효율성을 높입니다.
본 연구는 대규모 언어 모델(LLMs)의 높은 계산 요구 사항 문제를 해결하기 위해, 30억~40억 파라미터 규모의 소형 언어 모델(SLMs)을 활용하여 방사선학 분야의 다중 작업 성능을 개선하는 방법을 제시합니다. LoRA 파인튜닝 기법을 통해 다양한 임상 과제에 걸쳐 SLM들을 성공적으로 훈련시켰으며, 이를 GGUF 형식으로 양자화하여 소비자급 CPU 환경에서도 효율적으로 배포할 수 있음을 입증했습니다.
본 논문은 연구 결과를 일반 독자에게 전달하는 '평이어 요약(PLS)'의 한계를 지적하며, LLM 기반의 개인화된 PLS가 이 문제를 해결할 수 있는 대안임을 제시합니다. 저자들은 사용자 특성 및 이해도를 고려한 ReLay 데이터셋을 구축하고 이를 활용하여 5개의 LLM을 평가했습니다. 연구 결과, 개인화는 독자의 이해도와 품질 인식을 높이지만, 동시에 사용자의 편향 강화나 환각(hallucinations) 도입과 같은 안전성 위험을 증가시키는 트레이드오프가 있음을 보여줍니다.
AGoQ는 대규모 언어 모델(LLM)의 메모리 효율적인 분산 훈련을 위해 활성화와 경사 양자화 기술을 결합한 새로운 프레임워크입니다. 이 방법은 레이어별로 최적의 비트 폭을 할당하여 활성화를 거의 4-bit 수준으로 저장하고, 통신 시간을 줄이는 8-bit 경사 및 All-Reduce를 사용합니다. 실험 결과, AGoQ는 기존 최고 수준의 분산 훈련 시스템 대비 메모리를 최대 52% 절감하고 훈련 속도를 크게 향상시키면서도 모델 정확도를 유지할 수 있음을 입증했습니다.
본 기술 기사는 LLM의 글로벌 배포에 따른 안전성 확보 문제를 다루며, 14개 언어를 포괄하는 정책 기반 다국어 안전 벤치마크인 ML-Bench를 소개합니다. ML-Bench는 지역 규정 및 법적 텍스트에서 파생된 위험 범주와 세부 규칙을 사용하여 문화적/법적으로 정렬된 평가가 가능하게 합니다. 또한, 이를 기반으로 다국어 안전 판단과 정책 조건부 준수 평가를 지원하는 Diffusion LLM(dLLM) 기반 방벽 모델인 ML-Guard를 개발했으며, 기존 벤치마크 대비 우수한 성능을 입증했습니다.
본 논문은 루크셈부르크의 다언어 사회에서 나타나는 '언어 이데올로기'를 탐지하는 데 대규모 언어 모델(LLM)을 활용하는 방법을 제시한다. 연구진은 Luxembourgish 사용자 댓글 데이터셋을 수동으로 주석화하고, 다양한 프롬프트 조건 하에서 LLM의 성능을 평가하여 인간의 주석 능력을 모방할 수 있는지 검증했다. 또한, 소규모 언어인 Luxembourgish 데이터를 고자원 언어로 기계 번역하는 것이 이데올로기 탐지 작업에 미치는 영향도 분석하였다.