Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
이번 v5.8.0 릴리스는 DeepSeek-V4와 같은 최신 MoE(Mixture of Experts) 언어 모델을 추가하고, Gemma 4 Assistant를 통해 스페큘레이티브 디코딩 기능을 강화했습니다. 또한, Granite Vision 4.1과 EXAONE 4.5와 같이 문서 이해 및 멀티모달 능력을 대폭 향상시킨 비전-언어 모델들이 도입되었습니다. 이 외에도 오디오 전사(GraniteSpeechPlus) 및 복잡한 구조의 표/수식 인식(PP-FormulaNet) 등 다양한 전문 분야의 기능을 업데이트했습니다.
Hugging Face Transformers 라이브러리의 초소형 패치 릴리스 v5.5.1이 출시되었습니다. 이번 업데이트는 주요 모델인 Gemma4의 내보내기(export) 기능 오류를 해결하고, vLLM 관련 cis 문제를 수정하는 데 집중했습니다. @Cyrilvallez 와 @ArthurZucker 가 기여한 이 변경사항은 #45285 와 #45139 이슈를 통해 반영되었으며, Gemma4 모델의 원활한 배포와 vLLM과의 통합 테스트 안정성을 확보합니다.
Hugging Face의 Transformers 라이브러리 v5.6.1 버전이 출시되었습니다. 이번 릴리스는 이전 버전에서 발생했던 'Flash Attention' 경로의 심각한 결함을 해결합니다. 구체적으로 `flash_attention_forward` 함수 내에서 `s_aux=None` 인자가 주어졌을 때 발생하는 AttributeError 문제를 수정했습니다. 이 업데이트를 통해 Flash Attention 기반 모델을 안정적으로 실행할 수 있게 되었으며, 관련 개발자들은 최신 버전을 설치하여 사용해야 합니다.
TL;DR: Hugging Face의 Transformers 라이브러리 v5.6.2 패치가 출시되었습니다. 주요 변경사항은 Qwen 3.5 및 3.6 MoE (text-only) 모델이 FP8 정밀도를 사용할 때 발생하는 작동 오류를 수정한 것입니다. 또한, @hmellor 가 기여한 커널 구성 읽기 및 에러 핸들링 개선 사항 (#45610) 이 포함되어 있어 안정성이 향상되었습니다.