Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
llama.cpp 프로젝트에 Tencent Hunyuan 3(Hy3) 아키텍처 지원이 추가되었습니다. MTP speculative decoding을 지원하며, MoE(Mixture-of-Experts) 구조를 갖춘 Hy3 모델을 GGUF 형식으로 사용할 수 있습니다.
llama.cpp의 b9585 버전 릴리스 노트로, 다양한 플랫폼(macOS, Linux, Android) 및 아키텍처에 대한 빌드 바이너리를 제공합니다. 주요 업데이트로는 deepstack 미사용 시 임베딩 스케일 적용 수정과 테스트에서 존재하지 않는 모델 제거 등이 포함되었습니다.
llama.cpp 프로젝트에서 Gemma-4 E2B 및 E4B 어시스턴트 모델 지원을 위한 업데이트가 진행되었습니다. 모델 컨버터 업데이트와 함께 gemma4-assist 아키텍처를 위한 masked_embd 텐서 추가 및 관련 디버그 코드가 정리되었습니다.