upstream Laguna 구현을 반영하기 위해 llama.cpp를 업데이트하고 Ollama의 로컬 Laguna 구현을 제거합니다
요약
llama.cpp의 최신 Laguna 구현을 반영하기 위해 Ollama를 업데이트합니다. 기존 로컬 구현을 제거하고 upstream 코드를 통합하며, 기존 모델과의 호환성을 위해 메타데이터 이름을 번역하는 작업을 포함합니다.
핵심 포인트
- upstream Laguna 구현 반영을 위한 llama.cpp 업데이트
- Ollama 내 기존 로컬 Laguna 구현 제거
- Metal 전용 스케일링 워크아라운드 유지
- 기존 GGUF 모델 호환성을 위한 메타데이터 이름 번역
upstream Laguna 구현을 반영하기 위해 llama.cpp를 업데이트하고 Ollama의 로컬 Laguna 구현을 제거합니다. routed-MoE 프롬프트 오버플로(prompt overflow)를 위한 제한적인 Metal 전용 스케일링 워크아라운드(workaround)는 유지합니다.
기존 모델들이 계속 로드될 수 있도록 이전 Ollama GGUF의 attention-gate 및 SWA 메타데이터 이름을 번역합니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 RSS: GitHub ollama/ollama releases의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기