llama.cpp 패치 세트가 필요한 레거시 GGUF를 로드할 때, 우리는 llama.cpp와 호환되도록 디스크에 지연 변환(lazy conve
요약
llama.cpp는 레거시 GGUF 모델 로딩 시 호환성을 유지하기 위해 지연 변환(lazy conversion)을 수행합니다. 이를 위해 새롭고 오래된 GGUF 버전을 임시로 보관하고, 다운그레이드 서버가 새로운 블롭 삭제를 막기 위한 섀도우 매니페스트 태그를 생성했습니다.
핵심 포인트
- 레거시 GGUF 로딩 시 호환성을 유지하기 위해 지연 변환을 사용합니다.
- 새로운/오래된 GGUF 버전을 임시로 보관하고 관리합니다.
- 다운그레이드 서버의 블롭 삭제 방지를 위한 섀도우 매니페스트 태그가 추가되었습니다.
llama.cpp 패치 세트가 필요한 레거시 GGUF를 로드할 때, 우리는 llama.cpp와 호환되도록 디스크에 지연 변환(lazy conversion)을 수행합니다. 다운그레이드를 지원하기 위해, 우리는 새 GGUF와 오래된 GGUF를 일시적으로 보관하고, 다운그레이드된 서버가 새로운 블롭(blobs)을 삭제하는 것을 방지하기 위해 임시 섀도우 v1 매니페스트 태그를 생성합니다. 이러한 항목들이 목록 출력에 표시되는 것은 사용자 및 API 소비자에게 혼란을 줄 수 있습니다. 레거시 복사본들은 나중에 디스크 공간을 확보하기 위해 향후 릴리스에서 제거될 예정입니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Ollama Releases의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기