Ollama의 이번 버전은 GGML을 기반으로 구축하는 대신 llama.cpp를 직접 지원하도록 아키텍처를 변경하며, GGUF 파일 형식과의 호
요약
Ollama의 최신 프리릴리스 버전은 기존 GGML 기반 아키텍처에서 llama.cpp를 직접 지원하는 방식으로 변경되었으며, GGUF 파일 형식과의 호환성을 확보했습니다. 또한 Apple Silicon 환경에서 모델 추론 가속화를 위해 MLX를 도입하여 성능 최적화를 꾀했습니다.
핵심 포인트
- llama.cpp 직접 지원을 통한 아키텍처 변경 및 GGUF 형식 호환성 제공
- Apple Silicon 사용자를 위한 MLX 기반 추론 가속화 적용
- laguna-xs.2 및 llama3.2-vision 모델은 현재 프리릴리스에서 미지원
- Mac, Linux, Windows 환경을 위한 특정 버전 설치 명령어 제공
Ollama의 이번 버전은 GGML을 기반으로 구축하는 대신 llama.cpp를 직접 지원하도록 아키텍처를 변경하며, GGUF 파일 형식과의 호환성을 허용합니다. Apple Silicon에서 모델 추론 (Inference)을 가속화하기 위해 MLX가 사용됩니다. 프리릴리스 (Pre-release) 단계 동안 다음과 같은 피드백을 부탁드립니다:
- 성능 향상 또는 저하
- 이전에 발생하지 않았던 오류 또는 충돌
- 메모리 사용량 향상 또는 저하
알려진 문제:
- laguna-xs.2는 아직 이 프리릴리스에서 지원되지 않습니다.
- llama3.2-vision은 아직 이 프리릴리스에서 지원되지 않습니다.
설치 방법:
Mac/Linux
curl -fsSL https://ollama.com/install.sh | OLLAMA_VERSION=0.30.0-rc21 sh
Windows
$env:OLLAMA_VERSION="0.30.0-rc21"; irm https://ollama.com/install.ps1 | iex
AI 자동 생성 콘텐츠
본 콘텐츠는 Ollama Releases의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기