Ollama v0.34.1 업데이트 내용
요약
Ollama v0.34.1 업데이트는 다양한 모델 로딩 및 실행 환경을 개선했습니다. 특히 mlxrunner의 메모리 관리 최적화와 llm 모듈의 토큰 반복 제한 상향 조정이 주요 변경 사항입니다. 또한, MLX 및 llama.cpp 관련 라이브러리가 업데이트되었습니다.
핵심 포인트
- mlxrunner: 시스템 메모리 확인 및 러너 대기 기능 추가로 안정성 향상
- llm: 토큰 반복 제한을 100으로 상향하고 오류 반환 방식으로 변경
- MLX 및 llama.cpp 업데이트를 통해 모델 실행 환경 개선
- gemma3n 프로젝트가 CPU에서 유지되도록 설정됨
변경 사항
- app: ChatGPT 모델 선택기 간격 수정
- mlxrunner: 활성 대화에서 접두사 캐시 스냅샷 제거
- mlxrunner: 시스템 사용 가능 메모리 확인 및 다음 MLX 모델 로드 전 이탈한 러너(runners) 대기
- llm: 토큰 반복 제한을 100으로 상향하고, 불완전한 결과 대신 오류 반환
- mlx: 고정(pinning) 및 스위핑(sweeping) 대신 배열 수명 범위 지정(scope array lifetimes)
- llm: gemma3n 프로젝트를 CPU에서 유지
- app: 앱 레이아웃 새로고침 및 명령어 복사 피드백
- MLX 및 llama.cpp 업데이트
전체 변경 로그: v0.34.0...v0.34.1-rc1
AI 자동 생성 콘텐츠
본 콘텐츠는 Ollama Releases의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기