Ollama v0.34.1 릴리스 노트
요약
Ollama v0.34.1 릴리스 노트는 다양한 모델 및 애플리케이션 개선 사항을 담고 있습니다. 주요 변경점으로는 토큰 반복 제한 상향 조정, 메모리 관리 최적화, 그리고 MLX 및 llama.cpp 업데이트가 포함되었습니다. 이는 사용자 경험과 시스템 안정성을 전반적으로 향상시킵니다.
핵심 포인트
- 토큰 반복 제한이 100으로 상향되어 오류 처리가 개선됨.
- mlxrunner에서 메모리 관리 로직이 최적화되었음.
- MLX 및 llama.cpp가 업데이트되어 성능과 호환성이 향상됨.
- 앱 레이아웃 및 사용자 피드백 기능이 추가됨.
변경 사항
- app: ChatGPT 모델 선택기 간격 수정
- mlxrunner: 활성 대화에서 접두사 캐시 스냅샷 제거
- mlxrunner: 시스템 사용 가능 메모리 확인 및 다음 MLX 모델 로드 전에 제거된 러너 대기
- llm: 토큰 반복 제한을 100으로 상향 조정하고 불완전한 결과 대신 오류 반환
- mlx: 고정(pinning) 및 스윕(sweeping) 대신 배열 수명 범위 지정(scope array lifetimes)
- llm: gemma3n 프로젝트를 CPU에서 유지
- app: 앱 레이아웃 새로고침 및 명령어 복사 피드백
- MLX 및 llama.cpp 업데이트
전체 변경 로그: v0.34.0...v0.34.1-rc1
AI 자동 생성 콘텐츠
본 콘텐츠는 Ollama Releases의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기