Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Ollama의 최신 버전은 아키텍처를 변경하여 GGML 대신 llama.cpp를 직접 지원하고 GGUF 파일 형식과의 호환성을 확보했습니다. Apple Silicon 환경에서는 MLX를 활용해 모델 추론 성능을 가속화합니다. 현재는 프리릴리스(Pre-release) 단계이므로 사용자 피드백을 요청하며, 특정 모델(laguna-xs.2, llama3.2-vision)은 지원되지 않습니다.
이번 업데이트는 mlx 라이브러리 및 관련 애플리케이션 전반에 걸친 여러 개선 사항을 포함합니다. 주요 내용은 모델 푸시 동작 개선, 통합 테스트 강화, 업데이트 흐름 안정화 등입니다. 특히 mlx에서는 스레드 친화도 지원 이미지 생성 러너 업데이트와 추론 중 상태 시간 초과 방지 등의 핵심적인 기술적 개선이 이루어졌습니다.
사용자 세션 관리와 관련된 알림 메시지('다른 탭이나 창에서 로그인/로그아웃/계정 전환')가 포함되어 있으며, MLX 라이브러리 사용 시 macOS SDK 버전 문제(metallib 대신 metal 호출)에 대한 기술적 해결책을 제시합니다. 이 문제를 임시로 해결하기 위해 설치 전 생성된 AIR 파일을 metallib로 다시 연결해야 합니다.
Ollama의 최신 업데이트에서는 Claude Desktop 통합 기능이 제거되었습니다. 이는 Anthropic 모델에 대한 제약 사항 때문입니다. 또한, 응답 캐싱 기능이 추가되어 VS Code와 같은 개발 환경에서 로드 속도가 평균 6.7배 향상되었으며, 전반적인 워크플로우 및 이미지 생성 레이아웃 개선도 이루어졌습니다.
이 업데이트는 Mac 환경에서 Gemma 4 모델에 Multi-token Processing (MTP)을 적용한 추측 디코딩(speculative decoding) 기능을 지원합니다. 이 기능은 특히 코딩 작업과 같은 복잡한 태스크에서 Gemma 4 31B 모델의 처리 속도를 2배 이상 향상시킬 수 있습니다.