Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
이 기술 기사는 특정 소프트웨어 버전(v0.22.1)의 업데이트 내용을 요약하고 있습니다. 주요 변경 사항으로는 mlxrunner에서 샘플러 배치 기능 추가, 토크나이저의 다중 정규식 BPE 오프셋 처리 수정, 그리고 mlx가 NVIDIA TensorRT 모델 최적화 임포트를 지원하게 된 점 등이 포함됩니다. 또한, 앱 서버 및 다양한 모델 관련 개선사항들이 적용되었습니다.
Ollama v0.21.3-rc0 릴리스가 공식 출시되었습니다. 이번 업데이트는 API 호출 시 'think' 파라미터에 'max' 값을 허용하도록 개선하고, OpenAI 모델의 응답 추론 노력(reasoning effort)을 Ollama의 'think' 필드와 매핑하여 호환성을 높였습니다. 개발자들은 이제 더 유연한 추론 설정과 원활한 OpenAI 생태계 통합을 경험할 수 있습니다.
Ollama v0.21.2 가 출시되었습니다. 이번 업데이트는 OpenClaw 온보딩 플로우의 신뢰성을 높이고, ollama launch 명령어에서 추천 모델이 고정된 순서로 표시되도록 개선했습니다. 또한 OpenClaw 통합에 Ollama 웹 검색 플러그인이 자동으로 포함되도록 변경되어 설치 과정이 간소화되었습니다.
이번 Ollama v0.21.0 버전은 주요 모델인 Gemma 4를 Apple Silicon 환경에서 MLX 백엔드를 통해 실행할 수 있도록 지원하는 것이 가장 큰 변화입니다. 이를 통해 사용자는 Mac 환경에서 최적화된 성능으로 Gemma 4를 활용할 수 있게 되었습니다. 또한, 'ollama launch' 기능에 Hermes Agent와 GitHub Copilot CLI 통합이 추가되어, 다양한 코딩 에이전트를 하나의 명령어로 쉽게 설정하고 관리할 수 있게 되었습니다. 이 외에도 여러 설정 파일 관련 버그 수정 및 빌드 안정성(
Ollama의 최신 버전인 v0.21.1이 출시되어 사용자들에게 다양한 기능 개선 사항을 제공합니다. 가장 주목할 만한 변화는 Kimi CLI를 Ollama를 통해 직접 설치하고 실행할 수 있게 되었다는 점입니다. 이를 통해 장기적인 에이전트 작업 수행에 강점을 가진 Kimi-K2.6 모델을 활용할 수 있습니다. 또한, MLX 러너의 성능과 안정성이 대폭 향상되었으며, GLM4 MoE Lite와 같은 특정 모델의 효율성 개선도 이루어졌습니다. macOS 앱의 버그 수정 및 Gemma 4를 위한 구조화된 출력 기능 추가 등 전반적인