Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
llama.cpp가 b9509 버전으로 업데이트되었습니다. 이번 업데이트는 Gemma 4 12B 멀티모달 프로젝터 사용 시 x86, CUDA, Linux, Windows 환경에서 발생하던 divide-by-zero 충돌 문제를 해결합니다.
Ollama가 GGML 대신 llama.cpp를 직접 지원하도록 아키텍처를 변경하여 GGUF 파일 호환성을 강화했습니다. 또한 Apple Silicon 가속을 위해 MLX를 도입하였으며, 현재 사전 출시 단계로 성능 및 메모리 피드백을 수집 중입니다.
Ollama가 GGML 대신 llama.cpp를 직접 지원하도록 아키텍처를 변경하고 GGUF 파일 호환성을 확보했습니다. Apple Silicon 환경에서 MLX를 통해 추론 성능을 가속화하며, 현재 프리릴리스 단계에서 피드백을 수집 중입니다.
Ollama가 GGML 대신 llama.cpp를 직접 지원하도록 아키텍처를 변경하며 GGUF 형식과 호환됩니다. Apple Silicon 가속을 위해 MLX를 도입하였으며, 현재 프리릴리스 단계에서 성능 및 메모리 피드백을 수집 중입니다.
Ollama의 최신 프리릴리스 버전은 기존 GGML 기반 아키텍처에서 llama.cpp를 직접 지원하는 방식으로 변경되었으며, GGUF 파일 형식과의 호환성을 확보했습니다. 또한 Apple Silicon 환경에서 모델 추론 가속화를 위해 MLX를 도입하여 성능 최적화를 꾀했습니다.
Ollama의 새로운 버전은 GGML 대신 llama.cpp를 직접 지원하도록 아키텍처를 변경하여 GGUF 파일 형식과의 호환성을 확보했습니다. 또한 Apple Silicon 환경에서 추론 가속을 위해 MLX를 도입하였으며, 현재 사전 출시(Pre-release) 단계로 성능 및 메모리 사용량에 대한 피드백을 요청하고 있습니다.
Ollama v0.30.0 버전은 아키텍처를 변경하여 llama.cpp를 직접 지원하며 GGUF 파일 형식과의 호환성을 확보했습니다. 또한 Apple Silicon 환경에서 MLX를 활용해 모델 추론 가속을 지원합니다.
이 문서는 사용자 세션 관리와 CI/CD(지속적 통합/배포) 파이프라인 개선 사항에 대한 알림과 업데이트 내용을 담고 있습니다. 사용자에게는 다른 탭이나 창에서 로그인, 로그아웃, 계정 전환이 발생했을 때 세션을 새로 고치도록 요청하는 경고 메시지가 표시됩니다. 개발 측면에서는 릴리스 빌드 및 로컬 개발자 빌드의 속도 향상, CI의 리눅스 빌드 단계 최적화 등이 주요 개선 사항으로 안내되고 있습니다.
사용자가 현재 보고 있는 웹페이지가 다른 브라우저 탭이나 창에서 로그인, 로그아웃, 또는 계정 전환 등의 활동이 발생했음을 알려주는 시스템 메시지입니다. 이러한 세션 변경 사항을 감지했을 때 사용자에게 알림을 제공하며, 최신 상태를 반영하기 위해 페이지를 새로고침할 것을 권장하고 있습니다.
이 기술 기사는 주로 사용자 세션 관리와 관련된 알림 메시지('다른 탭이나 창에서 로그인/로그아웃/계정 전환')를 다루고 있으며, 개발 측면에서는 Windows 및 Mac 업데이트 흐름을 개선하고 CI 트리거 단위 테스트를 추가하는 앱 업데이트와 OLLAMA_MODELS 환경 변수 관련 단위 테스트 강화를 포함합니다. 전반적으로 애플리케이션의 안정성과 업데이트 검증 프로세스를 강화하는 데 초점을 맞추고 있습니다.
Claude Desktop 애플리케이션이 Ollama Launch 기능을 지원하며, 이를 통해 Claude Cowork와 Claude Code 기능에 접근할 수 있게 되었습니다. 사용자는 터미널에서 `ollama launch claude` 명령어를 사용하여 여전히 Claude Code를 실행할 수 있습니다. 이번 업데이트에서는 Ollama 앱의 서버 기반 추천 모델 표시가 개선되었고, Windows 환경에서의 OpenClaw 게이트웨이 타임아웃 문제 및 Metal 초기화 관련 안정성 향상도 이루어졌습니다.
이 버전(v0.22.1)은 Gemma 4 모델의 렌더러를 업데이트하여 추론(thinking) 및 도구 호출(tool calling) 기능을 개선했습니다. 또한, Ollama 업데이트 없이도 최신 모델 추천을 받을 수 있게 되었으며, `ollama launch` 기능과 데스크톱 앱의 사용자 인터페이스 정렬이 이루어졌습니다.
이 버전(v0.22.1)은 여러 주요 업데이트를 포함하고 있으며, 특히 mlxrunner에서 여러 시퀀스에 대한 샘플러 배치 처리를 지원하도록 개선되었습니다. 또한 토크나이저의 다중 정규식 BPE 오프셋 처리 수정, NVIDIA TensorRT Model Optimizer 가져오기 지원 등 모델 및 인프라 관련 기능들이 강화되었습니다. 전반적으로 모델 배포와 성능 최적화에 초점을 맞춘 업데이트입니다.
이 기술 기사는 새로운 버전(v0.22.0)의 출시를 알리며, 특히 NVIDIA의 Nemotron 3 Omni Poolside와 같은 최신 모델과 연관된 오픈 가중치 코딩 모델인 Laguna XS.2에 대한 변경 로그를 제공합니다. 이는 개발자들이 해당 모델을 활용하여 코딩 및 AI 관련 작업을 수행할 수 있도록 업데이트 내용을 안내하는 목적을 가지고 있습니다.
이 기술 기사는 특정 소프트웨어 버전(v0.22.1)의 업데이트 내용을 요약하고 있습니다. 주요 변경 사항으로는 mlxrunner에서 샘플러 배치 기능 추가, 토크나이저의 다중 정규식 BPE 오프셋 처리 수정, 그리고 mlx가 NVIDIA TensorRT 모델 최적화 임포트를 지원하게 된 점 등이 포함됩니다. 또한, 앱 서버 및 다양한 모델 관련 개선사항들이 적용되었습니다.
Ollama v0.21.3-rc0 릴리스가 공식 출시되었습니다. 이번 업데이트는 API 호출 시 'think' 파라미터에 'max' 값을 허용하도록 개선하고, OpenAI 모델의 응답 추론 노력(reasoning effort)을 Ollama의 'think' 필드와 매핑하여 호환성을 높였습니다. 개발자들은 이제 더 유연한 추론 설정과 원활한 OpenAI 생태계 통합을 경험할 수 있습니다.
Ollama v0.21.2 가 출시되었습니다. 이번 업데이트는 OpenClaw 온보딩 플로우의 신뢰성을 높이고, ollama launch 명령어에서 추천 모델이 고정된 순서로 표시되도록 개선했습니다. 또한 OpenClaw 통합에 Ollama 웹 검색 플러그인이 자동으로 포함되도록 변경되어 설치 과정이 간소화되었습니다.
이번 Ollama v0.21.0 버전은 주요 모델인 Gemma 4를 Apple Silicon 환경에서 MLX 백엔드를 통해 실행할 수 있도록 지원하는 것이 가장 큰 변화입니다. 이를 통해 사용자는 Mac 환경에서 최적화된 성능으로 Gemma 4를 활용할 수 있게 되었습니다. 또한, 'ollama launch' 기능에 Hermes Agent와 GitHub Copilot CLI 통합이 추가되어, 다양한 코딩 에이전트를 하나의 명령어로 쉽게 설정하고 관리할 수 있게 되었습니다. 이 외에도 여러 설정 파일 관련 버그 수정 및 빌드 안정성(
Ollama의 최신 버전인 v0.21.1이 출시되어 사용자들에게 다양한 기능 개선 사항을 제공합니다. 가장 주목할 만한 변화는 Kimi CLI를 Ollama를 통해 직접 설치하고 실행할 수 있게 되었다는 점입니다. 이를 통해 장기적인 에이전트 작업 수행에 강점을 가진 Kimi-K2.6 모델을 활용할 수 있습니다. 또한, MLX 러너의 성능과 안정성이 대폭 향상되었으며, GLM4 MoE Lite와 같은 특정 모델의 효율성 개선도 이루어졌습니다. macOS 앱의 버그 수정 및 Gemma 4를 위한 구조화된 출력 기능 추가 등 전반적인