Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
llama.cpp가 b9509 버전으로 업데이트되었습니다. 이번 업데이트는 Gemma 4 12B 멀티모달 프로젝터 사용 시 x86, CUDA, Linux, Windows 환경에서 발생하던 divide-by-zero 충돌 문제를 해결합니다.
Ollama가 GGML 대신 llama.cpp를 직접 지원하도록 아키텍처를 변경하여 GGUF 파일 호환성을 강화했습니다. 또한 Apple Silicon 가속을 위해 MLX를 도입하였으며, 현재 사전 출시 단계로 성능 및 메모리 피드백을 수집 중입니다.
Ollama가 GGML 대신 llama.cpp를 직접 지원하도록 아키텍처를 변경하고 GGUF 파일 호환성을 확보했습니다. Apple Silicon 환경에서 MLX를 통해 추론 성능을 가속화하며, 현재 프리릴리스 단계에서 피드백을 수집 중입니다.
Ollama가 GGML 대신 llama.cpp를 직접 지원하도록 아키텍처를 변경하며 GGUF 형식과 호환됩니다. Apple Silicon 가속을 위해 MLX를 도입하였으며, 현재 프리릴리스 단계에서 성능 및 메모리 피드백을 수집 중입니다.
Ollama의 최신 프리릴리스 버전은 기존 GGML 기반 아키텍처에서 llama.cpp를 직접 지원하는 방식으로 변경되었으며, GGUF 파일 형식과의 호환성을 확보했습니다. 또한 Apple Silicon 환경에서 모델 추론 가속화를 위해 MLX를 도입하여 성능 최적화를 꾀했습니다.
Ollama의 새로운 버전은 GGML 대신 llama.cpp를 직접 지원하도록 아키텍처를 변경하여 GGUF 파일 형식과의 호환성을 확보했습니다. 또한 Apple Silicon 환경에서 추론 가속을 위해 MLX를 도입하였으며, 현재 사전 출시(Pre-release) 단계로 성능 및 메모리 사용량에 대한 피드백을 요청하고 있습니다.
Ollama v0.30.0 버전은 아키텍처를 변경하여 llama.cpp를 직접 지원하며 GGUF 파일 형식과의 호환성을 확보했습니다. 또한 Apple Silicon 환경에서 MLX를 활용해 모델 추론 가속을 지원합니다.
이 문서는 사용자 세션 관리와 CI/CD(지속적 통합/배포) 파이프라인 개선 사항에 대한 알림과 업데이트 내용을 담고 있습니다. 사용자에게는 다른 탭이나 창에서 로그인, 로그아웃, 계정 전환이 발생했을 때 세션을 새로 고치도록 요청하는 경고 메시지가 표시됩니다. 개발 측면에서는 릴리스 빌드 및 로컬 개발자 빌드의 속도 향상, CI의 리눅스 빌드 단계 최적화 등이 주요 개선 사항으로 안내되고 있습니다.
Codex App이 이제 Ollama에서 사용 가능해졌으며, 로컬 또는 클라우드의 모든 Ollama 모델을 활용하여 코딩, 브라우징 및 리뷰 작업을 수행할 수 있습니다. 이 앱은 내장 브라우저를 통해 웹 페이지에 직접 주석을 달아 변경 사항을 요청하거나, 작업 공간을 벗어나지 않고 코드 리뷰 및 반복 작업을 할 수 있는 '리뷰 모드'를 제공합니다. 또한, 사용자는 다양한 모델(예: kimi-k2.6, nemotron-3-super, gemma4:31b 등) 중 자신의 필요에 맞는 것을 선택하여 사용할 수 있습니다.
사용자가 현재 보고 있는 웹페이지가 다른 브라우저 탭이나 창에서 로그인, 로그아웃, 또는 계정 전환 등의 활동이 발생했음을 알려주는 시스템 메시지입니다. 이러한 세션 변경 사항을 감지했을 때 사용자에게 알림을 제공하며, 최신 상태를 반영하기 위해 페이지를 새로고침할 것을 권장하고 있습니다.
Ollama의 최신 버전은 아키텍처를 변경하여 GGML 대신 llama.cpp를 직접 지원하고 GGUF 파일 형식과의 호환성을 확보했습니다. Apple Silicon 환경에서는 MLX를 활용해 모델 추론 성능을 가속화합니다. 현재는 프리릴리스(Pre-release) 단계이므로 사용자 피드백을 요청하며, 특정 모델(laguna-xs.2, llama3.2-vision)은 지원되지 않습니다.
이번 업데이트는 mlx 라이브러리 및 관련 애플리케이션 전반에 걸친 여러 개선 사항을 포함합니다. 주요 내용은 모델 푸시 동작 개선, 통합 테스트 강화, 업데이트 흐름 안정화 등입니다. 특히 mlx에서는 스레드 친화도 지원 이미지 생성 러너 업데이트와 추론 중 상태 시간 초과 방지 등의 핵심적인 기술적 개선이 이루어졌습니다.
사용자 세션 관리와 관련된 알림 메시지('다른 탭이나 창에서 로그인/로그아웃/계정 전환')가 포함되어 있으며, MLX 라이브러리 사용 시 macOS SDK 버전 문제(metallib 대신 metal 호출)에 대한 기술적 해결책을 제시합니다. 이 문제를 임시로 해결하기 위해 설치 전 생성된 AIR 파일을 metallib로 다시 연결해야 합니다.
이 기술 기사는 주로 사용자 세션 관리와 관련된 알림 메시지('다른 탭이나 창에서 로그인/로그아웃/계정 전환')를 다루고 있으며, 개발 측면에서는 Windows 및 Mac 업데이트 흐름을 개선하고 CI 트리거 단위 테스트를 추가하는 앱 업데이트와 OLLAMA_MODELS 환경 변수 관련 단위 테스트 강화를 포함합니다. 전반적으로 애플리케이션의 안정성과 업데이트 검증 프로세스를 강화하는 데 초점을 맞추고 있습니다.
Ollama의 최신 업데이트에서는 Claude Desktop 통합 기능이 제거되었습니다. 이는 Anthropic 모델에 대한 제약 사항 때문입니다. 또한, 응답 캐싱 기능이 추가되어 VS Code와 같은 개발 환경에서 로드 속도가 평균 6.7배 향상되었으며, 전반적인 워크플로우 및 이미지 생성 레이아웃 개선도 이루어졌습니다.
이 업데이트는 Mac 환경에서 Gemma 4 모델에 Multi-token Processing (MTP)을 적용한 추측 디코딩(speculative decoding) 기능을 지원합니다. 이 기능은 특히 코딩 작업과 같은 복잡한 태스크에서 Gemma 4 31B 모델의 처리 속도를 2배 이상 향상시킬 수 있습니다.
Claude Desktop 애플리케이션이 Ollama Launch 기능을 지원하며, 이를 통해 Claude Cowork와 Claude Code 기능에 접근할 수 있게 되었습니다. 사용자는 터미널에서 `ollama launch claude` 명령어를 사용하여 여전히 Claude Code를 실행할 수 있습니다. 이번 업데이트에서는 Ollama 앱의 서버 기반 추천 모델 표시가 개선되었고, Windows 환경에서의 OpenClaw 게이트웨이 타임아웃 문제 및 Metal 초기화 관련 안정성 향상도 이루어졌습니다.
이 버전(v0.22.1)은 Gemma 4 모델의 렌더러를 업데이트하여 추론(thinking) 및 도구 호출(tool calling) 기능을 개선했습니다. 또한, Ollama 업데이트 없이도 최신 모델 추천을 받을 수 있게 되었으며, `ollama launch` 기능과 데스크톱 앱의 사용자 인터페이스 정렬이 이루어졌습니다.
이 버전(v0.22.1)은 여러 주요 업데이트를 포함하고 있으며, 특히 mlxrunner에서 여러 시퀀스에 대한 샘플러 배치 처리를 지원하도록 개선되었습니다. 또한 토크나이저의 다중 정규식 BPE 오프셋 처리 수정, NVIDIA TensorRT Model Optimizer 가져오기 지원 등 모델 및 인프라 관련 기능들이 강화되었습니다. 전반적으로 모델 배포와 성능 최적화에 초점을 맞춘 업데이트입니다.
이 기술 기사는 새로운 버전(v0.22.0)의 출시를 알리며, 특히 NVIDIA의 Nemotron 3 Omni Poolside와 같은 최신 모델과 연관된 오픈 가중치 코딩 모델인 Laguna XS.2에 대한 변경 로그를 제공합니다. 이는 개발자들이 해당 모델을 활용하여 코딩 및 AI 관련 작업을 수행할 수 있도록 업데이트 내용을 안내하는 목적을 가지고 있습니다.