
MLX-Serve 26.9.3 출시. Mac에서 로컬 모델을 구동하는 가장 빠른 엔진: LLM, 비디오, 이미지, 음성 클론, 음악 생성.
요약
MLX-Serve 26.9.3 버전이 출시되어 Mac에서 로컬 모델 구동에 최적화된 가장 빠른 엔진임을 강조합니다. 이 엔진은 LLM, 비디오, 이미지, 음성 클론, 음악 생성 등 다양한 미디어 유형의 모델을 지원하며, Qwen Flash Next가 M4/M5Max에서 높은 처리 속도를 보여주었습니다.
핵심 포인트
- MLX-Serve 26.9.3이 Mac 로컬 모델 구동에 최적화된 엔진입니다.
- LLM, 비디오, 이미지 등 다양한 미디어 생성을 지원합니다.
- Qwen Flash Next가 M4/M5Max에서 높은 처리 속도를 기록했습니다.
MLX-Serve 26.9.3이 출시되었습니다. Mac에서 로컬 모델을 실행하는 가장 빠른 엔진입니다: LLM(대규모 언어 모델), 비디오, 이미지, 음성 클론, 음악 생성.
Qwen Flash Next는 M4/M5Max에서 100 tok/s를 초과하며 놀라운 prefill 속도를 보여줍니다.
이번 릴리스는 매우 크므로 '베타'로 간주해 주십시오. 다음 릴리스는 다듬기와 리팩토링에 중점을 둘 예정입니다.
감사합니다: @Beamsters1, @TheDavidTai, @Lojza3D, ViRb3, d-b, perretv, @Damn_Lino, Nikolai Vysotskyi, t2tx, josko, Sinojen -- 여러분의 모든 X 계정을 갖고 있지 않으니, 다음번에 태그할 수 있도록 댓글을 남겨주세요.
AI 자동 생성 콘텐츠
본 콘텐츠는 X 토픽: 오픈소스 LLM의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기