GGUF 기반 로컬 확산 모델: Vulkan 데스크톱 앱에 stable-diffusion.cpp를 통합했습니다 (FLUX Schnell /
요약
사용자의 로컬 GPU 환경에서 이미지 및 비디오 생성이 가능한 오픈 소스 데스크톱 애플리케이션 Vison을 공개했습니다. 이 앱은 stable-diffusion.cpp와 GGUF 기반 모델을 통합하여 별도의 클라우드 서비스나 크레딧 없이 프롬프트 처리가 가능합니다. 현재 Windows 전용이며, macOS/Linux 포팅에 기여가 필요합니다.
핵심 포인트
- 로컬 GPU에서 이미지/비디오 생성 가능 (Vison)
- stable-diffusion.cpp와 GGUF 기반 모델 통합
- 클라우드 서비스나 크레딧 없이 사용 가능
- 현재 Windows 전용이며, macOS/Linux 포팅 기여 요청
저는 이미지를 생성하고 비디오까지 완전히 사용자 자신의 GPU 위에서 처리할 수 있는 데스크톱 애플리케이션인 Vison을 오픈 소스화했습니다. 별도의 생성 서비스 계정이나 크레딧이 필요 없으며, 프롬프트가 컴퓨터를 벗어나지 않습니다.
이 서브레디트의 관심사를 고려하여 라이선싱 세부 정보를 알려드립니다:
- Vison 자체는 MIT입니다. 이는 stable-diffusion.cpp, ggml 및 vision.cpp (모두 MIT)와 앱 내에 포함된
THIRD-PARTY-NOTICES.txt에 나열된 기타 항목들을 기반으로 구축되었습니다. - 번들된 ffmpeg은 libvpx를 사용한 LGPL 빌드이며 GPL 구성 요소는 없습니다. 이 빌드는 GPL 또는 비자유(non-free) 코드를 패키징하는 것을 거부합니다. 비디오는 로열티 프리인 WebM의 VP9 형식입니다. 이는 기술적인 선택이 아닌 의도적인 라이선싱 선택이었습니다.
- 모델 가중치(Model weights)는 MIT 라이선스에 포함되지 않습니다. 각각은 게시한 사람(FLUX.1 Schnell, Wan 및 나머지는 모두 다름)으로부터 자체 약관을 가지고 있으므로, 상업적으로 결과물을 사용할 경우 사용 전에 확인해야 합니다.
- 유료 등급도 없고, 제한된 기능도 없으며, 계획할 예정도 없습니다.
아직 초기 단계입니다: 개발자 1명, 6GB 노트북 GPU, Windows 전용입니다. 백엔드는 이식 가능한 C++/Vulkan이므로, macOS/Linux는 포팅(porting)보다는 주로 패키징 및 테스트의 영역이며, 이곳에서 도움이 가장 필요합니다.
레포지토리: https://github.com/JayRGadekar/Vison (기여 가이드, 이슈 템플릿 및 SECURITY.md가 포함되어 있습니다)
제출자 /u/Decent-Manager-5373
[링크] [댓글]
AI 자동 생성 콘텐츠
본 콘텐츠는 Reddit AI Engineering의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기