Iris-3B를 지원하는 ComfyUI 노드 팩 제작 (텍스트-이미지, 4배 업스케일러, 깊이 및 Img2Img 포함)
요약
Sperid Labs가 출시한 Iris-3B 모델을 ComfyUI에서 활용할 수 있도록 포괄적인 노드 팩이 제작되었습니다. 이 노드 팩은 고급 샘플러, Image to image 기능, 4x 업스케일러, 깊이(Depth) 모델 등 다양한 기능을 포함합니다. 사용자는 별도의 복잡한 설치 과정 없이 ComfyUI-Manager를 통해 쉽게 접근할 수 있습니다.
핵심 포인트
- Iris-3B 지원을 위한 통합 노드 팩 제공
- 고급 샘플링 및 Image to image 기능 구현
- 4x 업스케일러와 Depth 모델 포함으로 활용도 극대화
- ComfyUI-Manager를 통해 간편하게 설치 가능
Sperid Labs에서 이번 주에 Iris-3B가 출시되었습니다. 이는 VAE 없이 픽셀 단위로 직접 작동하는 3B 모델이며, 4x 업스케일러와 깊이(depth) 모델도 함께 제공합니다. ComfyUI는 아직 이를 네이티브하게 지원하지 않아, 저는 모든 모델과 사용 사례를 포괄하는 노드 팩을 제작했습니다. 레포지토리: https://github.com/bani4kaskashka/Iris-3B-Comfy-Nodes 또한 ComfyUI-Manager에서도 Iris-3B를 검색하여 찾을 수 있습니다. 무료이며, Apache-2.0 라이선스를 따릅니다.
무엇이 포함되어 있나요?
- 고급 샘플러 (Advanced sampler): 해상도(21:9부터 9:21까지의 1 MP 크기), 품질(30, 50 또는 100 스텝), 프롬프트 준수도, 시드 및 배치에 대한 드롭다운 메뉴가 있습니다.
- 고급 샘플러 (Advanced sampler): 모든 설정(스텝, cfg, 쉬프트, 솔버 순서, CFG 간격, 임의 크기)이 가능합니다.
- 이미지 투 이미지 (Image to image): 두 샘플러 모두에 모드 스위치가 있으며, 미묘함(subtle), 중간(medium), 강함(strong) 프리셋을 제공합니다.
- 4x 업스케일러: 모든 이미지에서 작동하며, 약 47초 만에 1024부터 4096까지 처리할 수 있습니다.
- 깊이 (Depth): 이미지당 약 4초가 소요되며, 그레이스케일(ControlNet용 준비 완료) 또는 inferno 모드를 지원하고 마스크도 포함합니다.
- 템플릿 내 다섯 가지 워크플로우: README에 있는 이미지는 해당 워크플로우를 내장하고 있으므로 ComfyUI로 바로 드래그할 수 있습니다.
설정하기
워크플로우를 열면 ComfyUI가 누락된 모델에 대한 다운로드 버튼을 보여줍니다. 로더는 첫 실행 시 여전히 누락된 모든 것을 다운로드합니다. 공식 Qwen3-VL-4B 텍스트 인코더 폴더를 사용하므로 재패키징 파일이 필요하지 않습니다. 추가적인 pip 설치가 필요하지 않으며, ComfyUI의 어떤 부분도 다운그레이드되지 않습니다.
속도 및 VRAM (RX 9060 XT, 16 GB, Windows, ROCm)
- 1024x1024에서 스텝당 약 1.8초가 소요됩니다.
- 최대 VRAM은 7.7 GB입니다.
텍스트 인코더와 모델이 GPU에서 번갈아 가며 작동하므로, 16 GB 카드에서 반복 실행해도 속도가 느려지지 않습니다. 궁금한 점이 있다면 README에 비교표가 있습니다. 여우 소녀의 사인 문구는 모델에서 직접 나온 것이며, 인페인팅을 거치지 않았습니다. 저는 여섯 개의 시드를 생성했고 모두
AI 자동 생성 콘텐츠
본 콘텐츠는 r/StableDiffusion의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기