Qwen Image 2.1 Turbo의 'magic' 시그마를 더 확장하는 방법
요약
본 글은 Qwen Image 2.1 Turbo 모델의 이미지 생성 품질을 향상시키기 위한 새로운 'Magic AI Slop Scheduler'를 소개합니다. 기존 방식으로는 스텝 수(Sigma) 보간이 어려웠으나, 이 커스텀 노드를 통해 10, 12, 14 스텝 등 원하는 단계로 정밀하게 조정할 수 있게 되었습니다.
핵심 포인트
- Qwen Image 2.1 Turbo의 디테일 향상을 위한 새로운 스케줄러 제공
- 커스텀 노드(Magic AI Slop Scheduler)를 통해 스텝 수를 유연하게 보간 가능
- 최적 결과는 12~14 스텝, CFG > 1, euler_ancestral 샘플러 조합에서 기대됨
저는 Qwen Image 2.1 Turbo와 다음 'magic' 시그마를 사용해 보기로 결정했습니다. 이 값들은 Diffusers 구현에서 직접 가져온 것입니다: [1.0, 0.978453, 0.954180, 0.926626, 0.895080, 0.845148, 0.704534, 0.414568, 0.0]. 이것도 괜찮게 작동하지만, 세밀한 디테일을 위해서는 약간 더 많은 스텝(더 나은 피부 표현, 더 좋은 구도 등)이 필요합니다. 그리고 제가 알기로는 결과 곡선을 임의의 N 스텝(예: 10, 12, 14)으로 보간하는 작동하는 방법이 없습니다. 'Custom Sigmas' RES4LYF 노드는 있지만, 버그가 있습니다 (나중에 보여드리겠지만). 이것이 원래의 'magic' 8단계 곡선입니다: 'magic' 8-step curve
RES4LYF의 'Custom Sigmas' 노드를 사용하여 예를 들어 14 스텝으로 보간을 시도하면 다음과 같습니다: curve is screwed
그래서 저는 임시방편적인 해결책을 만들어야 했지만, 이 목적만을 위해 커스텀 노드를 만들고 싶지는 않았습니다. 'Qwen Image 2.1 Turbo용 Magic AI Slop Scheduler'를 소개합니다😆 훨씬 좋지 않나요? 14 스텝으로 보간된 결과
이 곡선은 이제 정확히 똑같아 보이지만, 스텝 수가 더 많습니다 (이 경우 14개). 이를 위해서는 RES4LYF 노드, KJ 노드, 그리고 rgthree 노드가 필요합니다. 마지막 것이 가장 중요합니다: 이 노드는 이러한 계산을 수행할 수 있는 'Power Puter' 노드를 가지고 있습니다 (하지만 아마도 다른 곳의 많은 'expression' 스타일 노드들이 같은 일을 할 것입니다). 실제로 이것은 10 스텝, 12 스텝, 14 스텝에 대해 작동합니다 (그리고 아마 그 이상에서도 작동하겠지만, Turbo 모델을 더 많은 스텝으로 실행할 의미는 없습니다). 따라서 다음 사항들을 사용한다면:
- 이 'scheduler'를 사용하고
- CFG > 1을 사용하며
- 12~14 스텝을 사용하고
- 샘플러(euler_ancestral [제가 생각하기에 최고], euler, er_sde) 등을 사용한다면... 실제로 아름답고 디테일하며 일관성 있는 그림들을 얻을 수 있을 것입니다.
예를 들어: https://preview.redd.it/pcdf608liquh1.png?width=1248&format=png&auto=webp&s=4283bcc8851ae6052e158577b6aa92931d1155aa https://preview.redd.it/ahrbeebmiquh1.png?width=1248&format=png&auto=webp&s=0c7974c0626e81fa4d5d0b7a0719320bd6602b27 https://preview.redd.it/ywfpp31niquh1.png?width=1248&format=png&auto=webp&s=0d727e4364ebcaff000e97b85e879f775468d1b3 https://preview.redd.it/6dh6xj3oiquh1.png?width=1248&format=png&auto=webp&s=ed71d63ceb359ec556837e7d137a702ad1ae7b4c 1girl, 2 girl은 의도된 것이며, 어쩌면 더 많은 사람이 이것을 읽을 수도 있습니다 😆 워크플로우를 위해서는 Civitai로 이동하여 원본 2 메가픽셀(megapixel) 이미지를 다운로드한 후, 해당 이미지들을 ComfyUI에 끌어다 놓으세요. 무엇이 실제로 일어나고 어떻게 사용하는지에 대한 매우 상세한 설명이 안에 들어 있습니다. 위에 있는 모든 사진들은 1214 스텝과 CFG를 3.5에서 5로 설정하고, 2 메가픽셀(megapixel)로 생성되었습니다. 링크: https://blobs-b2.civitai.com/file/blobs-managed-public/Q054FWT4DMQR88GYN0PXJGQ030 https://blobs-b2.civitai.com/file/blobs-managed-public/V47QEA6MNP2XZAXPFFSGAHXZQ0 https://blobs-b2.civitai.com/file/blobs-managed-public/CSDBTWXEJ1KS54MCZN9XK2S6K0 https://blobs-b2.civitai.com/file/blobs-managed-public/C30VR7Z4ZHRBH8FW5RZ1YSFGC0 보너스 기능: 곡선을 약간 조정할 수 있도록 '가짜 SHIFT(fake SHIFT)'를 포함했습니다. 음수 값은 '-1.0'이나 '-2.0'처럼 더 미세한 디테일이 생깁니다. 하지만 너무 과하게 사용하지 마세요. 원본 곡선에서 너무 많이 벗어나고 싶지는 않습니다. '가짜 SHIFT'를 '0.0'으로 설정하면 비활성화됩니다. https://preview.redd.it/pz6g8uw8kquh1.png?width=742&format=png&auto=webp&s=3ace3e3e0eff1ab84fd964f0c45705beb8db7521 추가 팁: - 제발, 부탁이니 CFG=1을 사용하지 마세요. 제대로 익지 않은 노란색의 결과물만 얻게 되며, 네거티브 프롬프트(negative prompt)를 놓치고 있습니다 (이것은 매우 잘 작동합니다). - 항상 적은 스텝(10)으로 시작하고, 구도가 잘못되었거나 충분한 미세 디테일이 없을 때만 늘리세요(최대 14까지). - 그런 다음 CFG를 조정하세요. 3.55.0 사이가 괜찮지만, 이것은 각 특정 생성물에 매우 특화되어 있습니다. - '너무 많은 디테일'이 있는 경우(예:
(피부가 너무 디테일하거나 거칠 경우) - 먼저 스텝(steps)을 줄인 다음, 'fake shift'를 늘리세요 (예: '1.0' 또는 '2.0' 등으로 설정). - 반대로, 피부가 너무 플라스틱처럼 보이면 스텝을 늘리고, 'fake shift'를 줄이세요 (예: '-1.0', '-2.0' 등으로 설정). - 가장 중요한 것은 Qwen Image 2.1 Turbo에 적절하게 프롬프트를 입력하는 것입니다. 혹시 원래의 Chroma 프롬프팅을 기억하시는 분이라면 제가 무슨 말을 하는지 아실 겁니다. 즉, 정확한 구문을 사용하고, 구체적이며, '1girl, masterpiece'와 같은 모호한 태그(slop tags)를 피해야 합니다. 모든 열쇠는 여기에 있습니다. 어떤 생성 매개변수(gen params)도 잘못된 프롬프팅을 고칠 수 없습니다. 좋은 하루 되세요! 수정: 과도하게 노이즈가 많은 디테일 없이 더 깔끔한 출력을 선호하는 분들을 위해, 여기 Krea와 비슷한 결과물입니다 (단지 스텝을 줄이고 'fake shift'를 2로 설정). 보세요, 심지어 더 빠르게 생성됩니다 😄 https://preview.redd.it/57mjc7mp8ruh1.png?width=1248&format=png&auto=webp&s=a841a713cf3ca77f4bb767814823159574b1c7bb submitted by /u/GTManiK [link] [comments]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/StableDiffusion의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기