AND HOW DOES THAT MAKE YOU FEEL? | Claude가 Minimax H3와 ComfyUI의 비디오 빌더로 만든 AI
요약
본 기사는 Claude AI가 Minimax H3와 ComfyUI의 비디오 빌더를 활용하여 복잡한 3분 코미디 영상을 제작하는 과정을 상세히 설명합니다. 스토리 작성, 캐릭터 시각화(Z-Image), 일관된 음성 유지, 25개 장면 렌더링 및 QA 과정 등 AI가 창작 전반에 걸쳐 어떻게 기여했는지 보여줍니다.
핵심 포인트
- Claude가 스토리, 대사, 25장면 시나리오를 직접 작성했습니다.
- Z-Image와 H3 음성을 이용해 일관된 캐릭터와 목소리를 유지했습니다.
- ComfyUI 워크플로우를 통해 비디오 빌딩 및 사운드 마스터링을 진행했습니다.
- 총 제작 과정에 6.3시간이 소요되었으며, 철저한 QA 과정을 거쳤습니다.
혹시 아직 처리 중이라면 YouTube 링크:
🎬 제작 과정은 이렇습니다. 저의 역할 • 한 메시지 브리프: 재미있고 독특한 캐릭터들과 남성 의사 한 명과 함께하는 치료실 배경의 3분 코미디 (울고 있는 여성, 비명을 지르며 울고 웃는 여성, 건장한 남자와 마른 노인)• 캐릭터들은 Z-Image를 이용해 3패널 레퍼런스 시트로 제작했습니다. • MiniMax H3 2단계 워크플로우: Singularity 모델을 사용했으며, 두 번째 패스에서 8단계 LoRA를 4 스텝과 0.35 디노이즈(denoise) 값으로 적용했습니다.
• 그 후 저는 떠났습니다. 진행 과정 중 한 번의 전화를 걸었는데, 제대로 작동하지 않는 장면에 대한 것이었습니다. Claude가 스스로 해낸 것 • 스토리, 다섯 캐릭터, 모든 대사 및 25장면 시나리오를 작성했습니다.
• Z-Image로 출연진과 두 개의 세트를 만들고 가장 좋은 시드(seed)를 골랐습니다.
• 각 캐릭터의 목소리 설명을 매 장면마다 단어 그대로 유지하여 H3 음성이 일관되게 유지되도록 했습니다.
• H3 내장 음성과 사운드를 이용해 25개 장면을 렌더링했는데, 약 6.3시간이 걸렸습니다.
• 모든 테이크를 QA(품질 보증)했습니다: 스크립트 대비 Whisper 검토, 캐릭터별 피치 및 음색 확인, 아이라인, 프레임 리뷰 시트 점검.
• 실패한 테이크는 재촬영했습니다:
• MiniMax Music 3으로 점수를 매기고 우발적인 보컬이 있는지 신호(cue)를 스크리닝했습니다.
• 편집하고 -14 LUFS로 마스터링했으며, 모든 장면에서 오디오 싱크를 확인했습니다 (최대 오프셋 5ms).
🛠 사용 도구 ComfyUI, VRGDG Video Builder, MiniMax H3 (Singularity ref2va v1.3 + 8-step 768p turbo LoRA), Z-Image Turbo, MiniMax Music 3, Whisper, Claude Code VRGDG 노드: https://github.com/vrgamegirl19/comfyui-vrgamedevgirl
여기를 클릭하여 이와 같은 비디오를 만드는 전체 워크스루를 시청하세요. submitted by /u/Cheap_Credit_3957 [링크] [댓글]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/StableDiffusion의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기