인기 MiniMax H3 LoRA를 사용한 간단 테스트
요약
본 글은 MiniMax H3 LoRA를 사용하여 특정 인물(Will Smith)의 얼굴 정체성을 유지하며, 식당에서 스파게티를 먹는 사실적인 5초 모션 비디오를 테스트한 내용을 공유합니다. 이 테스트는 연속적이고 사실적인 손동작, 음식 상호작용, 그리고 입술 움직임이 포함된 고품질 모션 품질 벤치마크의 목적을 가집니다.
핵심 포인트
- MiniMax H3 LoRA를 활용하여 인물 정체성 유지에 성공함.
- 스파게티 먹는 장면은 연속적이고 사실적인 동작 테스트에 적합함.
- 테스트 설정(시드, 프롬프트 등) 공유를 통해 사용자 간 정보 교류가 이루어짐.
안녕하세요 여러분.. minimax_h3_fl2va_pruned_int8_convrot.safetensors 파일을 사용하여 몇 가지 인기 있는 H3 LoRA들을 빠르게 테스트해 봤습니다. 모든 테스트에서 동일한 Will Smith 레퍼런스 이미지, 시드, 프롬프트, 일반 설정을 사용했습니다. 해상도: 2144 × 1216 ~2.5 MP 지속 시간: 5초 샘플러: Euler 스케줄러: Simple LoRA 강도: 1.0 사용된 프롬프트: subject_definitions: <Subject 1>은 <Picture 1>에 나온 Will Smith의 모습입니다. 그의 얼굴 정체성, 헤어스타일, 피부톤, 얼굴 비율, 몸 비율 및 <Picture 1>에서 파악되는 전반적인 인식 가능한 외모를 유지합니다. summary: [레퍼런스 생성] 목표 비디오는 식당 테이블에 앉아 스파게티를 먹다가 만족감을 느끼며 짧은 한 단어를 말하는 <Subject 1>의 사실적인 실사 레스토랑 장면입니다. 이 클립은 단일 5초 쇼트에서 연속적이고 사실적인 손, 식기류, 음식, 얼굴, 입, 그리고 립싱크 움직임을 가진 모션 품질 벤치마크로 설계되었습니다. retention_analysis: <Subject 1> ( [Shot 1]에 등장): 완전히 보존됨 - <Picture 1>에서 확립된 얼굴 정체성, 헤어스타일, 피부톤, 몸 비율 및 인식 가능한 전반적인 외모를 유지합니다. <Picture 1> ( <Subject 1>에 적용): 약한 레퍼런스 - 식당 배경, 테이블, 스파게티 접시, 포즈, 행동은 새로 생성하고 <Picture 1>을 <Subject 1>의 정체성 및 외모 레퍼런스로만 사용합니다. detailed_description: [Shot 1] 사실적인 실사 레스토랑 영상으로, 연속된 5초 쇼트입니다. <Subject 1>이 작은 식당 테이블에 자연스럽게 앉아 바로 앞에 스파게티 접시가 놓여 있습니다. 좌석 상태의 눈높이에서 미디엄 클로즈업 구도입니다. 카메라는 안정적으로 유지되며, 미묘한 자연스러운 핸드헬드 마이크로 움직임만 있습니다. 쇼트 시작 시, <Subject 1>은 즉시 접시를 내려다보며 금속 포크로 스파게티를 집어 올립니다. 그의 손가락이 포크를 자연스럽게 돌리는 동안 여러 가닥의 스파게티가 그 주위를 감쌉니다.
그는 포크 가득한 스파게티를 부드럽고 연속적인 동작으로 입 쪽으로 들어 올리고, 몸을 살짝 숙인 후 한입 베어 물고, 몇 가닥의 느슨한 스파게티가 잠시 늘어졌다가 자연스럽게 떨어지도록 포크를 떼어냅니다. 그는 짧은 순간 동안 자연스럽게 음미하며 삼킨 다음, 만족스러운 표정으로 눈을 들어 올리며
다른 모델과 LoRA 조합으로 사람들이 어떤 결과를 얻는지 듣는 것도 유용할 것 같습니다. 만약 이들을 다른 H3 기반에서 테스트해 보셨다면, 설정값을 공유해 주시면 감사하겠습니다. 이것은 단순히 간단한 실습 테스트일 뿐 벤치마크는 아니지만, 누군가 시간을 절약하는 데 도움이 되기를 바랍니다.. /u/Better-Interview-793 제출 [링크] [댓글]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/StableDiffusion의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기