Seedance 2.5 — 30초 원테이크 생성과 유연한 참조
요약
Seedance 2.5 모델의 성능과 함께 AI 영상 생성 기술이 미치는 산업적, 윤리적 영향을 분석합니다. 중국과 서구 시장의 수요 차이에 따른 모델 발전 방향과 영상 제작 방식의 경제적 변화를 다룹니다.
핵심 포인트
- Seedance 2.5의 30초 원테이크 생성 및 유연한 참조 기능
- 중국과 서구 시장의 영상 수요 차이에 따른 모델 최적화 경향
- AI 영상 생성 기술의 경제성 향상에 따른 기존 제작 방식의 잠식 위험
- 딥페이크 및 생성 콘텐츠의 윤리적 문제와 사회적 규범 필요성
평소 AI 영상을 좋아하지 않지만 이건 놀라운 수준이며, 내년이면 기술이 거의 완벽해지고 더 저렴해져 좋든 싫든 AI 영상이 곳곳에 넘칠 것으로 보임
사람들은 아직 딥페이크의 사회적 규범을 정립하는 중임
공정 이용과 표현의 자유 아래 이런 콘텐츠가 일반화될 미래도 있지만, 공인을 등장시킬 수 있는 일부 관할권에서는 오히려 표현의 자유를 제한하는 데 쓰일 수도 있음
악용하면 안 될 방식은 많지만, 위험하고 수상한 금기로만 취급하기보다 합리적인 범위에서 재미를 위해 활용하는 미래를 원함
품질은 높지만, 모델의 발전 방향이 중국과 서구의 수요 차이와 강하게 맞물려 있음
특히 행동과 화려한 효과 중심의 텍스트-영상 생성에 집중하며, 공개 페이지 전체에서 사람을 참조한 장면은 하나뿐이고 그마저 대화가 중심이 아님
미국 영화 제작자들이 크게 원하는 기능은 배우의 연기를 유지하면서 원하는 세계에 삽입하는 영상-영상 변환임
반면 중국 영화 시장은 액션과 특수효과 비중이 높아, 미국에서는 실패했지만 중국에서는 성공한 Warcraft(중국 2억2,500만 달러·미국 4,700만 달러), Resident Evil(1억5,900만·2,700만), xXx: Return of Xander Cage(1억6,400만·4,400만), Pacific Rim: Uprising(9,900만·5,900만)이 있음
액션과 시각적 볼거리가 대화 중심 영화보다 보편적으로 통하기 때문일 수도 있고, 중국 문화가 그런 콘텐츠를 선호하기 때문일 수도 있음
ByteDance가 수요를 보고 액션·특수효과에 집중하는 듯함
이제는 그렇게 단순하지 않음
Green Book(2018)은 중국에서 7,070만 달러 이상을 벌었고, 2021년 최고 인기작 중 하나인 Hi, Mom은 7억8,500만 달러 이상을 기록함
Obsession(2026)도 중국에서 크게 흥행해 Supergirl 같은 액션 영화와 비교해 1,200만 달러 대 100만 달러 미만으로 앞서고 있음
홍콩 영화는 Hollywood와 정반대로 판타지와 액션이 미국보다 훨씬 인기 있음
다만 제시된 수치는 인구당 기준으로 보면 그렇게 극단적이지 않을 수 있지만, 큰 방향은 여전히 타당함
새로운 영상·이미지 생성 모델이 나올 때마다 작업이 너무 재미있어 보여 전율을 느낌
하지만 스토리보드용 이미지 5만 장 이상, 모델 훈련, 약 1시간 분량으로 추정되는 영상 제작에 추론 비용 1만 달러 이상을 썼음
최신 모델을 피하면 경제성을 높일 수 있지만 가장 재미있는 것은 최신 모델이며, 주말에 바이브 코딩하듯 확장하기는 어려움
잘 작동할 때는 주프락시스코프가 처음 살아 움직이는 광경을 보는 듯해 계속 만들고 싶어짐
관련 스타트업의 제안도 받았지만, 상당수는 YouTube·TikTok Shorts용 스팸 대량 생산처럼 가치가 낮거나 복제·딥페이크처럼 윤리적으로 잘못된 일을 함
영화 제작 경력 때문에 결국 공학적으로 이 분야에 끌려들어가 무언가를 찾게 될지도 모르겠음
재미로 진행하고 과정을 기록한 작업은 https://edwin.genego.io/blog에 있으며, 연초에 멈췄지만 다시 시작할 수도 있음
Art Center에서 영화를 공부했지만 촬영 대신 소프트웨어를 만들게 됐고, 시각 연출·그래픽·UI·3D 애니메이션 작업은 계속했음
이제는 두 분야 모두 프롬프트를 쓰며 비슷한 처지가 되어가는 듯함
생성 콘텐츠는 이미 포화된 시장을 더 범람시키고 기대 수준을 낮춰, 결국 아무도 직접 촬영하거나 애니메이션을 만들지 않게 할 수 있음
품질이 50% 낮아도 비용이 90% 저렴하면 새 실물 콘텐츠 제작의 경제성이 사라지고, 기존 콘텐츠까지 잠식함
이는 뱀이 자기 꼬리를 먹는 듯한 자기잠식 순환이며, Hollywood 블록버스터가 수십 년간 이를 반복했더라도 그것이 영화의 미래이자 선호되는 제작 방식으로 굳어지는 모습은 의욕을 꺾음
MiniMax H3는 가중치를 공개할 예정이라 1만 달러보다 훨씬 적은 비용으로 로컬 실행할 수 있고, Seedance 대기열보다 빠를 가능성도 있음
필요한 용도에 맞게 직접 훈련하는 재미도 있음
응용 계층에서 영상 모델을 실험하며 수백 달러를 썼음
모델로 무언가를 만드는 과정은 슬롯머신을 당기면 TikTok·Marvel·YouTube가 튀어나오는 것처럼 재미있고 중독적임
Sora도 이를 노렸겠지만 신기함은 금방 사라지고, 대부분은 원하는 내용을 직접 입력하거나 의미 없는 대량 생성 스팸을 걸러내기보다 그냥 콘텐츠를 소비하고 싶어 함
창작자가 모델을 더 정밀하게 제어하고 통합할 수 있게 되면 시장이 폭발할 것이며, 저질 생성물처럼 느껴지지 않으면서 오락과 참여를 제공할 초기 통합 활용법을 개발 중임
사이트의 AI 콘텐츠 일부는 인상적이지만, 시연이 아닌 페이지는 줄이는 편이 좋겠음
지금은 글의 진위를 믿어도 되는지, 많은 글을 읽고도 이 사람에 대해 알게 된 것이 없는 듯한 인상을 줄 수 있음
Seedance 2.5도 훌륭하지만 MiniMax H3의 공개 가중치가 24시간 안에 나올 예정임: https://fal.ai/minimax-h3
ComfyUI 팀에 따르면 3080 같은 중급 소비자용 GPU에서도 쓸 만하게 작동할 것이며, 약간의 품질 저하를 감수하고서라도 더 강한 제어력과 낮은 비용을 택하겠음
minimax-h3 공개가 무척 반가움
미뤄둔 프로젝트가 많으며, 특히 타이포그래피·UI·그래픽 작업을 수 시간 대신 수분 안에 끝낼 수 있을 듯함
새 모델이 나올 때마다 한 주 내내 혼란과 잘못된 조언이 쏟아지고, 주말이면 모델이 사라지거나 대성공하는 식으로 중간이 거의 없음
H3가 LTX가 만든 엉뚱한 결과를 해결할지 지켜보는 중이며, WAN도 출시 예정이고 LTX도 새 모델을 예고했으며 Flux3도 영상을 지원함
영상 모델이 전무하던 상태에서 올해 안에 수많은 선택지가 생길 전망임
감정 전달이 지나치게 평면적이고 문장도 어색해, 믿을 만한 수준이 되려면 아직 많은 작업이 필요함
이런 AI 영상의 음향 생성 방식이 궁금함
영상과 한 번에 생성하는지, 별도 모델을 쓰는지, 사람이 나중에 추가하는지 알고 싶음
Twitter의 정보에 따르면 Seedance 2.5 비용은 약 2배로, Dreamina에서 30초 영상을 생성하면 1,440크레딧 또는 약 15달러가 듦
영화나 TV 애니메이션, 고품질 YouTube 영상의 제작비와 비교하면 거의 아무것도 아닌 수준임
지금까지 본 것보다 놀라울 정도로 훌륭함
세탁기 광고 예시는 소셜 미디어의 다른 광고와 비교해도 손색없고, 품질과 장시간 일관성 유지가 충격적임
프롬프트에 언급된 참조 이미지를 매우 잘 활용하는 듯함
눈에 띄게 나쁜 예시는 공연장 영상으로, 처음 몇 초에는 좌석이 거의 비어 있다가 끝에는 관객으로 가득 차며 그 관객도 다소 부자연스러움
예시 영상과 세부 사항을 오래 일관되게 유지하는 능력은 대단하지만, 모든 장면이 여전히 AI 특유의 느낌을 강하게 풍김
방의 구성, 얼굴 표정, 움직임 등이 원인인 듯하지만 정확히 짚기는 어렵고 매우 불안하게 느껴짐
인간은 이런 차이를 감지하는 데 뛰어난 듯함
CGI가 등장한 지 수십 년이 지났지만 여전히 보고 바로 CGI라고 알아챌 수 있으니, 일종의 불쾌한 골짜기일 수 있음
걱정할 필요 없음. 지금이 앞으로 볼 수 있는 가장 나쁜 품질이며, Will Smith와 스파게티 영상 시절을 떠올려보면 됨
AI 자동 생성 콘텐츠
본 콘텐츠는 GeekNews의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기