세상에, Seedance 2.5가 이번에 정말 제대로 사고를 쳤네요!!!
요약
ByteDance의 Seed 팀이 30초 분량의 네이티브 영상을 생성하는 Seedance 2.5를 공개했습니다. 일관된 서사와 리듬을 갖춘 고품질 영상 생성이 가능하며, 이미지·비디오·오디오를 참조하여 스타일과 캐릭터를 정교하게 제어할 수 있습니다.
핵심 포인트
- 30초 분량의 일관된 네이티브 영상 생성 가능
- 이미지, 비디오, 오디오 등 최대 50개 참조 자료 활용
- 영상과 음성이 네이티브하게 동기화되어 생성됨
- 3D 모델 및 그린 스크린 참조를 통한 부분 수정 지원
- 실사 촬영과 구분이 어려울 정도의 물리 법칙 및 디테일 구현
세상에, Seedance 2.5가 이번에 정말 제대로 사고를 쳤네요!!!
이 일본 비 오는 거리의 1인칭 시점(POV) 영상은, AI가 생성했다는 사실을 믿기 위해 세 번이나 다시 봤습니다🤯...
1인칭 시점(First-person perspective)으로, 우산을 쓰고 일본의 빗속을 걷고 있습니다.
빗방울이 우산 위로 떨어지고, 물웅덩이에는 가로등과 전봇대의 그림자가 비칩니다.
교복을 입은 학생이 자전거를 타고 옆을 지나가고, 노란 우비를 입은 아이가 앞에서 뛰어갑니다.
철도 건널목의 차단기가 천천히 내려가고, 경보음이 울리며, 전차가 굉음을 내며 지나갑니다.
차단기가 올라가고, 다시 계속 걷습니다.
핸드헬드(Handheld) 카메라 특유의 호흡감, 초점의 미세한 흔들림, 렌즈에 맺힌 빗방울까지.
무려 30초 동안, 원테이크(One-take)로 진행됩니다.
이게 AI가 생성한 거라고요????!!
이것이 바로 ByteDance의 Seed 팀이 오늘 막 공개한 Seedance 2.5입니다.
이전 세대가 누가 더 진짜 같은 15초 분량의 클립을 생성하는지 겨루었다면, 이번 세대는 직접 30초 분량의 네이티브(Native) 영상을 만들어내며, 여러 차례 연장을 통해 몇 분짜리 일관된 콘텐츠로 만들 수도 있습니다.
단순히 조각내어 억지로 이어 붙인 것이 아니라, 진정한 서사(Narrative), 리듬, 그리고 기승전결이 있습니다.
50개의 참조 자료를 동시에 입력할 수 있습니다. 즉, 30장의 이미지, 10개의 비디오, 10개의 오디오를 넣으면 캐릭터, 장면, 스타일, 카메라 언어(Camera language)를 모두 고정할 수 있습니다.
3D 화이트 모델(White model)이나 그린 스크린(Green screen)도 참조로 사용할 수 있어, 마음에 들지 않는 부분만 수정하면 되고 전체를 다시 렌더링(Rendering)할 필요가 없습니다.
음성과 영상이 함께 생성됩니다. 빗소리, 발소리, 전차의 굉음, 입 모양에 맞춘 대사 등이 네이티브하게 동기화되어 후반 작업(Post-production)에서 맞출 필요가 없습니다.
가장 무서운 점은, 소위 '딱 봐도 AI 같은' 문턱을 마침내 넘어섰다는 것입니다!!!
이전의 AI 비디오는 어딘가 어색했습니다. 손은 흐릿하고, 물리 법칙은 무너지고, 사람이 걷다 보면 얼굴이 변하며, 카메라 전환 시 논리가 끊기곤 했습니다.
하지만 Seedance 2.5의 이 30초 POV 영상이 공개되었을 때, 많은 사람의 첫 반응은 "이거 실사 촬영 아닌가?"였습니다.
이것은 분명 양적인 변화가 아닙니다!
AI 자동 생성 콘텐츠
본 콘텐츠는 X @ayi_ainotes (자동 발견)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기