
바이트댄스는 오늘(7월 31일) 공지를 발표하고 중국 내에 Seedance 2.5 동영상 생성 모델을 출시한다고 밝혔다. 한 번에 30초 분량의 고품질 동영상 클립을 생성할 수 있으며, 지멍 AI와 더우바오 프로 버전에 순차적으로 제공되고 있다. API 서비스도 조만간 화산팡저우에 연동될 예정이다.
공식 설명에 따르면 Seedance 2.5는 Seedance 2.0의 통합 멀티모달 음성·영상 공동 생성 아키텍처를 계승하고, 장편 서사와 멀티모달 참조 및 편집 기능을 중점적으로 향상했다.
이 모델은 영화·드라마, 광고, 교육, 제조업, 체화 지능 및 자율주행 등의 분야를 대상으로 하며, 동영상 생성을 ‘하나의 클립 생성’에서 ‘하나의 창작 작업 완성’으로 전환하는 것을 목표로 한다.
생성 측면에서 Seedance 2.5는 한 번에 생성할 수 있는 동영상 길이를 15초에서 30초로 늘렸으며, 여러 차례 연장 생성도 지원한다. 공식 설명에 따르면 모델은 30초 안에 논리적으로 연결된 여러 장면을 구성해 이야기를 발단, 전개, 반전, 마무리의 흐름으로 펼칠 수 있다.


공식 예시에서는 가수가 원테이크로 무대에 올라 공연하는 장면을 통해 완결된 서사를 보여준다. 카메라는 두꺼운 붉은 커튼 틈에서 앞으로 이동해 따뜻한 색감의 백스테이지 분장실로 들어간다. 젊은 여성 가수는 이어폰을 정리하고, 스태프는 무대에 오를 것을 알린다. 가수는 백스테이지 통로를 지나 무용수와 교류한 뒤 마이크를 건네받는다. 이후 무대에 올라가며, 카메라는 체육관 전경까지 멀어져 관객, 응원 전광판, 야광봉과 환호성을 보여준다.
여러 차례 연장 생성과 관련해 공식 예시는 모델에 기존 동영상을 바탕으로 30초를 추가 생성하고, 인물 주체, 장면, 화면 스타일, 음성 및 음향 효과를 일관되게 유지하도록 요구한다. 예시 줄거리는 어린 소년이 축구공을 안고 객차를 달리고, 지하철이 멈춘 뒤 문 밖으로 뛰어나가며, 남자 주인공이 소년을 쫓아가 결국 붙잡는 등 연속적인 동작으로 구성된다.
Seedance 2.5는 사용자가 한 번에 최대 30장의 이미지, 10개의 동영상, 10개의 오디오를 참고 자료로 입력할 수 있도록 지원한다. 공식 설명에 따르면 모델은 서로 다른 자료에 담긴 화면 구성, 장면, 스타일, 인물, 소품 등의 요소를 종합적으로 이해하고, 지시에 따라 동영상 생성에 활용할 수 있다.
여러 인물이 함께 등장하는 장면과 군상 서사에서 Seedance 2.5는 여러 인물의 모습과 목소리를 동시에 재현하면서 주체의 특징을 안정적으로 유지할 수 있다. 공식이 공개한 30초 음악회 클립은 16:9 가로 화면과 영화적인 사실감의 스타일을 적용했으며, 참고 자료에는 장면 이미지, 피아니스트, 첼로, 바이올린, 보컬, 관현악단, 합창단과 관객석이 포함됐다.

참고 주소
Seedance 2.5 프로젝트 홈페이지
