Seedance 2.5 — 30초 원테이크 생성과 유연한 참조

15 hours ago 4

ByteDance Seed 팀이 단편 생성에서 완성된 창작물 제작으로 범위를 넓힌 차세대 영상 모델 Seedance 2.5를 출시함 음성과 영상을 포함한 최대 30초 분량을 한 번에 생성하고 여러 차례 연장해, 인물·환경·서사 속도를 유지한 수분 길이 콘텐츠를 만들 수 있음 단일 요청에서 이미지 30개, 영상 10개, 오디오 10개까지 활용하며 클레이 렌더·동작·창의적 참조로 다수 인물과 복잡한 장면을 제어함 타임스탬프별 서사·카메라·동작 제어와 그린 스크린, 시점 변경, 참조 기반 수정을 지원해 영화·광고 제작에 필요한 정밀도를 높임 Jimeng AI와 Doubao Pro에서 제공되며 BytePlus ModelArk API도 곧 지원할 예정이나, 복잡한 동작의 물리적 타당성과 다수 피사체 상호작용의 안정성은 과제로 남아 있음 30초 생성과 장편 서사 Seedance 2.0의 통합 멀티모달 음성·영상 공동 생성 아키텍처를 바탕으로 기초 생성과 참조 기반 생성을 강화함 단일 생성 길이를 15초에서 30초로 늘리고, 설정·전개·전환·결말이 논리적으로 연결되는 여러 숏을 한 번에 구성함 무대에 오르는 순간만 만드는 대신 가수가 대기실에서 스태프와 대화하고, 복도를 지나 댄서들과 만나 함께 공연을 시작하는 전체 흐름을 생성할 수 있음 Video 22는 핸드헬드 짐벌 원테이크로 대기실부터 공연장 전경까지 잇는 사례임 다회 연장으로 기존 결과 뒤에 장면을 덧붙이면서 주인공과 환경, 서사 속도의 일관성을 유지함 클립 분할과 반복적인 이어 붙이기, 전환 수정 작업을 줄이면서 수분 길이 영상을 제작할 수 있음 Video 23는 지하철에서 거리로 이어지는 추격 장면을 30초 연장함 영상·음향 품질과 연속성 카메라 이동 사이의 전환을 부드럽게 처리하고 여러 컷에서도 주요 피사체의 안정성과 음성·영상 동기화를 유지함 경극 장면에서는 배우의 물소매를 따라 원형으로 움직이는 카메라 속에서도 주인공과 배경을 일관되게 보존하며, 소매가 실제 물리에 가까운 자연스러운 호를 그리도록 생성함 Video 24는 여러 배우의 동작과 카메라 이동을 단일 연속 숏으로 구성함 AI 영상 특유의 인공적인 외관을 줄이도록 물체 질감, 피부와 눈, 조명, 색상 채도를 체계적으로 최적화함 통제되지 않은 자막과 배경음악 발생도 줄여 실사 영화에 가까운 결과를 목표로 함 확장된 멀티모달 참조 한 번의 생성에서 최대 이미지 30개, 영상 10개, 오디오 10개를 참...

Read Entire Article