오디오와 영상 동시 생성
나중에 더하지 않고 영상과 함께 소리를 생성합니다.
ByteDance의 Seedance 2.0은 첫 프레임과 마지막 프레임 또는 참고 이미지로 480P부터 기본 4K까지 영상과 소리를 한 번에 생성합니다.
데스크톱 브라우저에서 이 페이지를 열어 창작을 시작하세요.
Seedance 2.0은 ByteDance의 영상 모델로, 오디오가 별도 단계가 아니라는 점이 핵심입니다.
대부분의 생성 영상은 무음으로 나온 뒤 음악을 붙이므로 영상 위에 음악만 얹은 느낌이 납니다. Seedance 2.0은 오디오와 영상을 함께 생성해 주변음, 동작 소리, 리듬을 나중에 대략 맞추는 대신 화면의 실제 사건과 동기화합니다. Virse는 프레임 기반과 레퍼런스 기반을 나누고 각각 Fast 버전을 제공하는 네 모델로 구성합니다.
클립에서 묘사한 장소에 맞는 소리가 필요하다면 Seedance 2.0을 사용하세요. 오디오를 미뤄 둘 결정이 아닌 샷의 일부로 삼는 광고 영상, 제품 모션, 애니메이션, 캐릭터 시리즈, 소셜 영상을 만드세요.

Seedance 2.0은 ByteDance가 개발한 AI 영상 생성 모델입니다. 피사체, 동작, 카메라 동작, 속도감, 소리에 관한 서면 지시를 따라 동기화된 2채널 오디오가 있는 영상을 생성합니다.
이 모델은 세 가지 주요 강점을 중심으로 구축되었습니다.
생성 길이는 4~15초이며 화면비는 21:9부터 9:16까지입니다. Virse에는 네 모델이 있습니다. Seedance 2.0과 Seedance 2.0 Fast는 첫 프레임, 마지막 프레임 또는 둘 모두를 받고, Seedance 2.0 Reference와 Seedance 2.0 Fast Reference는 대신 제공한 참고 자료로 작업합니다.

나중에 더하지 않고 영상과 함께 소리를 생성합니다.
한 번의 생성 길이이며 이전 결과를 이어 확장할 수 있습니다.
업스케일이 아닌 진짜 4K 출력이며 그 아래 480P, 720P, 1080P도 있습니다.
이미지, 영상 클립, 오디오를 모두 입력으로 제공할 수 있습니다.
프레임 기반과 레퍼런스 기반 경로에 각각 Fast 모델이 있습니다.
같은 서면 브리프로 21:9부터 9:16까지 지원합니다.
영상과 함께 소리를 생성하므로 발이 닿을 때 발소리가 납니다. 이런 동기화는 무음 클립에 나중에 소리를 붙여서는 어렵고 동시 생성 모델을 선택하는 주된 이유입니다.
대부분의 영상 모델은 사진을 받습니다. 이 모델은 영상 클립과 오디오도 참고 자료로 받아 동작의 특성과 소리의 질감을 설명 대신 보여 줄 수 있습니다.
네 모델은 명확히 구분됩니다. 시작과 끝 구도를 안다면 프레임을 제공하고, 피사체를 유지해야 하며 설명보다 보여 주기가 쉽다면 레퍼런스를 제공하세요.
480P는 타이밍과 동작 시험이 완성본 예산을 소모하지 않도록 마련되었습니다. 크기를 올려도 브리프는 바뀌지 않습니다.
Seedance 2.0 Fast와 Fast Reference는 낮은 크기를 더 적은 비용으로 제공하며 탐색 단계에 적합합니다.
실사풍 영상만큼 쉽게 2D 만화 움직임, 3D 애니메이션 시퀀스, 일러스트 표현도 처리합니다.
레퍼런스 기반 영상에는 먼저 참고 자료가 필요하지만 깔끔한 모음으로 오는 경우는 드뭅니다. 캐릭터, 제품 사진, 동작 레퍼런스가 각각 다른 곳에서 옵니다. Virse는 영상을 만드는 같은 공간에서 자료를 모읍니다. 캔버스의 어떤 이미지 모델로 만든 정지 이미지든 내보내고 다시 업로드하지 않고 Seedance 2.0의 레퍼런스나 프레임으로 바로 사용할 수 있습니다.
이미지 모델로 캐릭터와 제품 정지 이미지를 만든 뒤 Seedance 2.0이 바로 참조하게 하세요.
480P에서 타이밍과 움직임을 정하고 같은 브리프를 1080P 또는 4K로 다시 실행하세요.
캔버스를 벗어나거나 브리프를 다시 쓰지 않고 Seedance 2.0과 30개 이상의 다른 이미지 및 영상 모델 사이를 오가세요.
시퀀스의 모든 클립에 같은 레퍼런스 모음을 재사용해 전체 일관성을 유지하세요.
배경 오디오를 영상과 함께 생성하는 짧은 브랜드 시퀀스.
정해진 구도로 시작하고 끝나는 회전, 공개 연출, 디테일 촬영.
샷마다 같은 룩을 유지하는 일러스트 및 애니메이션 시퀀스.
샷마다 한 출연자를 알아볼 수 있게 유지하는 클립 모음.
480P로 초안을 만들고 1080P로 마무리하는 세로 및 가로 영상.
제작에 들어가기 전에 스토리보드를 움직이는 참고 영상으로 변환.
정해진 구도에는 프레임 기반, 연속성에는 레퍼런스 기반, 탐색에는 Fast를 사용하세요.
시작과 마지막 프레임 또는 참고 자료를 업로드하고 각각의 역할을 설명하세요.
무엇이 움직이고 카메라가 어떻게 동작하며 어떤 소리가 나야 하는지 설명하세요.
승인된 브리프를 한 글자도 바꾸지 않고 1080P 또는 4K로 올리세요.
유용한 Seedance 2.0 프롬프트에는 보통 여섯 가지 요소가 포함됩니다.
이렇게 쓰는 대신
시계 제품 영상, 영화 같은 표현.
이렇게 쓰세요
Image 1의 시계 문자판이 단일 강한 머리 위 조명 아래 프레임을 채우며 시작한다. 광택 베젤 위로 반사가 이동하는 동안 케이스 주위를 천천히 시계 방향으로 돈다. 중간 지점에서 뒤로 물러나 어두운 돌 위에 놓인 시계 전체를 보여 준다. Image 2의 구도로 끝낸다. 컷 없이 움직임을 이어간다. 내내 조용한 실내 소리와 카메라가 멈출 때 낮은 금속음 한 번.
Image 1의 마개가 닫힌 향수병으로 시작하고 짙은 버건디 배경 중앙에 둔다. 클립의 처음 3분의 1 동안 빛이 유리 위로 이동하며 카메라가 천천히 다가간다. 병과 카메라는 고정한 채 하나의 연속 동작으로 마개를 들어 올린다. 마개가 병 위에 떠 있는 Image 2의 구도로 끝낸다. 희미한 실내 주변음과 마개가 들리는 순간 부드러운 유리 울림 한 번.
Image 1의 캐릭터를 Image 2의 일러스트 스타일로 움직이게 한다. 손으로 그린 숲 공터의 왼쪽에서 걸어 들어와 중앙에 멈추고 나무 사이로 빛이 비치면 위를 바라본다. 레퍼런스의 선, 색상 팔레트, 비율을 내내 유지한다. 카메라는 고정. 새소리를 포함한 여러 층의 숲 주변음과 캐릭터가 올려다볼 때 가볍게 상승하는 음악 구절.
Image 1의 모델, Image 2의 재킷, Image 3의 옥상 장소를 사용한다. 모델이 카메라를 향해 돌아서는 미디엄 샷으로 시작한 뒤 도시 스카이라인이 뒤에 들어오면서 천천히 오른쪽으로 이동한다. 얼굴과 재킷의 재단, 색상, 질감을 레퍼런스 그대로 유지한다. 흐린 날의 자연광. 바람, 먼 교통 소리, 그 아래 절제된 전자 음악 배경.
| 비교 항목 | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| 클립 길이 | 4~15초 | 최대 30초 |
| 레퍼런스 입력 | 이미지, 영상, 오디오 | 더 폭넓은 멀티모달 레퍼런스 모음 |
| 이야기 연속성 | 단일 샷과 짧은 시퀀스 | 긴 이야기를 위한 여러 차례 확장 |
| 편집 제어 | 클립 전체의 프롬프트 수준 제어 | 특정 순간을 타임스탬프 단위로 제어 |
| Virse 내 항목 | 프레임과 레퍼런스로 나뉜 네 모델 | 하나 |
| 적합한 용도 | 선택한 크기의 정해진 샷 | 더 길고 구조화된 이야기 |
동시 생성 모델에서 소리를 언급하지 않는 것은 중립이 아니라 모델에게 결정을 맡기는 것입니다. 단순해도 믹스를 지정하세요.
마지막 구도를 고정하면 특정 위치로 마무리해야 하는 샷의 편차 대부분을 없앱니다.
각 이미지, 클립, 오디오 파일이 제공할 것을 명시하면 모델이 평균내 섞는 것을 막습니다.
가장 낮은 크기에서 프레이밍, 속도감, 카메라 이동을 정하고 납품 예산은 한 번만 쓰세요.