Audio dan Video Bersama
Suara dibuat bersama gambar, bukan ditambahkan setelahnya.
Seedance 2.0 dari ByteDance menghasilkan gambar dan suara dalam satu proses, dari bingkai pertama dan terakhir atau gambar referensi, pada ukuran 480P hingga 4K native.
Buka halaman ini di peramban desktop untuk mulai berkarya.
Seedance 2.0 adalah model video ByteDance, dengan sifat khas bahwa audio bukan tahap terpisah.
Kebanyakan video buatan hadir tanpa suara lalu diberi musik, sehingga banyak yang terasa seperti rekaman dengan musik ditumpangkan. Seedance 2.0 membuat audio dan video bersama, sehingga suasana, suara gerakan, dan ritme sesuai waktu kejadian di layar, bukan dicocokkan secara perkiraan belakangan. Virse menawarkan empat entri, memisahkan pembuatan berbasis bingkai dan berbasis referensi, masing-masing dengan varian Fast.
Gunakan Seedance 2.0 ketika suara klip harus sesuai tempat yang digambarkan. Buat potongan iklan, gerakan produk, rangkaian animasi, seri karakter, dan video sosial dengan audio sebagai bagian bidikan, bukan keputusan yang ditunda.

Seedance 2.0 adalah model pembuatan video AI dari ByteDance. Model membuat video dengan audio dua saluran tersinkronisasi, mengikuti instruksi tertulis tentang subjek, aksi, perilaku kamera, tempo, dan suara.
Model ini memiliki tiga keunggulan utama:
Durasi pembuatan empat hingga lima belas detik, dengan rasio aspek 21:9 hingga 9:16. Virse menyediakan empat entri: Seedance 2.0 dan Seedance 2.0 Fast menerima bingkai pertama, terakhir, atau keduanya, sedangkan Seedance 2.0 Reference dan Seedance 2.0 Fast Reference memakai bahan referensi yang diberikan.

Suara dibuat bersama gambar, bukan ditambahkan setelahnya.
Durasi satu proses pembuatan, dapat diperpanjang dengan melanjutkan hasil sebelumnya.
Hasil 4K asli, bukan peningkatan ukuran, dengan 480P, 720P, dan 1080P tersedia di bawahnya.
Gambar, klip video, dan audio semuanya dapat diberikan sebagai masukan.
Jalur berbasis bingkai dan referensi, masing-masing memiliki varian Fast.
21:9 hingga 9:16 dari arahan tertulis yang sama.
Karena suara dibuat bersama gambar, bunyi langkah terdengar saat kaki mendarat. Sinkronisasi itu sulit dicapai dengan menambahkan musik atau suara pada klip senyap setelahnya, dan menjadi alasan utama memilih model gabungan.
Kebanyakan model video menerima gambar. Model ini juga menerima klip video dan audio sebagai referensi, sehingga karakter gerakan dan tekstur suara dapat ditunjukkan, bukan dideskripsikan.
Keempat entri terbagi jelas. Berikan bingkai jika awal dan akhir bidikan diketahui; berikan referensi jika subjek harus tetap dikenali dan lebih mudah ditunjukkan daripada dijelaskan.
480P tersedia agar pengujian waktu dan gerakan tidak menghabiskan anggaran hasil final. Arahan tidak berubah saat naik ukuran.
Seedance 2.0 Fast dan Fast Reference mencakup ukuran lebih rendah dengan biaya lebih kecil, cocok untuk putaran eksplorasi.
Model menangani gerakan kartun 2D, rangkaian animasi 3D, dan gaya ilustrasi semudah rekaman bergaya aksi nyata.
Video berbasis referensi membutuhkan referensi yang sudah tersedia, dan referensi jarang datang sebagai kumpulan rapi. Karakter berasal dari satu tempat, foto produk dari tempat lain, referensi gerakan dari tempat ketiga. Virse menyusun bahan itu di ruang yang sama tempat video dibuat. Gambar diam dari model gambar mana pun pada kanvas dapat langsung masuk ke Seedance 2.0 sebagai referensi atau bingkai, tanpa ekspor dan unggah ulang di antaranya.
Buat gambar diam karakter dan produk dengan model gambar, lalu arahkan Seedance 2.0 langsung kepadanya.
Tetapkan waktu dan gerakan pada 480P, lalu jalankan arahan yang sama pada 1080P atau 4K.
Beralih antara Seedance 2.0 dan lebih dari 30 model gambar serta video lain tanpa meninggalkan kanvas atau menulis ulang arahan.
Gunakan kumpulan referensi sama untuk setiap klip dalam rangkaian agar keseluruhan tetap konsisten.
Rangkaian merek pendek dengan latar audio dibuat bersama gambar.
Rotasi, pengungkapan, dan penelusuran detail yang mulai serta berakhir pada komposisi tertentu.
Rangkaian ilustrasi dan animasi yang mempertahankan tampilan konsisten antarbidikan.
Rangkaian klip dengan satu pemeran tetap dikenali dari bidikan ke bidikan.
Potongan vertikal dan lanskap yang didraf pada 480P dan difinalisasi pada 1080P.
Papan cerita diubah menjadi referensi bergerak sebelum masuk produksi.
Berbasis bingkai untuk komposisi terdefinisi, berbasis referensi untuk kontinuitas, Fast untuk eksplorasi.
Unggah bingkai pembuka dan penutup, atau bahan referensi, lalu jelaskan kontribusi masing-masing.
Jelaskan yang bergerak, perilaku kamera, dan seperti apa suara klipnya.
Naikkan arahan yang disetujui ke 1080P atau 4K tanpa mengubah satu kata pun.
Prompt Seedance 2.0 yang berguna biasanya mencakup enam unsur:
Alih-alih menulis
Video produk jam tangan, sinematik.
Tulis
Buka dengan muka jam tangan pada Gambar 1 memenuhi bingkai di bawah satu cahaya keras dari atas. Putar perlahan searah jarum jam mengelilingi casing saat pantulan melintas pada bezel mengilap. Pada pertengahan klip, mundur untuk memperlihatkan seluruh jam di atas batu gelap. Akhiri pada komposisi Gambar 2. Pertahankan gerakan berkelanjutan tanpa potongan. Suasana ruangan tenang sepanjang klip, dengan satu nada logam rendah saat kamera berhenti.
Mulai dari botol parfum tertutup pada Gambar 1, di tengah latar burgundi pekat. Maju perlahan selama sepertiga pertama klip saat cahaya bergeser pada kaca. Angkat sumbat dalam satu gerakan berkelanjutan, dengan botol tetap diam dan kamera stabil. Akhiri pada komposisi Gambar 2, sumbat melayang di atas botol. Suasana ruangan samar dan satu denting kaca lembut saat sumbat terangkat.
Animasikan karakter Gambar 1 dalam gaya ilustrasi Gambar 2. Karakter berjalan masuk dari kiri ke lahan terbuka hutan yang dilukis tangan, berhenti di tengah, dan menengadah saat cahaya menembus kanopi. Pertahankan garis, palet warna, dan proporsi referensi sepanjang klip. Kamera tetap. Suasana hutan berlapis dengan kicau burung dan frasa musik ringan yang meninggi saat karakter menengadah.
Gunakan model pada Gambar 1, jaket pada Gambar 2, dan lokasi atap pada Gambar 3. Mulai dengan bidikan sedang saat model berbalik ke kamera, lalu bergeser perlahan ke kanan saat cakrawala kota masuk bingkai di belakangnya. Pertahankan wajah serta potongan, warna, dan tekstur jaket sesuai referensi. Cahaya mendung. Angin, lalu lintas jauh, dan latar musik elektronik yang terkendali.
| Dimensi | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| Durasi klip | Empat hingga lima belas detik | Hingga tiga puluh detik |
| Masukan referensi | Gambar, video, dan audio | Kumpulan referensi multimodal lebih luas |
| Kontinuitas cerita | Bidikan tunggal dan rangkaian pendek | Perpanjangan bertahap untuk narasi lebih panjang |
| Kontrol pengeditan | Melalui prompt untuk seluruh klip | Melalui cap waktu pada momen tertentu |
| Entri di Virse | Empat, memisahkan bingkai dari referensi | Satu |
| Posisi penggunaannya | Bidikan terdefinisi pada ukuran pilihan | Narasi terstruktur lebih panjang |
Pada model gabungan, diam tentang suara bukan netral—artinya model yang memutuskan. Sebutkan campuran audio meski sederhana.
Membatasi komposisi penutup menghilangkan sebagian besar penyimpangan pada bidikan yang harus berakhir secara tertentu.
Menyebut kontribusi setiap gambar, klip, atau berkas audio mencegah model meratakan semuanya menjadi satu.
Tetapkan pembingkaian, tempo, dan gerakan kamera pada ukuran terendah, lalu gunakan anggaran penyerahan hanya sekali.
Bawa bingkai pembuka, referensi, dan arahan suara ke satu ruang kerja, lalu biarkan model menangani gerakan dan campuran audio bersama.