2K sebagai Standar
Bukan tingkat premium—setiap hasil beresolusi 2K.
Model Hailuo 03 dari MiniMax menghasilkan video 2K tanpa suara, dipandu bingkai pertama dan terakhir atau kumpulan gambar referensi.
Buka halaman ini di peramban desktop untuk mulai berkarya.
Minimax H3 adalah model video MiniMax, dengan posisi di Virse yang sangat sederhana: menghasilkan 2K, tidak menghasilkan suara, dan tidak ada keputusan lain yang perlu dibuat.
Kebanyakan model video menyediakan matriks pilihan—resolusi, rasio aspek, tingkat kualitas—dan setiap pilihan sedikit menghambat awal kerja. Model ini hanya memiliki satu konfigurasi. Setiap hasil berupa 2K dengan audio native, termasuk dialog tersinkron bibir, sehingga klip langsung bersuara, bukan menunggu proses musik terpisah.
Gunakan Minimax H3 ketika resolusi diperlukan dan audio tidak. Buat gerakan produk kaya detail, seri karakter berbasis referensi, serta rekaman untuk lini masa yang suaranya ditangani terpisah.

Minimax H3 adalah model pembuatan video AI dari MiniMax, dikenal dengan nama backend Hailuo 03. Virse menyediakannya sebagai dua entri dengan masukan berbeda dan hasil sama.
Model ini memiliki tiga keunggulan utama:
Minimax H3 menerima bingkai pertama, terakhir, atau keduanya, beserta arahan tertulis. Minimax H3 Reference memakai gambar referensi, membawa subjek, gaya, dan bahasa visualnya ke rangkaian buatan. Keduanya menghasilkan 2K dengan audio native.
Bukan tingkat premium—setiap hasil beresolusi 2K.
Trek audio buatan hadir bersama setiap klip, tanpa opsi untuk mematikannya.
Berbasis bingkai dan berbasis referensi, terdaftar terpisah.
Tidak ada pemilih resolusi atau tingkat kualitas. Audio selalu aktif, bukan opsional.
Entri Reference menerima gambar yang diberikan sebagai pengarah.
Entri standar menetapkan salah satu titik ujung bidikan, atau keduanya.
Model ini menghasilkan 2K. Tidak ada tingkat untuk dipertimbangkan atau peningkatan untuk dipilih, menghilangkan sumber keraguan paling umum sebelum membuat video.
Sinkronisasi bibir dan suasana dibuat pada proses yang sama dengan gambar. Ini perilaku bawaan, bukan pengaturan yang harus diingat untuk diaktifkan.
Saat karakter harus muncul dalam enam klip dan tetap dikenali, menunjukkan contoh lebih baik daripada mendeskripsikannya. Entri Reference memang dibuat untuk itu.
Beberapa gambar masing-masing dapat memiliki tugas berbeda—orang, latar, atau gaya—bukan diratakan menjadi satu pengaruh.
Entri standar menerima bingkai pertama dan terakhir, menjadikan pembuatan sebagai jalur antara dua komposisi yang diketahui, bukan jalur terbuka.
Memilih berbasis bingkai atau referensi bergantung pada bahan yang dimiliki, bukan kemampuan membayar.
Pekerjaan kontinuitas berbasis referensi bergantung pada kumpulan referensi yang tetap stabil. Ubah satu gambar antarklip dan karakter bergeser, biasanya tanpa disadari sampai rangkaian disusun. Virse menyimpan kumpulan itu di satu tempat. Gambar referensi berada di kanvas bersama setiap klip yang dibuat darinya, sehingga masukan yang sama dipakai ulang, bukan dikumpulkan kembali, dan penyimpangan terlihat selagi masih ada waktu memperbaikinya.
Simpan gambar karakter, produk, dan gaya bersama di kanvas, lalu arahkan setiap klip ke gambar yang sama.

Buat gambar diam dengan model gambar pada kanvas yang sama, lalu serahkan ke Minimax H3 tanpa ekspor.

Beralih antara Minimax H3 dan lebih dari 30 model gambar serta video lain tanpa meninggalkan kanvas atau menulis ulang arahan.

Tata rangkaian secara berurutan agar subjek yang menyimpang antara bidikan kedua dan kelima terlihat jelas.

Beberapa klip menampilkan orang yang sama, disatukan oleh kumpulan referensi bersama.
Rotasi, pengungkapan, dan penelusuran detail pada resolusi yang tetap baik setelah dipotong.
Referensi pakaian dan gaya mengarahkan gerakan tanpa perlu dideskripsikan ulang setiap kali.
Klip bergaya dengan bahasa visual tertentu yang harus bertahan antarbidikan.
Klip berbasis bingkai dengan komposisi yang sudah ditentukan.
Materi untuk lini masa ketika dialog dan suasana buatan menjadi titik awal, bukan sesuatu yang ditambahkan kemudian.
Berbasis bingkai jika komposisi diketahui, berbasis referensi jika subjek harus tetap dikenali.
Muat dua bingkai titik ujung, atau kumpulan referensi dengan tugas tiap gambar dijelaskan.
Nyatakan yang bergerak dalam adegan, perilaku kamera, dan kecepatannya.
Pertahankan masukan yang sama dan ubah hanya arahan agar seri tetap koheren.
Prompt Minimax H3 yang berguna biasanya mencakup empat unsur:
Alih-alih menulis
Model berjalan di galeri, sinematik, memakai referensi terlampir.
Tulis
Gunakan orang pada Gambar 1, mantel pada Gambar 2, dan interior galeri pada Gambar 3. Ia berjalan dari tepi kiri menuju tengah dengan santai lalu berhenti menghadap lukisan di luar kamera sebelah kanan. Kamera mengikutinya pada jarak konstan, menjaga ukuran tubuhnya sama dalam bingkai. Akhiri dengan ia diam, terlihat dari samping, di tengah bingkai.
Gunakan perempuan pada Gambar 1 dan interior bengkel pada Gambar 2. Ia duduk di meja kerja, tangannya mengerjakan sesuatu di luar bingkai. Ia berhenti, menengadah ke jendela kiri, lalu kembali melihat tangannya. Kamera mempertahankan bidikan sedang statis sedikit di atas tinggi meja, tanpa gerakan atau potongan. Pertahankan wajah, rambut, dan pakaian persis seperti Gambar 1. Akhiri dengan kepala kembali menunduk.
Buka dengan komposisi Gambar 1: tas kulit berdiri tegak pada tepian batu pucat, gesper menghadap kamera. Kamera mengorbit perlahan ke kiri sekitar empat puluh lima derajat, menjaga tas di tengah dengan ukuran konstan. Cahaya tetap saat kamera bergerak, sehingga sorotan melintas pada kulit dan komponen logam. Akhiri dengan tampilan tiga perempat, gusset samping dan jahitan terlihat.
Mulai dari Gambar 1: panggung kosong dengan satu penyangga mikrofon, lampu ruangan menyala. Lampu ruangan meredup selama separuh pertama klip, sementara satu lampu sorot dari atas menguat pada mikrofon. Tidak ada yang lain bergerak. Kamera mempertahankan bidikan lebar tetap sepanjang klip. Akhiri pada Gambar 2: panggung gelap selain mikrofon yang diterangi.
| Dimensi | Minimax H3 | Minimax H3 Reference |
|---|---|---|
| Masukan | Bingkai pertama, terakhir, atau keduanya | Gambar referensi yang diberikan |
| Hasil | 2K tanpa suara | 2K tanpa suara |
| Paling cocok untuk | Bidikan dengan komposisi terdefinisi | Subjek yang harus tetap dikenali |
| Kontrol titik ujung | Kedua ujung dapat ditetapkan | Dipandu referensi, bukan bingkai |
| Penggunaan umum | Gerakan produk, transisi | Seri karakter, kampanye bergaya |
| Biaya berpindah | Struktur arahan sama pada keduanya | Struktur arahan sama pada keduanya |
Mengunggah tiga gambar tanpa menyebut yang mana subjeknya adalah penyebab paling umum arahan ini gagal.
Mengubah satu gambar antarklip cukup untuk memutus kontinuitas. Ubah arahannya saja.
Hasil memiliki suara. Petunjuk dialog, efek, dan suasana dalam prompt membentuk hasil audio.
Bidikan yang bergerak dari satu keadaan terdefinisi ke keadaan lain adalah keunggulan entri standar.
Pilih entri sesuai bahan yang dimiliki, jelaskan gerakan, dan terima hasil 2K tanpa layar konfigurasi di antaranya.