Pustaka Model
Semua model yang tersedia di dalam Virse, dikelompokkan menurut apa yang dihasilkannya. Pilih satu untuk membuka halamannya, atau langsung berkarya dengannya di kanvas.
Video7 model
Model video Google yang multimodal secara native, menerima teks, gambar, video, dan audio, ditawarkan di Virse sebagai entri berbasis bingkai dan berbasis referensi.
GoogleModel video AI Happy Horse 1.0 membutuhkan satu gambar diam dan satu kalimat, menghasilkan gerakan dari bingkai yang sudah Anda miliki.
AlibabaKling 3.0 dari Kuaishou dapat berbicara — dialog tersinkronisasi bibir dalam lima bahasa, suara berbeda untuk tiap karakter, dan mode storyboard yang menyusun keseluruhan rangkaian.
KuaishouModel Hailuo 03 dari MiniMax menghasilkan video 2K tanpa suara, dipandu bingkai pertama dan terakhir atau kumpulan gambar referensi.
MiniMaxSeedance 2.0 dari ByteDance menghasilkan gambar dan suara dalam satu proses, dari bingkai pertama dan terakhir atau gambar referensi, pada ukuran 480P hingga 4K native.
ByteDanceBuat video sinematik 30 detik dengan Seedance 2.5, dilengkapi audio tersinkronisasi, referensi multimodal, dan kontrol kreatif yang presisi.
ByteDanceVeo 3.1 dari Google DeepMind menghasilkan klip pendek dengan audio 48kHz yang tersinkronisasi dan memperpanjangnya menjadi rangkaian yang lebih panjang dengan meneruskan frame penutup ke depan.
GoogleGambar14 model
ChatGPT Images 2.5 dari OpenAI hadir di Virse dalam kedua edisi API, GPT Image 2.5 Flare dan GPT Image 2.5 Sunburst, dengan enam tingkat kualitas dan output hingga 4K.
OpenAIGenerasi lini FLUX dari Black Forest Labs yang hadir sebelum FLUX 2, tetap tersedia sebagai dua entri — model standar dan Ultra.
Black Forest LabsModel produksi Black Forest Labs membaca arahan hingga 32.000 token, sehingga aturan merek, nilai warna, dan batasan komposisi dapat diberikan sekaligus.
Black Forest LabsModel penyuntingan Black Forest Labs, FLUX Kontext Pro dan Kontext Max, dibuat untuk menerapkan satu perubahan yang dijelaskan sambil mempertahankan bagian bingkai lainnya.
Black Forest LabsGPT Image 2.0 dari OpenAI membaca arahan seratus kata dan mencoba menjalankan semuanya, dengan kontrol kualitas dan resolusi terpisah dari 1K hingga 4K.
OpenAIGemini 2.5 Flash Image dari Google—Nano Banana asli—membuat dan menyunting gambar secepat percakapan, sehingga koreksi cukup dengan satu kalimat, bukan satu sesi.
GoogleModel fondasi teks-ke-gambar yang dilatih dari awal untuk tata letak, dengan penempatan kotak pembatas, pengondisian warna heksadesimal, dan keluaran 2K native.
IdeogramNano Banana 2 dari Google memadukan kualitas gambar kelas unggulan dengan kecepatan kelas Flash, dalam empat ukuran hasil dari prototipe cepat 0.5K hingga hasil final 4K.
GoogleBuat gambar 4K berkualitas studio dengan Nano Banana Pro, memadukan beberapa referensi sambil menjaga konsistensi karakter, produk, dan tipografi.
GoogleQwen Image 3.0 Pro dari Alibaba merender huruf sebagai bahasa dalam belasan sistem tulisan, dengan keterbacaan hingga ukuran sepuluh piksel pada tata letak padat.
AlibabaModel generasi kedua Reve AI membangun tata letak dengan elemen berposisi yang dapat dituju sebelum merender, sehingga susunan yang ditentukan kembali sesuai susunannya.
ReveSeedream 4.0 dan Seedream 4.5 dari ByteDance menghasilkan gambar dari deskripsi tertulis dan dari gambar yang Anda berikan, mengubah satu gambar sumber menjadi sebanyak mungkin arah yang dibutuhkan proyek.
ByteDanceGenerasi Seedream terbaru dari ByteDance, tersedia sebagai Seedream 5.0 Pro dan Seedream V5 Lite, keduanya menggunakan brief tertulis yang sama.
ByteDanceModel 6 miliar parameter yang dipadatkan menjadi pipeline inferensi delapan langkah, dibuat untuk menghasilkan gambar yang siap pakai sebelum alur pikiran Anda beralih.
Alibaba