Katalog Model AI

Pustaka Model

Semua model yang tersedia di dalam Virse, dikelompokkan menurut apa yang dihasilkannya. Pilih satu untuk membuka halamannya, atau langsung berkarya dengannya di kanvas.

Video7 model

Model video Google yang multimodal secara native, menerima teks, gambar, video, dan audio, ditawarkan di Virse sebagai entri berbasis bingkai dan berbasis referensi.

Google

Model video AI Happy Horse 1.0 membutuhkan satu gambar diam dan satu kalimat, menghasilkan gerakan dari bingkai yang sudah Anda miliki.

Alibaba

Kling 3.0 dari Kuaishou dapat berbicara — dialog tersinkronisasi bibir dalam lima bahasa, suara berbeda untuk tiap karakter, dan mode storyboard yang menyusun keseluruhan rangkaian.

Kuaishou

Model Hailuo 03 dari MiniMax menghasilkan video 2K tanpa suara, dipandu bingkai pertama dan terakhir atau kumpulan gambar referensi.

MiniMax

Seedance 2.0 dari ByteDance menghasilkan gambar dan suara dalam satu proses, dari bingkai pertama dan terakhir atau gambar referensi, pada ukuran 480P hingga 4K native.

ByteDance

Buat video sinematik 30 detik dengan Seedance 2.5, dilengkapi audio tersinkronisasi, referensi multimodal, dan kontrol kreatif yang presisi.

ByteDance

Veo 3.1 dari Google DeepMind menghasilkan klip pendek dengan audio 48kHz yang tersinkronisasi dan memperpanjangnya menjadi rangkaian yang lebih panjang dengan meneruskan frame penutup ke depan.

Google

Gambar14 model

ChatGPT Images 2.5 dari OpenAI hadir di Virse dalam kedua edisi API, GPT Image 2.5 Flare dan GPT Image 2.5 Sunburst, dengan enam tingkat kualitas dan output hingga 4K.

OpenAI

Generasi lini FLUX dari Black Forest Labs yang hadir sebelum FLUX 2, tetap tersedia sebagai dua entri — model standar dan Ultra.

Black Forest Labs

Model produksi Black Forest Labs membaca arahan hingga 32.000 token, sehingga aturan merek, nilai warna, dan batasan komposisi dapat diberikan sekaligus.

Black Forest Labs

Model penyuntingan Black Forest Labs, FLUX Kontext Pro dan Kontext Max, dibuat untuk menerapkan satu perubahan yang dijelaskan sambil mempertahankan bagian bingkai lainnya.

Black Forest Labs

GPT Image 2.0 dari OpenAI membaca arahan seratus kata dan mencoba menjalankan semuanya, dengan kontrol kualitas dan resolusi terpisah dari 1K hingga 4K.

OpenAI

Gemini 2.5 Flash Image dari Google—Nano Banana asli—membuat dan menyunting gambar secepat percakapan, sehingga koreksi cukup dengan satu kalimat, bukan satu sesi.

Google

Model fondasi teks-ke-gambar yang dilatih dari awal untuk tata letak, dengan penempatan kotak pembatas, pengondisian warna heksadesimal, dan keluaran 2K native.

Ideogram

Nano Banana 2 dari Google memadukan kualitas gambar kelas unggulan dengan kecepatan kelas Flash, dalam empat ukuran hasil dari prototipe cepat 0.5K hingga hasil final 4K.

Google

Buat gambar 4K berkualitas studio dengan Nano Banana Pro, memadukan beberapa referensi sambil menjaga konsistensi karakter, produk, dan tipografi.

Google

Qwen Image 3.0 Pro dari Alibaba merender huruf sebagai bahasa dalam belasan sistem tulisan, dengan keterbacaan hingga ukuran sepuluh piksel pada tata letak padat.

Alibaba

Model generasi kedua Reve AI membangun tata letak dengan elemen berposisi yang dapat dituju sebelum merender, sehingga susunan yang ditentukan kembali sesuai susunannya.

Reve

Seedream 4.0 dan Seedream 4.5 dari ByteDance menghasilkan gambar dari deskripsi tertulis dan dari gambar yang Anda berikan, mengubah satu gambar sumber menjadi sebanyak mungkin arah yang dibutuhkan proyek.

ByteDance

Generasi Seedream terbaru dari ByteDance, tersedia sebagai Seedream 5.0 Pro dan Seedream V5 Lite, keduanya menggunakan brief tertulis yang sama.

ByteDance

Model 6 miliar parameter yang dipadatkan menjadi pipeline inferensi delapan langkah, dibuat untuk menghasilkan gambar yang siap pakai sebelum alur pikiran Anda beralih.

Alibaba