2K Native, Tersedia 4K
Hasil standar 2K, dengan 4K tersedia untuk cetak dan pemotongan besar.
GPT Image 2.0 dari OpenAI membaca arahan seratus kata dan mencoba menjalankan semuanya, dengan kontrol kualitas dan resolusi terpisah dari 1K hingga 4K.
Buka halaman ini di peramban desktop untuk mulai berkarya.
GPT Image 2 adalah model gambar OpenAI dengan perilaku khas: instruksi panjang tidak diratakan menjadi kesan umum.
Kebanyakan model memburuk ketika arahan memanjang. Tambahkan persyaratan kelima dan persyaratan kedua diam-diam hilang; tentukan delapan objek dan Anda mendapat enam. GPT Image 2 dibuat untuk mempertahankan batasan yang terdiri dari banyak bagian, dengan akurasi kepatuhan instruksi sekitar 98 persen menurut OpenAI, serta merender teks hampir presisi per karakter, bukan sekadar memperkirakan bentuk huruf.
Gunakan GPT Image 2 ketika gambar memiliki persyaratan, bukan sekadar nuansa. Buat rancangan kemasan yang diatur regulasi, gambar produk berdasarkan spesifikasi, tata letak beranotasi, still life multiobjek, dan hasil apa pun yang akan diperiksa peninjau berdasarkan daftar.

GPT Image 2 adalah model pembuatan gambar AI dari OpenAI, penerus GPT Image 1.5 dan GPT Image 1 serta model di balik pembuatan gambar dalam ChatGPT. Virse menyediakannya langsung, dengan kontrol kualitas dan resolusi yang disembunyikan antarmuka percakapan.
Model ini memiliki tiga keunggulan utama:
GPT Image 2 memakai arsitektur autoregresif, bukan pendekatan difusi kebanyakan model lain; menurut OpenAI, inilah yang membuat pembuatan tiga hingga lima kali lebih cepat dari versi sebelumnya. Hasil native 2K dengan 4K tersedia, rasio aspek 3:1 hingga 1:3, dan kualitas render dapat dipilih Rendah, Sedang, atau Tinggi secara terpisah dari ukuran.

Hasil standar 2K, dengan 4K tersedia untuk cetak dan pemotongan besar.
Rendah, Sedang, dan Tinggi, dipilih terpisah dari ukuran hasil.
1K, 2K, 3K, dan 4K, masing-masing tersedia pada setiap tingkat kualitas.
Arahan dengan banyak bagian menghasilkan gambar dengan bagian-bagian tetap utuh.
Dari panorama lebar hingga vertikal tinggi dengan arahan yang sama.
Pendekatan pembuatan berbeda dari difusi, dengan peningkatan kecepatan yang diklaim 3–5 kali.

Karena model mempertahankan banyak batasan sekaligus, detail yang Anda tulis menjadi detail yang diperoleh. Spesifikasi seratus kata tidak sia-sia di sini, berbeda dari model yang merangkum maksud Anda sebelum membuat gambar.

Dua kontrol terpisah memungkinkan draf besar maupun hasil final kecil. Kebanyakan model mengaitkan fidelitas dengan ukuran hasil tanpa cara memisahkannya.

Judul, label, dan papan tanda muncul terbaca, bukan perkiraan bentuk huruf, sehingga model ini termasuk yang terkuat di sini untuk gambar berisi kata-kata.

Komposisi dengan beberapa objek yang harus berhubungan secara benar—berada pada permukaan, membentuk bayangan serasi, berbagi arah cahaya—tetap koheren tanpa menyimpang ke keadaan yang tidak masuk akal secara fisik.

Sertakan gambar bersama prompt, lalu model bekerja berdasarkan gambar itu, mempertahankan yang Anda sebutkan dan mengubah yang Anda minta.

Model memakai pengetahuan dasar yang sama dengan saudara model teksnya, terlihat dari caranya menangani objek nyata, konteks, dan konvensi tanpa harus dijelaskan dari awal.
Arahan dengan persyaratan tetap jarang datang dalam keadaan selesai. Arahan disusun dari lembar spesifikasi, panduan merek, foto referensi, dan tiga putaran masukan. Virse menjaga bahan itu di samping hasil. Arahan, referensi sumbernya, dan setiap hasil pembuatan berada pada satu kanvas, sehingga memeriksa hasil terhadap persyaratannya tidak perlu membuka jendela kedua.
Letakkan daftar persyaratan pada kanvas di samping gambar agar tinjauan mengacu pada sumber, bukan ingatan.

Tetapkan komposisi pada kualitas Rendah, lalu jalankan arahan yang sama pada Sedang atau Tinggi setelah konten disepakati.

Beralih antara GPT Image 2 dan lebih dari 30 model gambar serta video lain tanpa meninggalkan kanvas atau menulis ulang arahan.

Setiap putaran masukan menghasilkan gambar baru di samping sebelumnya, sehingga jejak dari draf pertama hingga aset yang disetujui tetap utuh.


Render yang harus sesuai spesifikasi tertulis hingga susunan dan finishing.

Tata letak bagian depan kemasan yang memuat nama produk, deskriptor, dan teks yang diwajibkan secara hukum secara tepat.

Penampang dan grafik penjelasan dengan label yang harus benar, bukan dekoratif.

Susunan dengan posisi, skala, dan bayangan setiap benda ditentukan.

Ruang yang dibangun sesuai denah yang dijelaskan, bukan perkiraan suasana.

Gambar konsep artikel dengan arahan yang membawa beberapa ide sekaligus.
Mulai dari tingkat terendah selama Anda masih menentukan isi gambar.
Daftar setiap elemen, posisinya, dan hal yang harus persis. Arahan panjang menguntungkan di sini.
Bandingkan satu per satu, bukan berdasarkan kesan umum, lalu tambahkan klausul untuk hal yang belum ada.
Gunakan arahan yang sudah berhasil tanpa perubahan pada kualitas Sedang atau Tinggi dan ukuran target.
Prompt GPT Image 2 yang berguna biasanya mencakup lima unsur:
Alih-alih menulis
Sudut baca nyaman, hangat dan mengundang, cahaya alami indah.
Tulis
Bangku jendela menyatu dengan jendela menjorok, berlapis beludru hijau pudar, dengan tiga bantal berbeda didorong ke sisi kiri. Buku sampul keras terbuka telungkup di bangku. Matahari sore masuk rendah dari kanan, membentuk bayangan bingkai jendela pada bantal. Di balik kaca, taman di luar fokus. Difoto lurus dari depan sejauh dua meter, bangku mengisi dua pertiga bawah bingkai.

Dapur galley sempit difoto dari pintu masuk, lurus dari depan, setinggi mata. Lemari hijau sage matte dengan pegangan mangkuk kuningan sepanjang dinding kiri. Rak terbuka di kanan berisi enam mangkuk keramik putih dalam satu baris. Jendela di ujung dengan tirai diturunkan separuh. Hanya cahaya mendung dari jendela, tanpa cahaya buatan, bayangan lembut. Lantai ubin terakota tanpa glasir dipasang dengan pola sambungan berselang.

Empat objek disusun pada meja kayu ek lapuk, difoto dari 45 derajat di atas. Kendi pewter di belakang kiri, kain linen abu-abu terlipat di depannya, tiga kenari tersebar di kanan kain, dan satu pir di sudut depan kanan. Setiap objek membentuk bayangan sesuai satu sumber cahaya dari kiri atas. Kenari agak terpisah, tidak ada yang bersentuhan. Palet redup, kontras terkendali, serat kayu terlihat membentang kiri ke kanan.

Stoples persegi panjang berisi awetan difoto lurus dari depan pada latar krem polos. Label depan bertuliskan ORCHARD ROW dengan serif sempit pada sepertiga atas, dengan "Damson & Bay Leaf" di bawahnya dalam huruf miring berukuran separuh, serta "227g" dalam kapital kecil pada tepi bawah. Cahaya hangat merata dari depan kiri, satu bayangan lembut di kanan stoples. Label menempati 60 persen tengah tinggi stoples, dengan margin sama di kedua sisi.
| Dimensi | GPT Image 1 | GPT Image 1.5 | GPT Image 2 |
|---|---|---|---|
| Kontrol kualitas | Tidak ada | Tidak ada | Rendah / Sedang / Tinggi |
| Kontrol resolusi | Tidak ada | Tidak ada | 1K / 2K / 3K / 4K |
| Arsitektur | Era difusi | Era difusi | Autoregresif |
| Kecepatan pembuatan | Acuan dasar | Acuan dasar | 3–5 kali lebih cepat dari pendahulunya |
| Rendering teks | Perkiraan | Ditingkatkan | Hampir presisi per karakter |
| Masih berguna untuk | Mencocokkan kumpulan aset yang sudah ada | Mencocokkan kumpulan aset yang sudah ada | Semua pekerjaan baru |
Ini model langka yang menghasilkan gambar lebih baik dari arahan lebih panjang. Detail yang Anda lewatkan dipilihkan oleh model.
"Kendi di belakang kiri" dapat ditindaklanjuti. "Kendi" menyerahkan penempatan pada kebetulan, padahal penempatan biasanya menjadi pokok komentar tinjauan.
Kata yang harus muncul di gambar harus tertulis dalam prompt. Teks yang hanya dideskripsikan akan menjadi teks rekaan.
Kualitas mengubah seberapa baik gambar dirender; ukuran mengubah seberapa besar gambar. Mengubah keduanya sekaligus membuat penyebab perbedaannya tidak dapat diketahui.
Tulis daftar persyaratan, serahkan seluruhnya, lalu tinjau hasil terhadap daftar itu, bukan perasaan.