LarpGPT · Panduan
Rasio aspek untuk gambar AI: cara memilih dan mengaturnya
Persegi, 3:2, 16:9, atau vertikal 9:16: cara memilih rasio aspek untuk gambar AI, bagaimana komposisi berubah, dan cara Midjourney dan OpenAI mengaturnya.

Dalam panduan ini14
Mengapa rasio didahulukan
Rasio aspek adalah hubungan antara lebar dan tinggi gambar, ditulis dalam dua angka, misalnya 3:2 atau 16:9. Ini adalah keputusan pertama yang diambil seorang fotografer, karena ialah yang menentukan apa yang dapat ditampung oleh bingkai tersebut. Dalam pembuatan gambar, hal ini lebih penting lagi: model menyusun keseluruhan pemandangan untuk bingkai yang Anda berikan, jadi mengubah rasio setelahnya berarti memotong atau membuat ulang. Pilihlah sebelum Anda menyempurnakan perintah lainnya.
Rasio bukanlah resolusi
Rasio tidak menjelaskan apa pun tentang jumlah piksel. Dokumentasi Midjourney menyatakan hal ini secara langsung: rasio aspek tidak sama dengan dimensi gambar, dan ukuran akhir bergantung pada versi dan peningkatannya. Gambar 3:2 bisa berukuran kecil atau besar. Putuskan bentuk di mana gambar akan dilihat dan bagaimana subjek harus duduk di dalamnya, lalu bahas resolusi sebagai pertanyaan terpisah.
Persegi, 1:1
Alun-alun tersebut seimbang dan statis, tidak ada arah yang dominan. Ini sesuai dengan objek tunggal, komposisi simetris, dan subjek terpusat, dan ini adalah bingkai yang telah lama digunakan oleh banyak platform sosial untuk postingan dan gambar profil. Ini juga merupakan default di Midjourney, yang dokumentasinya mencatat bahwa gambar dimulai sebagai kotak. Bentuk persegi kurang cocok untuk lanskap dan pemandangan kelompok, yang subjeknya secara alami menyebar ke samping.
Foto klasik, 3:2 dan 2:3
3:2 adalah rasio fotografi diam tradisional, yang diwarisi dari film 35 mm, dan banyak kamera masih menggunakannya. Rasanya wajar untuk sebuah prompt fotografi karena ini adalah bentuk yang diasosiasikan orang dengan foto. Horizontal 3:2 cocok untuk jalanan, interior, dan lanskap; vertikal 2:3 cocok untuk potret, pintu, dan gedung tinggi, dan dokumentasi Midjourney menyebutkannya sebagai hal yang umum dalam fotografi cetak dan bingkai foto.
4:3 dan 5:4
4:3 adalah rasio televisi asli dan masih digunakan oleh banyak tablet dan sebagian besar kamera digital kompak. Ini sedikit lebih persegi dibandingkan 3:2, yang menyisakan lebih banyak ruang di atas dan di bawah subjek. 5:4 lebih persegi lagi dan umum dalam fotografi format besar dan menengah serta untuk cetakan berukuran 8 kali 10 inci. Keduanya cocok untuk interior dan potret di mana Anda menginginkan sedikit ruang bernapas tanpa tarikan horizontal yang kuat dari format lebar.
Layar lebar, 16:9
16:9 adalah rasio standar untuk televisi dan video online; Pusat bantuan YouTube menggambarkannya sebagai rasio aspek standar pada komputer. Bingkai lebarnya sesuai dengan lanskap, pemandangan kota, mobil yang sedang bergerak, dan adegan sinematik dengan subjek ditempatkan di satu sisi. Ini adalah pilihan tepat untuk spanduk, slide presentasi, dan gambar mini video. Ini lebih lemah untuk figur tunggal yang berdiri, yang berakhir kecil dalam bingkai lebar.
Vertikal, 9:16
9:16 memiliki bentuk yang sama jika diputar ke samping: layar penuh ponsel dipegang tegak. Dokumentasi Midjourney menggambarkannya sebagai hal yang umum untuk konten seluler di media sosial, dan YouTube mencatat bahwa video vertikal 9:16 dapat ditampilkan dengan padding di layar komputer. Cocok untuk sosok berdiri, arsitektur tinggi, air terjun, dan apa pun yang memiliki garis vertikal kuat. Tulislah dengan sengaja; pemandangan horizontal yang dimasukkan ke dalam 9:16 biasanya kehilangan subjeknya karena langit dan lantai yang kosong.
Bagaimana komposisi berubah seiring dengan bingkai
Bingkai yang lebih lebar memberi lebih banyak ruang untuk pengaturan dan aturan sepertiga, dengan subjek berada di luar pusat dan ruang bagi mata untuk bergerak. Bingkai yang lebih tinggi menekankan ketinggian dan mengundang pelapisan dari latar depan ke latar belakang. Sebutkan penempatan dalam prompt: "mobil di sepertiga kanan bingkai, jalan kosong menuju dari kiri" dibaca sangat berbeda dalam 16:9 dan 1:1. Saat Anda mengubah rasio, baca kembali kalimat komposisi dan sesuaikan.
Mengatur rasio di Midjourney
Dokumentasi Midjourney mencantumkan parameter --ar, atau bentuk panjangnya --aspect, ditambahkan di akhir perintah dengan spasi sebelum tanda hubung, misalnya "pelabuhan yang tenang saat fajar --ar 16:9". Angkanya harus utuh: dokumentasi menyatakan desimal tidak diterima dan menyarankan 139:100, bukan 1,39:1, dan ukuran piksel seperti 1920:1080 disederhanakan menjadi 16:9. Ia juga mencatat bahwa beberapa rasio sedikit berubah ketika ditingkatkan dan rasio yang sangat lebar atau tinggi bersifat eksperimental.
Mengatur ukuran dengan model gambar OpenAI
Dokumentasi pembuatan gambar OpenAI menjelaskan ukuran dalam piksel, bukan rasio. Pada saat penulisan, ini mencantumkan 1024x1024 sebagai persegi, 1536x1024 sebagai lanskap, dan 1024x1536 sebagai potret di antara ukuran yang disarankan, dengan opsi otomatis. Untuk model yang lebih baru, ini juga menjelaskan ukuran khusus yang ditulis sebagai lebar kali tinggi, dengan kedua tepinya harus kelipatan 16 dan rasio antara tepi panjang dan pendek harus tetap dalam 3:1. Perhatikan bahwa 1536x1024 sendiri merupakan bentuk 3:2.
Stable Diffusion dan alat lainnya
Di pustaka Hugging Face diffusers, alur teks-ke-gambar Stable Diffusion menerima argumen tinggi dan lebar dalam piksel. Prinsipnya sama di mana pun: tentukan bentuknya terlebih dahulu, lalu atur apa pun yang diminta alat, piksel atau rasio. Jika alat hanya menawarkan beberapa ukuran, pilih yang terdekat dan pangkas setelahnya, sisakan margin pada komposisi agar pangkasan tidak memotong subjek.
Rencanakan lebih dari satu format
Jika sebuah gambar akan digunakan di beberapa tempat, misalnya spanduk web lebar dan cerita vertikal, menghasilkan satu gambar dan memotong kedua cara tersebut jarang berhasil. Buatlah komposisi dengan ruang kosong yang luas di sekitar subjek utama sehingga kedua tanaman dapat bertahan, atau buat setiap format secara terpisah dari perintah yang sama dengan kalimat komposisi yang disesuaikan. Opsi kedua biasanya memberikan hasil yang lebih baik dan hanya membutuhkan waktu lebih lama.
Cara cepat untuk memilih
Tanyakan di mana gambar itu akan dilihat dan apa bentuk subjeknya. Sebuah objek tunggal atau pemandangan simetris terpusat cocok untuk persegi. Sebuah foto dimaksudkan agar terasa seperti sebuah foto yang sesuai dengan 3:2 atau 2:3. Lanskap lebar atau bingkai video sesuai dengan 16:9. Gambar ponsel layar penuh atau subjek tinggi sesuai dengan 9:16. Ketika tidak ada yang menunjuk dengan jelas ke satu arah, 3:2 adalah titik awal fotografi yang aman dan cocok untuk bentuk lainnya.
Dimana LarpGPT cocok
LarpGPT adalah perpustakaan petunjuk foto untuk pemandangan perjalanan, arsitektur, mobil, dan gaya hidup, dengan komposisi tertulis di setiap petunjuk bersama subjek, pencahayaan, dan lensa. Anda menyalin prompt, menyesuaikan framingnya dengan rasio yang Anda perlukan, dan mengatur rasio tersebut di generator gambar yang sudah Anda gunakan. LarpGPT tidak menghasilkan gambar, dan hasilnya bervariasi antar upaya.
Pertanyaan
Berapa rasio aspek terbaik untuk gambar AI?
Itu tergantung di mana gambar akan dilihat dan bentuk subjeknya. 3:2 adalah default fotografi alami, 16:9 sesuai dengan pemandangan dan video lebar, 9:16 sesuai dengan gambar ponsel layar penuh, dan 1:1 sesuai dengan subjek tunggal di tengah.
Bagaimana cara mengubah rasio aspek di Midjourney?
Tambahkan --ar diikuti dengan dua bilangan bulat di akhir perintah, misalnya --ar 3:2, menurut dokumentasi Midjourney. Desimal tidak diterima, dan standarnya adalah persegi.
Berapa ukuran yang didukung model gambar OpenAI?
Pada saat penulisan, dokumentasi OpenAI mencantumkan 1024x1024, 1536x1024, dan 1024x1536 di antara ukuran yang disarankan, ditambah opsi otomatis, dan menjelaskan ukuran khusus untuk model yang lebih baru dalam batas yang ditentukan.
Bisakah saya memotong gambar AI ke rasio lain nanti?
Bisa saja, namun komposisi yang dibuat untuk satu bentuk sering kali kehilangan subjeknya di bentuk lain. Berikan ruang di sekitar subjek utama, atau buat setiap format secara terpisah dengan komposisi kalimat yang disesuaikan.
