LarpGPT · Rehberler
AI görüntüleri için en boy oranları: bunların nasıl seçileceği ve ayarlanacağı
Kare, 3:2, 16:9 veya dikey 9:16: Yapay zeka görüntüsü için en boy oranının nasıl seçileceği, kompozisyonun onunla birlikte nasıl değiştiği ve Midjourney ile OpenAI'nin bunu nasıl ayarlayacağı.

Bu rehberde14
Oran neden önce gelir?
En boy oranı, bir görüntünün genişliği ve yüksekliği arasındaki ilişkidir ve 3:2 veya 16:9 gibi iki sayıyla yazılır. Bu, fotoğrafçının vereceği ilk karardır çünkü çerçevenin ne tutabileceğine o karar verir. Görüntü oluşturmada bu daha da önemlidir: Model, verdiğiniz çerçeveye göre tüm sahneyi oluşturur; dolayısıyla oranı sonradan değiştirmek, kırpma veya yeniden oluşturma anlamına gelir. İstemin geri kalanını hassaslaştırmadan önce bunu seçin.
Oran çözünürlük değildir
Oran, piksel sayısı hakkında hiçbir şey söylemez. Midjourney'nin belgeleri bu noktayı doğrudan vurgulamaktadır: en boy oranı, görüntü boyutlarıyla aynı değildir ve son boyut, sürüme ve yükselticiye bağlıdır. 3:2 görüntü küçük veya büyük olabilir. Görüntünün görüneceği yerden şekline ve nesnenin bu şekle nasıl oturması gerektiğine karar verin, ardından çözünürlüğü ayrı bir soru olarak ele alın.
Kare, 1:1
Kare, baskın bir yön olmaksızın dengeli ve statiktir. Tek nesnelere, simetrik kompozisyonlara ve merkezi konulara uygundur ve birçok sosyal platformun uzun süredir gönderiler ve profil görselleri için kullandığı çerçevedir. Ayrıca, belgelerinde görüntülerin kareler olarak başladığını belirten Midjourney'de de varsayılan değerdir. Kare, konunun doğal olarak yanlara doğru yayıldığı manzaralar ve grup sahneleri için pek uygun değildir.
Klasik fotoğraf, 3:2 ve 2:3
3:2, 35 mm filmden miras kalan geleneksel fotoğraf oranıdır ve birçok kamera hâlâ bunu kullanmaktadır. İnsanların fotoğraflarla ilişkilendirdiği şekil olduğundan, fotoğrafik bir istem için bu doğal bir histir. Yatay 3:2 sokaklara, iç mekanlara ve manzaralara uygundur; dikey 2:3 portrelere, kapı aralıklarına ve yüksek binalara uygundur ve Midjourney'nin belgelerinde bunun basılı fotoğraf ve resim çerçevelerinde yaygın olduğu belirtilmektedir.
4:3 ve 5:4
4:3 orijinal televizyon oranıydı ve hâlâ birçok tablet ve çoğu kompakt dijital kamera tarafından kullanılıyor. 3:2'den biraz daha kare olduğundan konunun üstünde ve altında daha fazla yer bırakır. 5:4 yine daha karedir ve büyük ve orta format fotoğrafçılıkta ve 8 x 10 inç baskılarda yaygındır. Geniş formatın güçlü yatay çekimi olmadan biraz nefes alma alanı istediğiniz iç mekanlara ve portrelere her ikisi de uygundur.
Geniş ekran, 16:9
16:9, televizyon ve çevrimiçi video için standart orandır; YouTube'nin yardım merkezi bunu bilgisayardaki standart en boy oranı olarak tanımlıyor. Geniş çerçevesi manzaralara, şehir manzaralarına, hareket halindeki arabalara ve nesnenin bir tarafa yerleştirildiği sinema sahnelerine uygundur. Banner'lar, sunum slaytları ve video küçük resimleri için güçlü bir seçimdir. Geniş bir çerçevede küçük kalan tek başına duran figürlerde ise daha zayıftır.
Dikey, 9:16
9:16, yan çevrilmiş şeklin aynısıdır: dik tutulan bir telefonun tam ekranı. Midjourney'nin belgeleri, bunun sosyal medyadaki mobil içerik için yaygın olduğunu açıklıyor ve YouTube, dikey 9:16 videoların bilgisayar ekranlarında dolguyla gösterilebileceğini belirtiyor. Ayakta duran figürlere, yüksek mimariye, şelalelere ve güçlü dikey çizgiye sahip her şeye uygundur. Bunun için bilinçli olarak beste yapın; 9:16'ya sıkıştırılmış yatay bir sahne genellikle konusunu boş gökyüzüne ve zemine kaptırıyor.
Kompozisyon çerçeveyle nasıl değişir?
Daha geniş bir çerçeve, konu merkezden uzakta ve gözün hareket edebileceği alanla, ayar ve üçte bir kuralı için daha fazla alan sağlar. Daha uzun bir çerçeve yüksekliği vurgular ve ön plandan arka plana doğru katmanları davet eder. Bilgi istemindeki yerleşimden bahsedin: "Çerçevenin sağ üçte birlik kısmındaki araba, soldan içeri giren boş yol" 16:9 ve 1:1'de çok farklı okunuyor. Oranı değiştirdiğinizde kompozisyon cümlelerini tekrar okuyun ve ayarlayın.
Midjourney'de oranın ayarlanması
Midjourney'nin belgeleri --ar parametresini veya onun uzun biçimi --aspect'yi listeler; bu parametre istemin sonuna tirelerden önce bir boşluk eklenerek eklenir, örneğin "şafakta sessiz liman --ar 16:9". Sayılar tam olmalıdır: Belgelerde ondalık sayıların kabul edilmediği ve 1,39:1 yerine 139:100 önerildiği ve 1920:1080 gibi bir piksel boyutunun 16:9 olarak basitleştirildiği belirtiliyor. Ayrıca, ölçeklendirme sırasında bazı oranların biraz değiştiğini ve aşırı geniş veya yüksek oranların deneysel olduğunu da belirtiyor.
OpenAI'nin görüntü modelleriyle boyutu ayarlama
OpenAI'nin görüntü oluşturma belgeleri, boyutu oran yerine piksel cinsinden açıklar. Yazma sırasında, otomatik seçenekle birlikte önerilen boyutlar arasında kare olarak 1024x1024, yatay olarak 1536x1024 ve dikey olarak 1024x1536 listeleniyor. Daha yeni modelleri için, her iki kenarın da 16'nın katları olması ve uzun ve kısa kenarlar arasındaki oranın 3:1 dahilinde kalması gereken, genişlik ve yükseklik olarak yazılan özel boyutları da tanımlıyor. 1536x1024'ün kendisinin 3:2 şekli olduğunu unutmayın.
Stable Diffusion ve diğer araçlar
Hugging Face diffusers kitaplığında, Stable Diffusion metinden görüntüye ardışık düzen, piksel cinsinden yükseklik ve genişlik bağımsız değişkenlerini kabul eder. Prensip her yerde aynıdır: Önce şekle karar verin, ardından aracın istediği şeyi (piksel veya oran) ayarlayın. Bir araç yalnızca birkaç boyut sunduğunda, en yakın olanı seçin ve ardından kırpın, kompozisyonda kenar boşluğu bırakarak kesmenin konuyu kesmemesini sağlayın.
Birden fazla format planlama
Bir görsel birden fazla yerde kullanılacaksa, örneğin geniş bir web banner'ı ve dikey bir hikaye, tek bir görsel oluşturmak ve onu her iki şekilde kırpmak nadiren işe yarar. Her iki ürünün de hayatta kalması için merkezi bir konunun etrafında cömert bir boş alan oluşturun veya her bir formatı, kompozisyon cümleleri uyarlanarak aynı istemden ayrı olarak oluşturun. İkinci seçenek genellikle daha iyi sonuçlar verir ve yalnızca biraz daha fazla zamana mal olur.
Seçim yapmanın hızlı bir yolu
Görüntünün nerede görüleceğini ve konunun nasıl bir şekle sahip olduğunu sorun. Tek bir nesne veya ortalanmış simetrik bir sahne bir kareye yakışır. Fotoğraf gibi hissettiren bir fotoğraf 3:2 veya 2:3'e uygundur. Geniş bir manzara veya video çerçevesi 16:9'a uygundur. Tam ekran bir telefon görüntüsü veya uzun bir nesne 9:16'ya uygundur. Hiçbir şey açıkça bir yöne işaret etmediğinde, 3:2, diğer şekilleri iyi bir şekilde kesen güvenli bir fotoğraf başlangıç noktasıdır.
LarpGPT'nin sığdığı yer
LarpGPT, seyahat, mimari, arabalar ve yaşam tarzı sahneleri için fotoğraf istemlerinden oluşan bir kütüphanedir; konu, aydınlatma ve lensin yanı sıra her bir istemin içine kompozisyon yazılır. Bir istemi kopyalar, çerçevesini ihtiyacınız olan orana uyarlar ve bu oranı halihazırda kullanmakta olduğunuz görüntü oluşturucuda ayarlarsınız. LarpGPT görüntü oluşturmaz ve sonuçlar denemeler arasında değişiklik gösterir.
Sorular
AI görüntüleri için en iyi en boy oranı nedir?
Görüntünün nerede görüleceğine ve konunun şekline bağlıdır. 3:2 doğal bir fotoğraf varsayılanıdır, 16:9 geniş sahneler ve videolara uygundur, 9:16 tam ekran telefon görüntülerine uygundur ve 1:1 tek merkezli konulara uygundur.
Midjourney'de en boy oranını nasıl değiştiririm?
Midjourney'nin belgelerine göre istemin sonuna --ar ve ardından iki tam sayı ekleyin; örneğin --ar 3:2. Ondalık sayılar kabul edilmez ve varsayılan değer karedir.
OpenAI'nin görüntü modelleri hangi boyutları destekliyor?
Yazma sırasında, OpenAI'nin belgeleri, önerilen boyutlar arasında 1024x1024, 1536x1024 ve 1024x1536 artı bir otomatik seçeneği listeliyor ve belirlenen sınırlar dahilinde daha yeni modeller için özel boyutları açıklıyor.
Daha sonra bir AI görüntüsünü başka bir orana kırpabilir miyim?
Yapabilirsiniz, ancak bir şekil için yapılan kompozisyon çoğu zaman konusunu diğerinde kaybeder. Merkezi bir konunun etrafında boşluk bırakın veya uyarlanan kompozisyon cümleleriyle her formatı ayrı ayrı oluşturun.
