LarpGPT · Gidsen
Beeldverhoudingen voor AI-afbeeldingen: hoe u ze kiest en instelt
Vierkant, 3:2, 16:9 of verticaal 9:16: hoe je een beeldverhouding kiest voor een AI-afbeelding, hoe de compositie daarmee verandert en hoe Midjourney en OpenAI deze instellen.

In deze gids14
Waarom de ratio voorop staat
De beeldverhouding is de verhouding tussen de breedte en hoogte van een afbeelding, geschreven als twee getallen, zoals 3:2 of 16:9. Het is de eerste beslissing die een fotograaf neemt, omdat hij bepaalt wat het frame kan bevatten. Bij het genereren van afbeeldingen maakt het zelfs nog meer uit: het model componeert de hele scène voor het frame dat u eraan geeft, dus het achteraf wijzigen van de verhouding betekent bijsnijden of regenereren. Kies deze optie voordat u de rest van de prompt verfijnt.
Ratio is geen resolutie
Een verhouding zegt niets over het aantal pixels. De documentatie van Midjourney maakt dit punt direct duidelijk: de beeldverhouding is niet hetzelfde als de afmetingen van de afbeelding, en de uiteindelijke grootte hangt af van de versie en de upscaler. Een 3:2-afbeelding kan klein of groot zijn. Bepaal de vorm van waaruit het beeld zal worden gezien en hoe het onderwerp erin moet zitten, en behandel vervolgens de resolutie als een aparte vraag.
Vierkant, 1:1
Het plein is evenwichtig en statisch, zonder dominante richting. Het past bij afzonderlijke objecten, symmetrische composities en gecentreerde onderwerpen, en het is het kader dat veel sociale platforms al lang gebruiken voor berichten en profielafbeeldingen. Het is ook de standaard in Midjourney, waarvan de documentatie aangeeft dat afbeeldingen beginnen als vierkanten. Een vierkant past slecht bij landschappen en groepsscènes, waar het onderwerp zich van nature zijwaarts verspreidt.
Klassieke foto, 3:2 en 2:3
3:2 is de traditionele verhouding van fotografie, geërfd van 35 mm-film, en veel camera's gebruiken deze verhouding nog steeds. Het voelt natuurlijk aan voor een fotografische prompt, omdat het de vorm is die mensen associëren met foto's. Horizontaal 3:2 past bij straten, interieurs en landschappen; verticale 2:3 past bij portretten, deuropeningen en hoge gebouwen, en in de documentatie van Midjourney wordt vermeld dat dit gebruikelijk is in gedrukte fotografie en fotolijsten.
4:3 en 5:4
4:3 was de oorspronkelijke televisieverhouding en wordt nog steeds gebruikt door veel tablets en door de meeste compacte digitale camera's. Het is iets vierkanter dan 3:2, waardoor er meer ruimte boven en onder het onderwerp overblijft. 5:4 is weer vierkanter en is gebruikelijk in fotografie op groot en middenformaat en voor afdrukken van 8 bij 10 inch. Beide passen bij interieurs en portretten waarbij je wat ademruimte nodig hebt zonder de sterke horizontale aantrekkingskracht van een grootformaat.
Breedbeeld, 16:9
16:9 is de standaardverhouding voor televisie en online video; Het helpcentrum van YouTube beschrijft dit als de standaardbeeldverhouding op een computer. Het brede kader past bij landschappen, stadsgezichten, bewegende auto's en filmscènes met een onderwerp aan de zijkant. Het is een goede keuze voor banners, presentatiedia's en videominiaturen. Het is zwakker voor enkele staande figuren, die klein worden in een breed frame.
Verticaal, 9:16
9:16 is dezelfde vorm die op zijn kant is gedraaid: het volledige scherm van een telefoon die rechtop wordt gehouden. In de documentatie van Midjourney wordt beschreven dat dit gebruikelijk is voor mobiele inhoud op sociale media, en YouTube merkt op dat verticale 9:16-video's met opvulling op computerschermen kunnen worden weergegeven. Het past bij staande figuren, hoge architectuur, watervallen en alles met een sterke verticale lijn. Componeer er doelbewust voor; een horizontale scène die in 9:16 is geperst, verliest meestal zijn onderwerp door lege lucht en vloer.
Hoe de compositie verandert met het kader
Een breder kader geeft meer ruimte voor de setting en voor de regel van derden, waarbij het onderwerp niet in het midden staat en er ruimte is voor het oog om te reizen. Een hoger frame benadrukt de hoogte en nodigt uit tot gelaagdheid van voorgrond tot achtergrond. Vermeld de plaatsing in de prompt: "de auto in het rechter derde deel van het frame, de lege weg die van links naar binnen leidt" leest heel anders in 16:9 en in 1:1. Als je de verhouding verandert, lees dan de compositiezinnen opnieuw en pas ze aan.
De verhouding instellen in Midjourney
De documentatie van Midjourney vermeldt de parameter --ar, of de lange vorm --aspect, toegevoegd aan het einde van de prompt met een spatie vóór de streepjes, bijvoorbeeld "stille haven bij zonsopgang --ar 16:9". De getallen moeten geheel zijn: de documentatie zegt dat decimalen niet worden geaccepteerd en suggereert 139:100 in plaats van 1,39:1, en een pixelgrootte zoals 1920:1080 wordt vereenvoudigd tot 16:9. Het merkt ook op dat sommige verhoudingen enigszins veranderen bij het opschalen en dat extreem brede of hoge verhoudingen experimenteel zijn.
Het formaat instellen met de afbeeldingsmodellen van OpenAI
De documentatie voor het genereren van afbeeldingen bij de OpenAI beschrijft de grootte in pixels in plaats van als een verhouding. Op het moment van schrijven worden 1024x1024 als vierkant, 1536x1024 als liggend en 1024x1536 als staand vermeld als de aanbevolen formaten, met een automatische optie. Voor de nieuwere modellen beschrijft het ook aangepaste formaten, geschreven als breedte bij hoogte, waarbij beide randen een veelvoud van 16 moeten zijn en de verhouding tussen de lange en korte randen binnen 3:1 moet blijven. Merk op dat 1536x1024 zelf een 3:2-vorm is.
Stable Diffusion en andere hulpmiddelen
In de Hugging Face diffusers-bibliotheek accepteert de Stable Diffusion tekst-naar-afbeelding-pijplijn hoogte- en breedte-argumenten in pixels. Het principe is overal hetzelfde: bepaal eerst de vorm en stel vervolgens in wat de tool vraagt, pixels of verhouding. Wanneer een tool slechts een paar formaten biedt, kies dan het dichtstbijzijnde formaat en snij daarna bij, waarbij u een marge in de compositie laat zodat de uitsnede niet in het onderwerp snijdt.
Plan voor meer dan één formaat
Als een afbeelding op meerdere plaatsen wordt gebruikt, bijvoorbeeld een brede webbanner en een verticaal verhaal, lukt het zelden om één afbeelding te genereren en deze in beide richtingen bij te snijden. Componeer ofwel met royale lege ruimte rond een centraal onderwerp, zodat beide gewassen overleven, of genereer elk formaat afzonderlijk vanaf dezelfde prompt met aangepaste compositiezinnen. De tweede optie geeft meestal betere resultaten en kost slechts iets meer tijd.
Een snelle manier om te kiezen
Vraag waar de afbeelding te zien is en welke vorm het onderwerp heeft. Een enkel object of een gecentreerde symmetrische scène past bij een vierkant. Een foto die bedoeld is om aan te voelen als een foto past bij 3:2 of 2:3. Een weids landschap of een videoframe past bij 16:9. Een telefoonbeeld op volledig scherm of een lang onderwerp past bij 9:16. Als niets duidelijk één kant op wijst, is 3:2 een veilig fotografisch uitgangspunt dat goed aansluit bij andere vormen.
Waar LarpGPT past
LarpGPT is een bibliotheek met fotoprompts voor reizen, architectuur, auto's en lifestylescènes, waarbij in elke prompt de compositie wordt geschreven, naast het onderwerp, de belichting en de lens. Je kopieert een prompt, past de framing ervan aan de gewenste verhouding aan en stelt die verhouding in in de beeldgenerator die je al gebruikt. LarpGPT genereert geen afbeeldingen en de resultaten variëren tussen pogingen.
Vragen
Wat is de beste beeldverhouding voor AI-afbeeldingen?
Het hangt af van waar het beeld te zien zal zijn en de vorm van het onderwerp. 3:2 is een natuurlijke fotografische standaard, 16:9 past bij brede scènes en video, 9:16 past bij telefoonbeelden op volledig scherm en 1:1 past bij enkelvoudige gecentreerde onderwerpen.
Hoe wijzig ik de beeldverhouding in Midjourney?
Voeg --ar toe, gevolgd door twee hele cijfers aan het einde van de prompt, bijvoorbeeld --ar 3:2, volgens de documentatie van Midjourney. Decimalen worden niet geaccepteerd en de standaardwaarde is een vierkant.
Welke formaten ondersteunen de beeldmodellen van OpenAI?
Op het moment van schrijven vermeldt de documentatie van OpenAI 1024x1024, 1536x1024 en 1024x1536 als een van de aanbevolen formaten, plus een automatische optie, en worden aangepaste formaten voor nieuwere modellen binnen vastgestelde limieten beschreven.
Kan ik een AI-afbeelding later bijsnijden naar een andere verhouding?
Dat kan, maar een compositie die voor de ene vorm is gemaakt, verliest vaak zijn onderwerp in een andere vorm. Laat ruimte rond een centraal onderwerp, of genereer elk format afzonderlijk met aangepaste compositiezinnen.
