LarpGPT · Ratgeber
Seitenverhältnisse für KI-Bilder: wie man sie auswählt und einstellt
Quadratisch, 3:2, 16:9 oder vertikal 9:16: So wählen Sie ein Seitenverhältnis für ein KI-Bild aus, wie sich die Komposition damit ändert und wie Midjourney und OpenAI es festlegen.

In diesem Leitfaden14
Warum das Verhältnis an erster Stelle steht
Das Seitenverhältnis ist das Verhältnis zwischen der Breite und Höhe eines Bildes und wird als zwei Zahlen wie 3:2 oder 16:9 geschrieben. Es ist die erste Entscheidung, die ein Fotograf trifft, denn sie entscheidet darüber, was der Rahmen aufnehmen kann. Bei der Bildgenerierung kommt es sogar noch mehr darauf an: Das Modell komponiert die gesamte Szene für den Rahmen, den Sie ihm geben. Eine nachträgliche Änderung des Verhältnisses bedeutet also Zuschneiden oder Regenerieren. Wählen Sie es aus, bevor Sie den Rest der Eingabeaufforderung verfeinern.
Verhältnis ist keine Auflösung
Ein Verhältnis sagt nichts über die Anzahl der Pixel aus. Die Dokumentation von Midjourney bringt dies direkt zum Ausdruck: Das Seitenverhältnis ist nicht dasselbe wie die Bildabmessungen, und die endgültige Größe hängt von der Version und dem Upscaler ab. Ein 3:2-Bild kann klein oder groß sein. Legen Sie die Form fest, von der aus das Bild gesehen werden soll und wie das Motiv darin sitzen soll, und behandeln Sie dann die Auflösung als separate Frage.
Quadratisch, 1:1
Der Platz ist ausgewogen und statisch, ohne vorherrschende Richtung. Es eignet sich für einzelne Objekte, symmetrische Kompositionen und zentrierte Themen und ist der Rahmen, den viele soziale Plattformen seit langem für Beiträge und Profilbilder verwenden. Dies ist auch die Standardeinstellung in Midjourney, in dessen Dokumentation darauf hingewiesen wird, dass Bilder als Quadrate beginnen. Ein Quadrat eignet sich schlecht für Landschaften und Gruppenszenen, bei denen sich das Motiv natürlich seitlich ausbreitet.
Klassisches Foto, 3:2 und 2:3
3:2 ist das traditionelle Verhältnis der Fotofotografie, das vom 35-mm-Film übernommen wurde und von vielen Kameras immer noch verwendet wird. Für eine fotografische Aufforderung fühlt es sich natürlich an, weil es die Form ist, die Menschen mit Fotos assoziieren. Horizontal 3:2 eignet sich für Straßen, Innenräume und Landschaften; Vertikal 2:3 eignet sich für Porträts, Türen und hohe Gebäude, und in der Dokumentation von Midjourney wird erwähnt, dass es in gedruckten Fotografien und Bilderrahmen üblich ist.
4:3 und 5:4
4:3 war das ursprüngliche Fernsehverhältnis und wird immer noch von vielen Tablets und den meisten kompakten Digitalkameras verwendet. Es ist etwas quadratischer als 3:2, wodurch mehr Platz über und unter dem Motiv bleibt. 5:4 ist wiederum quadratischer und in der Groß- und Mittelformatfotografie sowie für 8 x 10 Zoll große Drucke üblich. Beide eignen sich für Innenräume und Porträts, bei denen Sie ein wenig Luft zum Atmen wünschen, ohne den starken horizontalen Zug eines Breitformats.
Breitbild, 16:9
16:9 ist das Standardverhältnis für Fernsehen und Online-Videos; In der Hilfe von YouTube wird es als das Standard-Seitenverhältnis auf einem Computer beschrieben. Sein breiter Rahmen eignet sich für Landschaften, Stadtansichten, fahrende Autos und Filmszenen mit einem seitlich platzierten Motiv. Es ist eine gute Wahl für Banner, Präsentationsfolien und Video-Thumbnails. Es ist schwächer für einzelne stehende Figuren, die in einem breiten Rahmen klein werden.
Vertikal, 9:16
9:16 ist die gleiche Form, die auf die Seite gedreht ist: der gesamte Bildschirm eines aufrecht gehaltenen Telefons. In der Dokumentation von Midjourney wird beschrieben, dass dies bei mobilen Inhalten in sozialen Medien üblich ist, und YouTube weist darauf hin, dass vertikale 9:16-Videos mit Abstand auf Computerbildschirmen angezeigt werden können. Es eignet sich für stehende Figuren, hohe Architektur, Wasserfälle und alles mit einer starken vertikalen Linie. Komponiere bewusst dafür; Eine horizontale Szene, die auf 9:16 gequetscht wird, verliert normalerweise ihr Motiv durch leeren Himmel und Boden.
Wie sich die Komposition mit dem Rahmen ändert
Ein breiterer Rahmen bietet mehr Raum für die Einstellung und die Drittelregel, wobei das Motiv außermittig platziert ist und dem Auge Raum für die Bewegung gibt. Ein höherer Rahmen betont die Höhe und lädt zum Übereinanderschichten vom Vordergrund zum Hintergrund ein. Erwähnen Sie die Platzierung in der Aufforderung: „Das Auto im rechten Drittel des Bildes, die leere Straße führt von links hinein“ liest sich in 16:9 und in 1:1 sehr unterschiedlich. Wenn Sie das Verhältnis ändern, lesen Sie die Kompositionssätze noch einmal und passen Sie sie an.
Einstellen des Verhältnisses in Midjourney
In der Dokumentation von Midjourney wird der Parameter --ar oder seine Langform --aspect aufgeführt, der am Ende der Eingabeaufforderung mit einem Leerzeichen vor den Bindestrichen hinzugefügt wird, zum Beispiel „ruhiger Hafen im Morgengrauen --ar 16:9“. Die Zahlen müssen ganzzahlig sein: Die Dokumentation besagt, dass Dezimalzahlen nicht akzeptiert werden und schlägt 139:100 statt 1,39:1 vor, und eine Pixelgröße wie 1920:1080 wird auf 16:9 vereinfacht. Es wird außerdem darauf hingewiesen, dass sich einige Verhältnisse beim Hochskalieren leicht ändern und dass extrem breite oder hohe Verhältnisse experimentell sind.
Festlegen der Größe mit den Bildmodellen von OpenAI
In der Dokumentation zur Bildgenerierung von OpenAI wird die Größe in Pixeln und nicht als Verhältnis beschrieben. Zum Zeitpunkt des Verfassens dieses Artikels sind unter den empfohlenen Größen 1024 x 1024 als Quadrat, 1536 x 1024 als Querformat und 1024 x 1536 als Hochformat aufgeführt, mit einer automatischen Option. Für die neueren Modelle werden auch benutzerdefinierte Größen als Breite mal Höhe beschrieben, wobei beide Kanten ein Vielfaches von 16 sein müssen und das Verhältnis zwischen den langen und kurzen Kanten innerhalb von 3:1 bleiben muss. Beachten Sie, dass 1536 x 1024 selbst eine 3:2-Form ist.
Stable Diffusion und andere Tools
In der Bibliothek Hugging Face diffusers akzeptiert die Text-zu-Bild-Pipeline Stable Diffusion Höhen- und Breitenargumente in Pixeln. Das Prinzip ist überall das gleiche: Legen Sie zuerst die Form fest und stellen Sie dann ein, was das Werkzeug verlangt, Pixel oder Verhältnis. Wenn ein Werkzeug nur wenige Größen anbietet, wählen Sie die nächstgelegene Größe aus und schneiden Sie sie anschließend zu. Lassen Sie dabei einen Rand in der Komposition, damit der Zuschnitt nicht in das Motiv schneidet.
Planen Sie mehr als ein Format ein
Wenn ein Bild an mehreren Stellen verwendet wird, beispielsweise in einem Wide-Web-Banner und in einer vertikalen Story, funktioniert es selten, ein Bild zu erstellen und es in beide Richtungen zuzuschneiden. Entweder komponieren Sie mit großzügigem Leerraum um ein zentrales Thema, damit beide Ausschnitte erhalten bleiben, oder erstellen Sie jedes Format separat aus derselben Eingabeaufforderung mit angepassten Kompositionssätzen. Die zweite Option liefert in der Regel bessere Ergebnisse und kostet nur wenig mehr Zeit.
Eine schnelle Möglichkeit zur Auswahl
Fragen Sie, wo das Bild zu sehen ist und welche Form das Motiv hat. Ein einzelnes Objekt oder eine zentrierte symmetrische Szene passt zu einem Quadrat. Ein Foto, das sich wie ein Foto anfühlen soll, passt zu 3:2 oder 2:3. Ein breites Querformat oder ein Videobild eignen sich für 16:9. Ein Vollbild-Telefonbild oder ein großes Motiv passen zu 9:16. Wenn nichts klar in eine Richtung zeigt, ist 3:2 ein sicherer fotografischer Ausgangspunkt, der sich gut auf andere Formen zuschneiden lässt.
Wo LarpGPT passt
LarpGPT ist eine Bibliothek mit Fotoaufforderungen für Reise-, Architektur-, Auto- und Lifestyle-Szenen, wobei in jeder Aufforderung neben Motiv, Beleuchtung und Objektiv auch die Komposition eingetragen ist. Sie kopieren eine Eingabeaufforderung, passen den Rahmen an das von Ihnen benötigte Verhältnis an und legen dieses Verhältnis in dem Bildgenerator fest, den Sie bereits verwenden. LarpGPT generiert keine Bilder und die Ergebnisse variieren je nach Versuch.
Fragen
Was ist das beste Seitenverhältnis für KI-Bilder?
Es hängt davon ab, wo das Bild gesehen wird und von der Form des Motivs. 3:2 ist ein natürlicher fotografischer Standardwert, 16:9 eignet sich für breite Szenen und Videos, 9:16 eignet sich für Vollbild-Telefonbilder und 1:1 eignet sich für einzelne zentrierte Motive.
Wie ändere ich das Seitenverhältnis in Midjourney?
Fügen Sie --ar gefolgt von zwei ganzen Zahlen am Ende der Eingabeaufforderung hinzu, zum Beispiel --ar 3:2, gemäß der Dokumentation von Midjourney. Dezimalzahlen werden nicht akzeptiert und der Standardwert ist ein Quadrat.
Welche Größen unterstützen die Bildmodelle von OpenAI?
Zum Zeitpunkt des Schreibens listet die Dokumentation von OpenAI 1024 x 1024, 1536 x 1024 und 1024 x 1536 als empfohlene Größen sowie eine automatische Option auf und beschreibt benutzerdefinierte Größen für neuere Modelle innerhalb festgelegter Grenzen.
Kann ich ein AI-Bild später auf ein anderes Verhältnis zuschneiden?
Das ist möglich, aber eine Komposition, die für eine Form erstellt wurde, verliert in einer anderen Form oft ihr Motiv. Lassen Sie Platz um ein zentrales Thema oder erstellen Sie jedes Format separat mit angepassten Kompositionssätzen.
