LarpGPT · Guide
Proporzioni per immagini AI: come sceglierle e impostarle
Quadrato, 3:2, 16:9 o verticale 9:16: come scegliere le proporzioni per un'immagine AI, come cambia la composizione con essa e come la impostano Midjourney e OpenAI.

In questa guida14
Perché il rapporto viene prima
Le proporzioni sono il rapporto tra la larghezza e l'altezza di un'immagine, espressa come due numeri come 3:2 o 16:9. È la prima decisione che prende un fotografo, perché decide cosa può contenere la cornice. Nella generazione dell'immagine conta ancora di più: il modello compone l'intera scena per l'inquadratura che gli dai, quindi cambiare il rapporto in seguito significa ritagliare o rigenerare. Sceglilo prima di perfezionare il resto del prompt.
Il rapporto non è la risoluzione
Un rapporto non dice nulla sul numero di pixel. La documentazione di Midjourney sottolinea direttamente questo punto: le proporzioni non sono le stesse delle dimensioni dell'immagine e la dimensione finale dipende dalla versione e dall'upscaler. Un'immagine 3:2 può essere piccola o grande. Decidi la forma da cui verrà vista l'immagine e come dovrebbe trovarsi il soggetto al suo interno, quindi gestisci la risoluzione come una questione separata.
Quadrato, 1:1
La piazza è equilibrata e statica, senza direzione dominante. Si adatta a singoli oggetti, composizioni simmetriche e soggetti centrati, ed è la cornice che molte piattaforme social utilizzano da tempo per post e immagini del profilo. È anche l'impostazione predefinita in Midjourney, la cui documentazione rileva che le immagini iniziano come quadrati. Un quadrato non è adatto ai paesaggi e alle scene di gruppo, in cui il soggetto si estende naturalmente lateralmente.
Foto classica, 3:2 e 2:3
3:2 è il rapporto tradizionale della fotografia, ereditato dalla pellicola da 35 mm, e molte fotocamere lo utilizzano ancora. Sembra naturale per uno stimolo fotografico perché è la forma che le persone associano alle fotografie. Il rapporto orizzontale 3:2 si adatta a strade, interni e paesaggi; il rapporto verticale 2:3 è adatto a ritratti, porte ed edifici alti e la documentazione di Midjourney lo menziona come comune nelle fotografie stampate e nelle cornici.
4:3 e 5:4
4:3 era il rapporto televisivo originale ed è ancora utilizzato da molti tablet e dalla maggior parte delle fotocamere digitali compatte. È leggermente più quadrato di 3:2, il che lascia più spazio sopra e sotto il soggetto. 5:4 è ancora una volta più quadrato ed è comune nella fotografia di grande e medio formato e per le stampe da 8 x 10 pollici. Entrambi si adattano agli interni e ai ritratti in cui si desidera un po' di respiro senza la forte spinta orizzontale di un grande formato.
Schermo panoramico, 16:9
16:9 è il rapporto standard per la televisione e i video online; Il centro assistenza di YouTube lo descrive come le proporzioni standard su un computer. La sua ampia cornice si adatta a paesaggi, paesaggi urbani, automobili in movimento e scene cinematografiche con il soggetto messo da parte. È una scelta efficace per banner, diapositive di presentazione e miniature di video. È più debole per le singole figure in piedi, che finiscono piccole in una cornice ampia.
Verticale, 9:16
9:16 è la stessa forma capovolta: lo schermo intero di un telefono tenuto in posizione verticale. La documentazione di Midjourney lo descrive come comune per i contenuti mobili sui social media e YouTube rileva che i video verticali 9:16 possono essere visualizzati con riempimento sugli schermi dei computer. Si adatta a figure in piedi, architetture alte, cascate e qualsiasi cosa con una forte linea verticale. Componi deliberatamente per questo; una scena orizzontale compressa in 9:16 di solito perde il soggetto a favore del cielo e del pavimento vuoti.
Come cambia la composizione con l'inquadratura
Una cornice più ampia offre più spazio per l'ambientazione e per la regola dei terzi, con il soggetto decentrato e spazio per far viaggiare l'occhio. Una cornice più alta enfatizza l'altezza e invita a stratificare dal primo piano allo sfondo. Menziona il posizionamento nel prompt: "l'auto nel terzo destro dell'inquadratura, la strada vuota che entra da sinistra" si legge in modo molto diverso in 16:9 e in 1:1. Quando cambi il rapporto, rileggi le frasi della composizione e regolale.
Impostazione del rapporto in Midjourney
La documentazione di Midjourney elenca il parametro --ar, o la sua forma lunga --aspect, aggiunto alla fine del prompt con uno spazio prima dei trattini, ad esempio "porto tranquillo all'alba --ar 16:9". I numeri devono essere interi: la documentazione dice che i decimali non sono accettati e suggerisce 139:100 invece di 1,39:1, e una dimensione in pixel come 1920:1080 è semplificata a 16:9. Si nota inoltre che alcuni rapporti cambiano leggermente durante l'upscaling e che i rapporti estremamente ampi o alti sono sperimentali.
Impostazione delle dimensioni con i modelli di immagine di OpenAI
La documentazione sulla generazione delle immagini di OpenAI descrive la dimensione in pixel anziché come rapporto. Al momento in cui scrivo vengono elencate 1024x1024 come quadrato, 1536x1024 come orizzontale e 1024x1536 come verticale tra le dimensioni consigliate, con un'opzione automatica. Per i modelli più recenti descrive anche le dimensioni personalizzate scritte come larghezza per altezza, dove entrambi i bordi devono essere multipli di 16 e il rapporto tra i bordi lunghi e corti deve rimanere entro 3:1. Tieni presente che 1536x1024 è di per sé una forma 3:2.
Stable Diffusion e altri strumenti
Nella libreria Hugging Face diffusers, la pipeline da testo a immagine Stable Diffusion accetta argomenti di altezza e larghezza in pixel. Il principio è lo stesso ovunque: decidi prima la forma, poi imposta ciò che lo strumento richiede, pixel o rapporto. Quando uno strumento offre solo poche dimensioni, scegli quella più vicina e ritaglia successivamente, lasciando un margine nella composizione in modo che il ritaglio non tagli il soggetto.
Pianifica più di un formato
Se un'immagine verrà utilizzata in più punti, ad esempio un ampio banner web e una storia verticale, generare un'immagine e ritagliarla in entrambi i modi raramente funziona. O componi con ampio spazio vuoto attorno a un soggetto centrale in modo che entrambi i ritagli sopravvivano, oppure genera ciascun formato separatamente dallo stesso prompt con le frasi di composizione adattate. La seconda opzione solitamente dà risultati migliori e costa solo un po’ più di tempo.
Un modo veloce per scegliere
Chiedi dove verrà vista l'immagine e che forma ha il soggetto. Un singolo oggetto o una scena simmetrica centrata si adatta a un quadrato. Una fotografia pensata per sembrare una fotografia adatta a 3:2 o 2:3. Un ampio paesaggio o un fotogramma video sono adatti al formato 16:9. Un'immagine del telefono a schermo intero o un soggetto alto si adatta alle 9:16. Quando nulla indica chiaramente una direzione, 3:2 è un punto di partenza fotografico sicuro che ritaglia bene su altre forme.
Dove si adatta LarpGPT
LarpGPT è una libreria di suggerimenti fotografici per scene di viaggi, architettura, automobili e stile di vita, con la composizione scritta in ciascun messaggio insieme al soggetto, all'illuminazione e all'obiettivo. Copi un prompt, adatti la sua inquadratura al rapporto che ti serve e imposti tale rapporto nel generatore di immagini che già usi. LarpGPT non genera immagini e i risultati variano tra i tentativi.
Domande
Qual è il rapporto d'aspetto migliore per le immagini AI?
Dipende da dove verrà vista l'immagine e dalla forma del soggetto. 3:2 è un'impostazione fotografica naturale, 16:9 si adatta a scene e video ampi, 9:16 si adatta alle immagini del telefono a schermo intero e 1:1 si adatta a soggetti singoli centrati.
Come posso modificare le proporzioni in Midjourney?
Aggiungi --ar seguito da due numeri interi alla fine del prompt, ad esempio --ar 3:2, secondo la documentazione di Midjourney. I decimali non sono accettati e il valore predefinito è un quadrato.
Quali dimensioni supportano i modelli di immagine di OpenAI?
Al momento in cui scrivo, la documentazione di OpenAI elenca 1024x1024, 1536x1024 e 1024x1536 tra le dimensioni consigliate, oltre a un'opzione automatica, e descrive le dimensioni personalizzate per i modelli più recenti entro limiti stabiliti.
Posso ritagliare un'immagine AI in un altro rapporto in un secondo momento?
Puoi, ma una composizione creata per una forma spesso perde il soggetto in un'altra. Lascia spazio attorno a un argomento centrale o genera ciascun formato separatamente con le frasi della composizione adattate.
