LarpGPT · 指南
AI影像的長寬比:如何選擇與設置
方形、3:2、16:9 或垂直 9:16:如何為 AI 影像選擇長寬比、構圖如何隨之變化以及 Midjourney 和 OpenAI 如何設定它。

本指南內容14
為什麼比率是第一位的
縱橫比是影像寬度和高度之間的關係,寫為兩個數字,例如 3:2 或 16:9。這是攝影師做出的第一個決定,因為它決定了框架可以容納什麼。在影像生成中,這一點更為重要:模型為您提供的幀組成了整個場景,因此之後更改比例意味著裁剪或重新生成。在完善提示的其餘部分之前選擇它。
比率不是分辨率
比率與像素數量無關。 Midjourney的文件直接說明了這一點:寬高比與影像尺寸不同,最終尺寸取決於版本和升級器。 3:2 影像可以很小也可以很大。確定從哪裡可以看到影像的形狀以及拍攝對像在影像中的位置,然後將解析度作為一個單獨的問題來處理。
正方形,1:1
方形是平衡的、靜態的,沒有主導方向。它適合單一物件、對稱構圖和居中主題,也是許多社交平台長期以來用於發布貼文和個人資料圖片的框架。這也是 Midjourney 中的預設設置,其文件指出圖像以正方形開頭。正方形不適合風景和集體場景,因為在這些場景中,主體會自然地向側面擴散。
經典照片,3:2 和 2:3
3:2是靜態攝影的傳統比例,繼承自35毫米膠片,許多相機仍在使用它。對於攝影提示來說感覺很自然,因為它是人們與照片聯繫在一起的形狀。水平3:2適合街道、室內和風景;垂直 2:3 適合肖像、門口和高層建築,Midjourney 的文檔提到它在印刷攝影和相框中很常見。
4:3 和 5:4
4:3 是最初的電視比例,許多平板電腦和大多數輕便數位相機仍在使用。它比 3:2 略呈方形,從而在拍攝對象的上方和下方留有更多空間。 5:4 又更方形,常見於大中片幅攝影以及 8 x 10 英寸的打印。兩者都適合室內裝飾和肖像畫,您需要一點喘息空間,而又沒有寬幅畫幅的強大水平拉力。
寬屏,16:9
16:9是電視和網路視訊的標準比例;YouTube的幫助中心將其描述為電腦上的標準寬高比。其寬幅畫面適合風景、城市景觀、行駛中的汽車以及主題置於一側的電影場景。它是橫幅、簡報投影片和影片縮圖的絕佳選擇。它對於單一站立人物來說較弱,在寬框架中最終會顯得很小。
垂直,9:16
9:16 是側面翻轉的相同形狀:直立的手機全螢幕。 Midjourney 的文檔將其描述為社交媒體上移動內容的常見內容,YouTube 指出垂直 9:16 影片可以在電腦螢幕上以填充方式顯示。它適合站立的人物、高層建築、瀑布和任何具有強烈垂直線的物體。刻意為之創作;壓縮在 9 分 16 秒的水平場景通常會因為空蕩蕩的天空和地板而失去主體。
構圖如何隨框架變化
較寬的畫面為背景和三分法則提供了更多的空間,使主體偏離中心,並為眼睛移動提供了空間。較高的框架強調高度並邀請從前景到背景的層次感。提及提示中的位置:「汽車位於畫面右側三分之一處,空路從左側通往」在 16:9 和 1:1 中讀起來非常不同。當你改變比例時,重讀作文句子並調整它們。
在Midjourney中設定比率
Midjourney 的文檔列出了 --ar 參數或其長形式 --aspect,添加在提示符末尾並在破折號之前添加一個空格,例如“黎明時的安靜港口 --ar 16:9”。數字必須是整數:文件說不接受小數,並建議使用 139:100 而不是 1.39:1,並且像素大小(例如 1920:1080)會簡化為 16:9。它還指出,某些比率在放大時會略有變化,且極寬或極高的比率是實驗性的。
使用OpenAI的圖像模型設定尺寸
OpenAI 的圖像產生文件以像素為單位描述大小,而不是比率。在撰寫本文時,它在建議尺寸中列出了 1024x1024 方形、1536x1024 橫向和 1024x1536 縱向,並帶有自動選項。對於較新的型號,它還描述了自訂尺寸,寫作寬度乘高度,其中兩條邊必須是 16 的倍數,長邊和短邊之間的比率必須保持在 3:1 以內。請注意,1536x1024 本身就是 3:2 形狀。
Stable Diffusion等工具
在 Hugging Face diffusers 庫中,Stable Diffusion 文字到影像管道接受以像素為單位的高度和寬度參數。原理在任何地方都是相同的:首先決定形狀,然後設定工具要求的任何內容,像素或比率。當工具僅提供幾種尺寸時,請選擇最接近的尺寸,然後進行裁剪,在構圖中留出邊距,這樣裁剪就不會切入主題。
規劃不只一種格式
如果一張圖像將在多個地方使用,例如寬幅網頁橫幅和垂直故事,則產生一張圖像並以兩種方式裁剪它很少起作用。要么在中心主題周圍留出足夠的空白空間,以便兩種作物都能生存,要么根據相同的提示分別生成每種格式並調整作文句子。第二種選擇通常會產生更好的結果,並且只花費更多的時間。
快速選擇的方法
詢問在哪裡可以看到影像以及主體的形狀。單一物體或居中對稱的場景適合正方形。一張看起來像照片的照片適合 3:2 或 2:3。寬幅風景或視訊畫面適合 16:9。全螢幕手機影像或高大的拍攝對象適合 9:16。當沒有明確的方向時,3:2 是一個安全的攝影起點,可以很好地裁剪到其他形狀。
LarpGPT 適合的地方
LarpGPT 是一個旅行、建築、汽車和生活方式場景的照片提示庫,每個提示中都寫入了構圖以及主題、燈光和鏡頭。您複製提示,將其框架調整為您需要的比例,然後在您已使用的影像產生器中設定該比例。 LarpGPT 不會產生影像,每次嘗試的結果都會有所不同。
常見問題
AI 影像的最佳長寬比是多少?
這取決於影像的觀看位置和拍攝對象的形狀。 3:2 是自然的攝影預設值,16:9 適合寬場景和視頻,9:16 適合全螢幕手機影像,1:1 適合單中心主題。
如何更改 Midjourney 中的縱橫比?
根據 Midjourney 的文檔,在提示字元末尾新增 --ar,後面跟著兩個整數,例如 --ar 3:2。不接受小數,預設為平方。
OpenAI的鏡像型號支援哪些尺寸?
在撰寫本文時,OpenAI 的文檔列出了建議尺寸中的 1024x1024、1536x1024 和 1024x1536,以及自動選項,並描述了在設定限制內較新型號的自訂尺寸。
我可以稍後將 AI 影像裁切為其他比例嗎?
可以,但是針對一種形狀製作的構圖常常會在另一種形狀中失去主題。圍繞中心主題留出空間,或單獨產生每種格式並調整組合句子。
