LarpGPT
简体中文
← 返回应用

LarpGPT · 指南

AI图像的长宽比:如何选择和设置

方形、3:2、16:9 或垂直 9:16:如何为 AI 图像选择长宽比、构图如何随之变化以及 Midjourney 和 OpenAI 如何设置它。

LarpGPT — 下一张图的起点
LarpGPT · 下一张图的起点
本指南内容14

为什么比率是第一位的

纵横比是图像宽度和高度之间的关系,写为两个数字,例如 3:2 或 16:9。这是摄影师做出的第一个决定,因为它决定了框架可以容纳什么。在图像生成中,这一点更为重要:模型为您提供的帧组成了整个场景,因此之后更改比例意味着裁剪或重新生成。在完善提示的其余部分之前选择它。

比率不是分辨率

比率与像素数量无关。 Midjourney的文档直接说明了这一点:宽高比与图像尺寸不同,最终尺寸取决于版本和升级器。 3:2 图像可以很小也可以很大。确定从哪里可以看到图像的形状以及拍摄对象在图像中的位置,然后将分辨率作为一个单独的问题来处理。

正方形,1:1

正方形是平衡的、静态的,没有主导方向。它适合单一物体、对称构图和居中主题,也是许多社交平台长期以来用于发布帖子和个人资料图片的框架。这也是 Midjourney 中的默认设置,其文档指出图像以正方形开头。正方形不适合风景和集体场景,因为在这些场景中,拍摄对象会自然地向侧面扩散。

经典照片,3:2 和 2:3

3:2是静态摄影的传统比例,继承自35毫米胶片,许多相机仍在使用它。对于摄影提示来说感觉很自然,因为它是人们与照片联系在一起的形状。水平3:2适合街道、室内和风景;垂直 2:3 适合肖像、门口和高层建筑,Midjourney 的文档提到它在印刷摄影和相框中很常见。

4:3 和 5:4

4:3 是最初的电视比例,许多平板电脑和大多数紧凑型数码相机仍在使用。它比 3:2 略呈方形,从而在拍摄对象的上方和下方留有更多空间。 5:4 又更方形,常见于大中画幅摄影以及 8 x 10 英寸的打印。两者都适合室内装饰和肖像画,您需要一点喘息空间,而又没有宽幅画幅的强大水平拉力。

宽屏,16:9

16:9是电视和网络视频的标准比例; YouTube的帮助中心将其描述为计算机上的标准宽高比。其宽幅画面适合风景、城市景观、行驶中的汽车以及主题置于一侧的电影场景。它是横幅、演示幻灯片和视频缩略图的绝佳选择。它对于单个站立人物来说较弱,在宽框架中最终会显得很小。

垂直,9:16

9:16 是侧面翻转的相同形状:直立的手机全屏。 Midjourney 的文档将其描述为社交媒体上移动内容的常见内容,YouTube 指出垂直 9:16 视频可以在计算机屏幕上以填充方式显示。它适合站立的人物、高层建筑、瀑布和任何具有强烈垂直线的物体。刻意为之创作;压缩在 9 分 16 秒的水平场景通常会因为空荡荡的天空和地板而失去主题。

构图如何随框架变化

较宽的画面为背景和三分法则提供了更多的空间,使拍摄对象偏离中心,并为眼睛移动提供了空间。较高的框架强调高度并邀请从前景到背景的层次感。提及提示中的位置:“汽车位于画面右侧三分之一处,空路从左侧通向”在 16:9 和 1:1 中读起来非常不同。当你改变比例时,重读作文句子并调整它们。

在Midjourney中设置比率

Midjourney 的文档列出了 --ar 参数或其长形式 --aspect,添加在提示符末尾并在破折号之前添加一个空格,例如“黎明时的安静港口 --ar 16:9”。数字必须是整数:文档说不接受小数,并建议使用 139:100 而不是 1.39:1,并且像素大小(例如 1920:1080)会简化为 16:9。它还指出,某些比率在放大时会略有变化,并且极宽或极高的比率是实验性的。

使用OpenAI的图像模型设置尺寸

OpenAI 的图像生成文档以像素为单位描述大小,而不是比率。在撰写本文时,它在推荐尺寸中列出了 1024x1024 方形、1536x1024 横向和 1024x1536 纵向,并带有自动选项。对于较新的型号,它还描述了自定义尺寸,写作宽度乘高度,其中两条边必须是 16 的倍数,长边和短边之间的比率必须保持在 3:1 以内。请注意,1536x1024 本身就是 3:2 形状。

Stable Diffusion等工具

在 Hugging Face diffusers 库中,Stable Diffusion 文本到图像管道接受以像素为单位的高度和宽度参数。原理在任何地方都是相同的:首先决定形状,然后设置工具要求的任何内容,像素或比率。当工具仅提供几种尺寸时,请选择最接近的尺寸,然后进行裁剪,在构图中留出边距,这样裁剪就不会切入主题。

规划不止一种格式

如果一张图像将在多个地方使用,例如宽幅网页横幅和垂直故事,则生成一张图像并以两种方式裁剪它很少起作用。要么在中心主题周围留出足够的空白空间,以便两种作物都能生存,要么根据相同的提示分别生成每种格式并调整作文句子。第二种选择通常会产生更好的结果,并且只花费更多的时间。

快速选择的方法

询问在哪里可以看到图像以及拍摄对象的形状。单个物体或居中对称的场景适合正方形。一张看起来像照片的照片适合 3:2 或 2:3。宽幅风景或视频帧适合 16:9。全屏手机图像或高大的拍摄对象适合 9:16。当没有明确的方向时,3:2 是一个安全的摄影起点,可以很好地裁剪到其他形状。

LarpGPT 适合的地方

LarpGPT 是一个旅行、建筑、汽车和生活方式场景的照片提示库,每个提示中都写入了构图以及主题、灯光和镜头。您复制提示,将其框架调整为您需要的比例,然后在您已使用的图像生成器中设置该比例。 LarpGPT 不会生成图像,并且每次尝试的结果都会有所不同。

常见问题

AI 图像的最佳长宽比是多少?

这取决于图像的观看位置和拍摄对象的形状。 3:2 是自然的摄影默认值,16:9 适合宽场景和视频,9:16 适合全屏手机图像,1:1 适合单中心主题。

如何更改 Midjourney 中的纵横比?

根据 Midjourney 的文档,在提示符末尾添加 --ar,后跟两个整数,例如 --ar 3:2。不接受小数,默认为平方。

OpenAI的镜像型号支持哪些尺寸?

在撰写本文时,OpenAI 的文档列出了推荐尺寸中的 1024x1024、1536x1024 和 1024x1536,以及自动选项,并描述了在设定限制内较新型号的自定义尺寸。

我可以稍后将 AI 图像裁剪为其他比例吗?

可以,但是针对一种形状制作的构图常常会在另一种形状中失去主题。围绕中心主题留出空间,或者单独生成每种格式并调整组合句子。

延伸阅读

全部应用