LarpGPT · 指南
如何为现实的人编写人工智能提示
在 AI 图像中描述逼真的人物:姿态、服装、皮肤、双手与光线,以及相伴的肖像权与披露规范。

本指南内容14
为什么人是最难的学科
观众是面孔和身体的专家。 We notice a slightly wrong hand, an impossible posture or skin that looks like plastic long before we notice a flaw in a building or a landscape.这使得人们成为模糊提示最明显失败的对象。 The fix is the same as for any photographic prompt, only stricter: describe what a camera would actually record, and leave as little as possible to the model's idea of an average person.
发明人,不要借人
从一个不存在的人开始。描述年龄范围、体型、头发、服装和活动,并让细节变得普通。 Never prompt for the likeness of a real private individual, and never generate a real public figure in a situation that could be taken as genuine. Beyond the ethics, many jurisdictions recognise personality rights, which let people control the commercial use of their name, image and likeness.不同国家的规则有所不同,而一个虚构的人完全回避了这个问题。
描述一项活动,而不是一个姿势
被拍到的人们做某事看起来很自然;人们被告知摆出像库存图片一样的姿势。不要让一个女人对着镜头微笑,而是让一个四十多岁的女人在火车站阅读纸质地图,另一只手拿着一杯咖啡。一项活动为身体提供了其姿势的理由,为双手提供了可以握住的东西,并为面部提供了来自任务而不是提示的表情。
姿势和体重
真实的身体有重量。有人靠在栏杆上,坐在椅子边缘,在等待时将重量转移到一条腿上:这些都是使数字可信的小物理事实。僵硬、对称、正面的人物是生成图像最常见的标志之一。关于重物所在的位置和人所靠的东西的一句话往往比关于他们的外表的几句话更能说明问题。
服装的材质和合身性
以描述任何其他表面的方式来描述衣服:卷袖的褶皱亚麻衬衫、略大的厚羊毛外套、破旧的帆布运动鞋。折叠、拉伸和起皱的织物是最强烈的现实主义线索之一,因为它会对下面的身体做出反应。诸如“时尚”或“优雅”之类的通用词与材质无关,通常会产生看起来刚拆开包装的衣服。
皮肤,没有修饰
生成的面孔通常显得光滑均匀,就像经过大量修饰的广告一样。如果你想要自然的效果,用物理术语来说:自然的皮肤纹理、明显的毛孔、眼睛周围的细纹、鼻子上轻微的晒伤、不化妆。描述光线也有帮助,因为柔和的侧光可以温和地揭示纹理,而平坦的正面光则可以消除纹理。避免堆砌“完美”或“无瑕”等术语,这会使结果进一步接近塑料外观。
手需要工作
手是图像生成器众所周知的弱点。最可靠的方法是给他们一些特定的事情做,拿着杯子,放在桌子上,塞进外套口袋里,而不是让他们自由地留在框架中。可见手指越少意味着出错的机会就越少。在使用图像之前,请务必检查双手:数一下手指,检查它们如何抓握物体,并查看它们与手腕的交汇处。
脸上有光
以三点照明传统描述的经典摄影设置,在拍摄对象上使用主光,使用辅助光来柔化阴影,并使用后面的光将拍摄对象与背景分开。你不需要使用行话来使用这个想法。一侧柔和的窗光、阴影一侧的柔和反射以及头部后面明亮的背景用简单的文字描述了相同的布置。相比之下,头顶正午的阳光会在眼睛下方留下深色的阴影,而且很少让人赏心悦目。
取景和距离
说出相机有多近。头肩肖像、街道上几米外的人物、广阔风景中的小人物:每一个都设定了面部和手部必须渲染的比例。更宽的框架隐藏了小错误并讲述了更多的故事;特写镜头暴露了一切。为了获得最自然的效果,具有清晰活动和真实环境的中等框架是最宽容的起点。
多样性是有意为之,而非偶然
图像生成器反映了训练数据中的模式,Midjourney 的一项研究发现,即使是中性提示也会根据性别、肤色和位置返回不同的结果。如果你想要一个特定的人,请具体描述他们。如果您正在制作一个系列,请故意改变年龄、体型和外观,而不是首先接受模特返回的任何内容,并在发布之前对整个系列进行审查。
同意和合成媒体
Partnership on AI 负责任的合成媒体框架围绕三个理念构建:同意、披露和透明度。对于生成的人来说,同意主要意味着未经许可不得使用任何人的肖像,包括通过参考照片。如果您使用真人照片进行创作,例如为了保持一致的性格,请确保该人明确同意特定用途,并且切勿创建带有色情色彩、羞辱或冒充任何人的图像。
须知的披露规则
在欧盟,《人工智能法案》将深度造假定义为人工智能生成或操纵的图像、音频或视频内容,类似于现有的人、物体、地点、实体或事件,并且会错误地显得真实。生成此类内容的部署者必须披露该内容是人为生成或操纵的,对于明显的艺术、创意、讽刺或虚构作品,披露更为有限。欧盟委员会表示,这些透明度规则从 2026 年 8 月起适用。在可以被视为真实的背景下,一个现实的虚构人物应该在任何地方都被贴上标签。
为文件添加标签,而不仅仅是标题
重新共享图像时,标题可能会被剪掉或丢失。元数据标准的存在是为了在文件中携带信息:IPTC 数字源类型词汇表包含使用生成式 AI 创建的媒体的值,并且许多工具会自动写入此类信息。编辑和导出时保持其完整,并在人们可能合理地将图像误认为真人照片的地方添加可见的注释。
LarpGPT 适合的地方
LarpGPT 是一个关于旅行、建筑、汽车和生活方式场景的照片提示库,围绕主题、构图、灯光和镜头编写,并且它的许多生活方式场景都可以使用上述方法进行调整,以包括发明人。您复制提示并将其粘贴到您已使用的图像生成器中。 LarpGPT不生成图像;尊重他人的权利并披露合成内容由您负责。
常见问题
如何让人工智能生成的人物看起来更真实?
给人物一个活动,描述姿势、衣服作为材料、自然的皮肤纹理和真实的光源。僵硬的姿势、完美的皮肤和自由浮动的双手是生成图像最常见的标志。
为什么AI图像会出错?
手是图像生成器的一个已知弱点。给他们一个特定的任务,例如拿着杯子,并显示更少的手指可以减少错误,但您应该在使用图像之前始终检查它们。
我可以生成真人图像吗?
完全避免真实的个人,并且永远不要在可以被视为真实的情况下描绘公众人物。在许多国家,人格权保护个人的姓名、肖像和肖像,而虚构的人则避免了这个问题。
我需要给现实的人工智能人贴上标签吗?
在欧盟,《人工智能法案》要求披露深度造假,这意味着生成的内容与现有人员相似,并且会虚假地显得真实。给任何现实生成的人贴上标签在任何地方都是很好的做法。
延伸阅读
- Regulation (EU) 2024/1689 (Artificial Intelligence Act), Articles 3 and 50
- European Commission: AI Act, regulatory framework and application timeline
- Partnership on AI: Responsible Practices for Synthetic Media
- Personality rights (Wikipedia)
- Midjourney (Wikipedia), section on bias in generated images
- IPTC Digital Source Type NewsCodes
