# Anatomi gesaan imej foto-realistik

Canonical: https://romeoapps.app/ms/larpgpt/anatomy-of-a-photo-prompt/
Author: Roméo Gambino · Published: 2026-09-06 · Updated: 2026-09-06 · App: LarpGPT (https://romeoapps.app/ms/larpgpt/)

Perkara yang dilakukan oleh setiap bahagian gesaan dalam penjana imej, sebab satu ayat bagi setiap keputusan berfungsi lebih baik daripada dinding kata sifat, dan cara menyesuaikan gesaan tanpa melanggar perkara yang menjadikannya berfungsi.

## Gesaan adalah ringkas, bukan mantra

Salah tanggapan yang paling berterusan tentang gesaan imej ialah perkataan tertentu adalah sihir dan tugasnya adalah untuk mengumpulnya. Apa yang sebenarnya berkesan adalah lebih dekat dengan memberi taklimat kepada jurugambar yang tidak boleh bertanya soalan. Anda sedang menerangkan adegan yang seseorang perlu sediakan, terangkan dan rakam, dan setiap keputusan yang anda biarkan tidak dinyatakan ialah keputusan yang dibuat oleh model untuk anda, biasanya ke arah versi paling purata bagi perkara yang anda minta.


## Satu ayat setiap keputusan

Gesaan panjang gagal bukan kerana ia panjang tetapi kerana ia tidak dibezakan. Dua puluh kata sifat dalam satu ayat bersaing antara satu sama lain dan model meratakannya. Kandungan yang sama dibahagikan kepada ayat-ayat pendek, masing-masing membawa satu keputusan, menghasilkan hasil yang jauh lebih boleh diramal. Ia juga menjadikan gesaan boleh diedit, kerana anda boleh melihat ayat yang hendak diubah apabila ada sesuatu yang salah.


## Subjek didahulukan dan paling berat

Jawatan penting. Perkara yang muncul pada awal gesaan biasanya ditimbang dengan lebih berat, jadi subjek berada di hadapan, diterangkan secara konkrit. Subjek konkrit ialah subjek yang anda boleh ambil gambar: objek, tempat, situasi dengan sifat fizikal. Subjek abstrak tidak memberikan model untuk dibina dan ia akan mencipta sesuatu yang generik untuk mengisi ruang.


## Terangkan apa yang akan kelihatan, bukan apa yang dirasakan

Ini adalah satu-satunya disiplin yang paling berguna. Perkataan seperti melankolik adalah tafsiran, dan model perlu meneka susunan visual yang menghasilkannya. Hujan di tingkap, lampu tunggal yang menyala, kerusi kosong: itu adalah perkara yang dirakam oleh kamera. Tulis sebab dan bukannya kesan, dan kesannya datang dengan sendirinya dengan lebih konsisten.


## Adegan menetapkan kekangan

Tetapan bukan hiasan. Ia menentukan cahaya yang tersedia, permukaan apa yang wujud untuk memantulkannya, perkara yang boleh muncul di latar belakang, dan pada skala yang dibaca semuanya. Subjek yang diterangkan secara terperinci tanpa tetapan yang dinyatakan akan diletakkan di suatu tempat generik, dan tetapan generik kemudiannya akan bercanggah dengan separuh daripada pilihan yang anda buat tentang subjek tersebut.


## Momen menyempitkan pemandangan kepada gambar

Masa hari, cuaca dan musim melakukan lebih banyak kerja daripada jangkaan kebanyakan orang, kerana setiap satu membawa persediaan pencahayaan keseluruhan dengannya. Lewat petang pada musim luruh membayangkan matahari panas rendah, bayang-bayang panjang dan warna tertentu, semuanya daripada empat perkataan. Menamakan detik ialah ayat yang paling berkesan dalam kebanyakan gesaan.


## Cahaya adalah keputusan, bukan renungan

Gambar sebahagian besarnya diperbuat daripada cahaya, dan pilihan pencahayaan yang tidak dinyatakan ialah laluan terpantas ke imej rata dan terang rata yang kelihatan sintetik. Katakan dari mana datangnya cahaya dan jenisnya. Lampu tingkap dari kiri. Satu sumber overhed tunggal. langit mendung. Matahari terus melalui daun. Setiap satu menghasilkan imej yang berbeza daripada subjek dan pemandangan yang sama.


## Cahaya keras dan lembut melakukan kerja yang berbeza

Cahaya dari sumber yang kecil atau jauh adalah keras: tepi bayang yang tajam, kontras yang tinggi, tekstur yang boleh dilihat. Cahaya daripada sumber yang besar atau tersebar adalah lembut: bayang-bayang beransur-ansur, kontras rendah, permukaan yang lebih lembut. Menamakan mana satu yang anda mahu memberitahu model lebih banyak tentang mood imej berbanding kata sifat tentang mood.


## Arahan komposisi model boleh ikut

Istilah pembingkaian berguna kerana ia tidak jelas. Dekat, tangkapan lebar, paras mata, sudut rendah, atas kepala. Sama ada subjek duduk di tengah atau ke sebelah. Apa yang ada di hadapannya dan apa yang ada di belakangnya. Ini adalah perkataan yang akan digunakan oleh jurugambar pada set, dan ia menterjemah dengan bersih kerana ia menggambarkan geometri dan bukannya rasa.


## Bahasa kanta, dan fungsinya sebenarnya

Panjang fokus yang lebar membesar-besarkan kedalaman dan menjadikan benda berhampiran besar. Panjang fokus yang panjang memampatkan jarak dan meratakan lapisan. Apertur yang luas menyebabkan latar belakang tidak fokus dan mengasingkan subjek. Istilah ini berfungsi dalam gesaan kerana ia sepadan dengan gelagat optik sebenar, dan meminta kedalaman medan yang cetek adalah lebih tepat daripada meminta latar belakang yang kabur.


## Warna, dihalang

Menamakan dua atau tiga warna menghasilkan imej yang koheren. Menamakan lapan menghasilkan lumpur, kerana model cuba memasukkan kesemuanya dan tiada satu pun yang mendominasi. Jika warna itu penting, pasangkannya pada objek dan bukannya pada keseluruhan gambar: pintu merah dibaca lebih baik daripada pemandangan berwarna merah, dan ia meninggalkan palet yang lain untuk mengikuti cahaya.


## Ubah satu perkara pada satu masa

Apabila keputusan hampir tetapi salah, naluri adalah untuk menulis semula gesaan. Tolaklah. Tukar satu ayat, jana semula dan lihat perkara yang menggerakkan. Ini adalah lebih perlahan setiap percubaan dan lebih pantas secara keseluruhan, kerana anda mempelajari perkara yang dilakukan oleh setiap ayat. Gesaan yang ditulis semula yang berfungsi tidak mengajar anda apa-apa yang boleh anda gunakan semula esok.


## Simpan versi yang anda buang

Gesaan yang menghasilkan sesuatu yang menarik tetapi bukan yang anda mahukan patut disimpan. Perpustakaan segera dibina daripada itu, bukan daripada kejayaan, kerana hampir-hampir adalah perkara yang anda sesuaikan apabila ringkasan seterusnya berbeza sedikit. Nota tentang rupa hasil sebenarnya lebih bernilai daripada gesaan sahaja.


## Menyesuaikan diri tanpa memecahkan struktur

Apabila anda menggunakan semula gesaan, tukar subjek dan tetapan dan biarkan ayat cahaya, gubahan dan kanta sahaja pada mulanya. Itu adalah bahagian yang menjadikan imej kelihatan seperti fotografi, dan ia adalah bahagian yang dipadamkan orang apabila gesaan terasa terlalu lama. Tukar mereka dengan sengaja, satu demi satu, sebaik sahaja subjek baru berfungsi.


## Sebut apa gambar itu

Imej yang dibuat dengan cara ini bukan gambar, dan piawaian untuk menyatakan demikian sudah wujud. Perbendaharaan kata Jenis Sumber Digital IPTC memberikan nilai yang membezakan tangkapan digital yang disampel daripada kehidupan sebenar daripada media yang dicipta menggunakan AI generatif, dan spesifikasi C2PA mentakrifkan cara maklumat asal bergerak dengan fail. Di mana imej itu mungkin diambil untuk rekod sesuatu yang nyata, labelkannya. LarpGPT menyediakan gesaan dan bahan rujukan, dan apa yang anda hasilkan adalah milik anda untuk digunakan dan milik anda untuk didedahkan.


## Soalan

### Mengapakah gesaan imej yang panjang sering gagal?

Kerana mereka tidak dibezakan, bukan kerana mereka panjang. Dua puluh kata sifat dalam satu ayat bersaing dan model meratakannya. Pisahkan kandungan yang sama kepada ayat pendek yang membawa satu keputusan setiap satu dan hasilnya menjadi jauh lebih boleh diramal.

### Perlukah saya menerangkan mood atau apa yang kelihatan?

Apa yang nampak. Perkataan seperti melankolik adalah tafsiran model yang perlu meneka. Hujan di tingkap, lampu tunggal yang menyala, kerusi kosong adalah perkara yang dirakam oleh kamera. Tulis punca dan mood berikut.

### Adakah susunan perkataan dalam masa yang pantas?

ya. Perkara yang muncul lebih awal biasanya ditimbang dengan lebih berat, jadi subjek berada di bahagian hadapan, diterangkan dengan cukup konkrit sehingga anda boleh memotretnya.

### Adakah istilah kamera seperti jarak fokus sebenarnya berfungsi?

Mereka lakukan, kerana ia sepadan dengan tingkah laku optik sebenar. Panjang fokus lebar membesar-besarkan kedalaman, panjang fokus memampatkannya, dan apertur lebar mengasingkan subjek. Meminta kedalaman bidang yang cetek adalah lebih tepat daripada meminta latar belakang yang kabur.

### Bagaimanakah saya harus melabelkan imej yang dijana AI?

Standard wujud. Perbendaharaan kata Jenis Sumber Digital IPTC membezakan tangkapan digital yang disampel daripada kehidupan sebenar daripada media yang dicipta menggunakan AI generatif, dan spesifikasi C2PA mentakrifkan cara asal bergerak dengan fail. Labelkan apa-apa yang mungkin diambil untuk rekod sesuatu yang nyata.

## Bacaan lanjut

- IPTC Digital Source Type NewsCodes — https://cv.iptc.org/newscodes/digitalsourcetype/
- C2PA technical specification — https://c2pa.org/specifications/specifications/2.1/index.html
- IPTC Photo Metadata Standard — https://www.iptc.org/std/photometadata/specification/IPTC-PhotoMetadata

