LarpGPT · Udhëzues
Raportet e aspektit për imazhet e AI: si t'i zgjidhni dhe vendosni ato
Sheshi, 3:2, 16:9 ose vertikal 9:16: si të zgjidhni një raport të pamjes për një imazh të AI, si ndryshon përbërja me të dhe si e vendosin Midjourney dhe OpenAI.

Në këtë udhëzues14
Pse raporti vjen i pari
Raporti i pamjes është marrëdhënia midis gjerësisë dhe lartësisë së një imazhi, të shkruar si dy numra si 3:2 ose 16:9. Është vendimi i parë që merr një fotograf, sepse ai vendos se çfarë mund të mbajë korniza. Në gjenerimin e imazhit ka edhe më shumë rëndësi: modeli kompozon të gjithë skenën për kornizën që i jepni, kështu që ndryshimi i raportit më pas do të thotë prerje ose rigjenerim. Zgjidhni atë përpara se të përmirësoni pjesën tjetër të kërkesës.
Raporti nuk është rezolucion
Një raport nuk thotë asgjë për numrin e pikselëve. Dokumentacioni i Midjourney e bën këtë gjë drejtpërdrejt: raporti i pamjes nuk është i njëjtë me dimensionet e imazhit, dhe madhësia përfundimtare varet nga versioni dhe niveli i lartë. Një imazh 3:2 mund të jetë i vogël ose i madh. Vendosni formën nga ku do të shihet imazhi dhe si duhet të ulet subjekti në të, më pas trajtoni rezolucionin si një pyetje më vete.
Sheshi, 1:1
Sheshi është i balancuar dhe statik, pa drejtim dominues. I përshtatet objekteve të veçanta, kompozimeve simetrike dhe subjekteve të përqendruara, dhe është korniza që shumë platforma sociale e kanë përdorur prej kohësh për postime dhe imazhe të profilit. Është gjithashtu parazgjedhja në Midjourney, dokumentacioni i të cilit vë në dukje se imazhet fillojnë si katrorë. Një katror është një përshtatje e dobët për peizazhet dhe skenat në grup, ku subjekti përhapet natyrshëm anash.
Foto klasike, 3:2 dhe 2:3
3:2 është raporti tradicional i fotografisë së palëvizshme, i trashëguar nga filmi 35 mm dhe shumë kamera ende e përdorin atë. Ndihet e natyrshme për një nxitje fotografike sepse është forma që njerëzit shoqërojnë me fotografitë. Horizontali 3:2 i përshtatet rrugëve, ambienteve të brendshme dhe peizazheve; vertikale 2:3 i përshtatet portreteve, dyerve dhe ndërtesave të larta dhe dokumentacioni i Midjourney e përmend atë si të zakonshme në fotografitë e printuara dhe kornizat e fotografive.
4:3 dhe 5:4
4:3 ishte raporti origjinal i televizionit dhe përdoret ende nga shumë tableta dhe nga shumica e kamerave dixhitale kompakte. Është pak më katror se 3:2, gjë që lë më shumë hapësirë sipër dhe poshtë temës. 5:4 është përsëri më katror dhe është i zakonshëm në fotografinë me format të madh dhe të mesëm dhe për printime 8 me 10 inç. Të dyja përshtaten me ambientet e brendshme dhe portretet ku dëshironi një dhomë të vogël të frymëmarrjes pa tërheqjen e fortë horizontale të një formati të gjerë.
Ekran i gjerë, 16:9
16:9 është raporti standard për televizionin dhe videon online; Qendra e ndihmës e YouTube e përshkruan atë si raportin standard të pamjes në një kompjuter. Korniza e saj e gjerë i përshtatet peizazheve, peizazheve të qytetit, makinave në lëvizje dhe skenave kinematografike me një subjekt të vendosur në njërën anë. Është një zgjedhje e fortë për banderolat, rrëshqitjet e prezantimit dhe miniaturat e videove. Është më e dobët për figurat e vetme në këmbë, të cilat përfundojnë të vogla në një kornizë të gjerë.
Vertikale, 9:16
9:16 është e njëjta formë e kthyer anash: ekrani i plotë i një telefoni të mbajtur drejt. Dokumentacioni i Midjourney e përshkruan atë si të zakonshme për përmbajtjen celulare në mediat sociale, dhe YouTube vëren se videot vertikale 9:16 mund të shfaqen me mbushje në ekranet e kompjuterit. I përshtatet figurave në këmbë, arkitekturës së lartë, ujëvarave dhe çdo gjëje me një vijë të fortë vertikale. Kompozoni për të me qëllim; një skenë horizontale e shtrydhur në 9:16 zakonisht humbet subjektin e saj në qiell dhe dysheme bosh.
Si ndryshon përbërja me kornizën
Një kornizë më e gjerë jep më shumë hapësirë për vendosjen dhe rregullin e të tretave, me subjektin jashtë qendrës dhe hapësirë për të udhëtuar syrin. Një kornizë më e lartë thekson lartësinë dhe fton shtresimin nga plani i parë në sfond. Përmendni vendosjen në prompt: "makina në të tretën e djathtë të kornizës, rruga e zbrazët që të çon nga e majta" lexohet shumë ndryshe në 16:9 dhe 1:1. Kur ndryshoni raportin, rilexoni fjalitë e përbërjes dhe rregullojini ato.
Vendosja e raportit në Midjourney
Dokumentacioni i Midjourney liston parametrin --ar, ose formën e tij të gjatë --aspect, të shtuar në fund të kërkesës me një hapësirë përpara vijave, për shembull "liman i qetë në agim --ar 16:9". Numrat duhet të jenë të plotë: dokumentacioni thotë se numrat dhjetorë nuk pranohen dhe sugjeron 139:100 në vend të 1.39:1, dhe një madhësi pikselësh si 1920:1080 është thjeshtuar në 16:9. Ai gjithashtu vëren se disa raporte ndryshojnë pak kur rriten dhe se raportet jashtëzakonisht të gjera ose të larta janë eksperimentale.
Vendosja e madhësisë me modelet e imazhit të OpenAI
Dokumentacioni i gjenerimit të imazhit të OpenAI përshkruan madhësinë në piksel dhe jo si raport. Në momentin e shkrimit rendit 1024x1024 si katror, 1536x1024 si peizazh dhe 1024x1536 si portret midis madhësive të rekomanduara, me një opsion automatik. Për modelet e tij më të reja, ai përshkruan gjithashtu madhësitë e personalizuara të shkruara si gjerësi sipas lartësisë, ku të dy skajet duhet të jenë shumëfish të 16 dhe raporti midis skajeve të gjata dhe të shkurtra duhet të qëndrojë brenda 3:1. Vini re se 1536x1024 është në vetvete një formë 3:2.
Stable Diffusion dhe mjete të tjera
Në bibliotekën Hugging Face diffusers, tubacioni tekst-në-imazh Stable Diffusion pranon argumentet e lartësisë dhe gjerësisë në piksel. Parimi është i njëjtë kudo: vendosni fillimisht formën, më pas vendosni çfarëdo që të kërkojë mjeti, pikselë ose raport. Kur një vegël ofron vetëm disa madhësi, zgjidhni atë më të afërt dhe prisni më pas, duke lënë diferencë në përbërje në mënyrë që prerja të mos prehet në subjekt.
Planifikoni për më shumë se një format
Nëse një imazh do të përdoret në disa vende, le të themi një baner të gjerë në internet dhe një histori vertikale, duke krijuar një imazh dhe duke e prerë atë në të dyja mënyrat rrallë funksionon. Ose kompozoni me hapësirë boshe bujare rreth një subjekti qendror në mënyrë që të dy të korrat të mbijetojnë, ose gjeneroni secilin format veçmas nga e njëjta kërkesë me fjalitë e kompozimit të përshtatura. Opsioni i dytë zakonisht jep rezultate më të mira dhe kushton vetëm pak më shumë kohë.
Një mënyrë e shpejtë për të zgjedhur
Pyesni se ku do të shihet imazhi dhe çfarë forme ka subjekti. Një objekt i vetëm ose një skenë simetrike e përqendruar i përshtatet një katrori. Një fotografi e destinuar të ndjehet sikur një fotografi i përshtatet 3:2 ose 2:3. Një peizazh i gjerë ose një kornizë video i përshtatet 16:9. Një imazh telefoni me ekran të plotë ose një subjekt i gjatë i përshtatet 9:16. Kur asgjë nuk tregon qartë një drejtim, 3:2 është një pikënisje e sigurt fotografike që përshtatet mirë me forma të tjera.
Aty ku përshtatet LarpGPT
LarpGPT është një bibliotekë me porosi fotografish për udhëtime, arkitekturë, makina dhe skena të stilit të jetesës, me kompozim të shkruar në secilën kërkesë së bashku me subjektin, ndriçimin dhe lentet. Ju kopjoni një kërkesë, përshtatni kornizën e tij me raportin që ju nevojitet dhe vendosni atë raport në gjeneratorin e imazhit që përdorni tashmë. LarpGPT nuk gjeneron imazhe dhe rezultatet ndryshojnë ndërmjet përpjekjeve.
Pyetje
Cili është raporti më i mirë i pamjes për imazhet e AI?
Varet nga vendi ku do të shihet imazhi dhe forma e subjektit. 3:2 është një standard fotografik natyral, 16:9 i përshtatet skenave dhe videove të gjera, 9:16 i përshtatet imazheve të telefonit në ekran të plotë dhe 1:1 i përshtatet subjekteve me qendër të vetme.
Si mund ta ndryshoj raportin e pamjes në Midjourney?
Shtoni --ar të ndjekur nga dy numra të plotë në fund të kërkesës, për shembull --ar 3:2, sipas dokumentacionit të Midjourney. Dhjetorët nuk pranohen, dhe parazgjedhja është një katror.
Çfarë madhësish mbështesin modelet e imazhit të OpenAI?
Në momentin e shkrimit, dokumentacioni i OpenAI rendit 1024x1024, 1536x1024 dhe 1024x1536 midis madhësive të rekomanduara, plus një opsion automatik dhe përshkruan madhësitë e personalizuara për modelet më të reja brenda kufijve të caktuar.
A mund të pres një imazh të AI me një raport tjetër më vonë?
Mundesh, por një kompozim i bërë për një formë shpesh e humb temën në një tjetër. Lini hapësirë rreth një subjekti qendror, ose gjeneroni secilin format veçmas me fjalitë e kompozimit të përshtatura.
