LarpGPT
Հայերեն
← Վերադարձ դեպի հավելված

LarpGPT · Էքսկուրսավարներ

Տեսակետային հարաբերակցություններ AI պատկերների համար. ինչպես ընտրել և սահմանել դրանք

Քառակուսի, 3:2, 16:9 կամ ուղղահայաց 9:16. ինչպես ընտրել AI պատկերի հարաբերակցությունը, ինչպես է փոխվում դրա կազմը և ինչպես են սահմանում Midjourney և OpenAI:

LarpGPT — Ձեր հաջորդ պատկերը սկսվում է այստեղ
LarpGPT · Ձեր հաջորդ պատկերը սկսվում է այստեղ
Այս ուղեցույցում14

Ինչու է հարաբերակցությունը առաջին տեղում

Տեսակետի հարաբերակցությունը պատկերի լայնության և բարձրության հարաբերությունն է, որը գրված է որպես երկու թվեր, ինչպիսիք են 3:2 կամ 16:9: Սա լուսանկարչի առաջին որոշումն է, քանի որ այն որոշում է, թե ինչ կարող է պահել շրջանակը: Պատկերի ստեղծման ժամանակ դա ավելի կարևոր է. մոդելը կազմում է ամբողջ տեսարանը ձեր կողմից տրված կադրի համար, ուստի հարաբերակցությունը փոխելուց հետո նշանակում է կրճատում կամ վերածնում: Ընտրեք այն՝ նախքան մնացած հուշումը ճշգրտելը:

Հարաբերակցությունը լուծում չէ

Հարաբերակցությունը ոչինչ չի ասում պիքսելների քանակի մասին: Midjourney-ի փաստաթղթերն ուղղակիորեն ընդգծում են այս կետը. կողմերի հարաբերակցությունը նույնը չէ, ինչ պատկերի չափսերը, և վերջնական չափը կախված է տարբերակից և մեծացնողից: 3:2 պատկերը կարող է լինել փոքր կամ մեծ: Որոշեք այն ձևը, որտեղից երևալու է պատկերը և ինչպես պետք է սուբյեկտը նստի դրա մեջ, ապա լուծեք որպես առանձին հարց:

Քառակուսի, 1:1

Հրապարակը հավասարակշռված է և ստատիկ, առանց գերիշխող ուղղության: Այն համապատասխանում է առանձին օբյեկտներին, սիմետրիկ կոմպոզիցիաներին և կենտրոնացված առարկաներին, և դա այն շրջանակն է, որը շատ սոցիալական հարթակներ երկար ժամանակ օգտագործել են գրառումների և պրոֆիլի պատկերների համար: Այն նաև լռելյայն է Midjourney-ում, որի փաստաթղթերում նշվում են, որ պատկերները սկսվում են որպես քառակուսի: Քառակուսին վատ տեղավորվում է լանդշաֆտների և խմբային տեսարանների համար, որտեղ թեման բնականաբար տարածվում է մի կողմ:

Դասական լուսանկար՝ 3։2 և 2։3

3:2-ը անշարժ լուսանկարչության ավանդական հարաբերակցությունն է, որը ժառանգվել է 35 մմ ֆիլմից, և շատ տեսախցիկներ դեռ օգտագործում են այն: Լուսանկարչական հուշումի համար դա բնական է թվում, քանի որ դա այն ձևն է, որը մարդիկ կապում են լուսանկարների հետ: Հորիզոնական 3:2-ը համապատասխանում է փողոցներին, ինտերիերին և լանդշաֆտներին; ուղղահայաց 2:3-ը համապատասխանում է դիմանկարներին, դռներին և բարձր շենքերին, իսկ Midjourney-ի փաստաթղթերում նշվում է, որ այն սովորական է տպագիր լուսանկարչության և նկարների շրջանակների մեջ:

4։3 և 5։4

4:3-ը հեռուստատեսության սկզբնական հարաբերակցությունն էր և մինչ օրս օգտագործվում է շատ պլանշետների և կոմպակտ թվային տեսախցիկների կողմից: Այն մի փոքր ավելի քառակուսի է, քան 3:2, ինչը ավելի շատ տեղ է թողնում թեմայի վերևում և ներքևում: 5:4-ը կրկին ավելի քառակուսի է և տարածված է մեծ և միջին ձևաչափի լուսանկարչության մեջ և 8-ից 10 դյույմ տպագրության համար: Ե՛վ ինտերիերին, և՛ դիմանկարներին, որտեղ դուք ցանկանում եք մի փոքր շնչառական սենյակ ունենալ, առանց լայն ձևաչափի ուժեղ հորիզոնական ձգման:

Լայնէկրան, 16:9

16:9-ը հեռուստատեսության և առցանց տեսանյութերի ստանդարտ հարաբերակցությունն է. YouTube-ի օգնության կենտրոնն այն նկարագրում է որպես համակարգչի չափման ստանդարտ հարաբերակցություն: Նրա լայն շրջանակը համապատասխանում է բնապատկերներին, քաղաքային տեսարաններին, շարժվող մեքենաներին և կինեմատոգրաֆիկ տեսարաններին, որոնց առարկան դրված է մի կողմում: Այն ուժեղ ընտրություն է բաններների, ներկայացման սլայդների և վիդեո մանրապատկերների համար: Այն ավելի թույլ է միայնակ կանգնած ֆիգուրների համար, որոնք փոքր են հայտնվում լայն շրջանակում:

Ուղղահայաց, 9:16

9:16-ը կողքից շրջված նույն ձևն է՝ հեռախոսի ամբողջ էկրանը կանգնած է: Midjourney-ի փաստաթղթերում այն ​​նկարագրվում է որպես սովորական սոցիալական ցանցերում բջջային բովանդակության համար, և YouTube-ը նշում է, որ ուղղահայաց 9:16 տեսանյութերը կարող են ցուցադրվել ներդիրներով համակարգչի էկրաններին: Այն համապատասխանում է կանգնած ֆիգուրներին, բարձր ճարտարապետությանը, ջրվեժներին և ուժեղ ուղղահայաց գիծ ունեցող ամեն ինչին: Կազմել դրա համար միտումնավոր; հորիզոնական տեսարանը, որը սեղմված է 9:16-ի վրա, սովորաբար կորցնում է իր առարկան դատարկ երկնքին և հատակին:

Ինչպես է կազմը փոխվում շրջանակի հետ

Ավելի լայն շրջանակն ավելի շատ տեղ է տալիս կարգավորելու և երրորդների կանոնների համար՝ առարկան կենտրոնից դուրս է և աչքի ճանապարհորդելու տարածք: Ավելի բարձր շրջանակն ընդգծում է բարձրությունը և հրավիրում է շերտավորվել առաջին պլանից դեպի հետին պլան: Հուշումում նշեք տեղադրումը. «մեքենան շրջանակի աջ երրորդում, ձախից ներս տանող դատարկ ճանապարհը» 16:9-ում և 1:1-ում շատ տարբեր է գրված: Երբ փոխում եք հարաբերակցությունը, վերընթերցեք կազմության նախադասությունները և կարգավորեք դրանք:

Սահմանել հարաբերակցությունը Midjourney-ում

Midjourney-ի փաստաթղթերում թվարկված է --ar պարամետրը կամ դրա երկար --aspect ձևը, որն ավելացվել է հուշման վերջում՝ գծիկներից առաջ բացատով, օրինակ՝ «հանգիստ նավահանգիստ լուսաբացին --ar 16:9»: Թվերը պետք է ամբողջական լինեն. փաստաթղթերում ասվում է, որ տասնորդականները չեն ընդունվում և առաջարկում են 139:100 1,39:1-ի փոխարեն, իսկ պիքսելների չափը, ինչպիսին 1920:1080-ն է, պարզեցված է մինչև 16:9: Այն նաև նշում է, որ որոշ գործակիցներ փոքր-ինչ փոխվում են, երբ մեծացնում են, և որ չափազանց լայն կամ բարձր գործակիցները փորձնական են:

Չափի կարգավորում OpenAI-ի պատկերի մոդելներով

OpenAI-ի պատկերների ստեղծման փաստաթղթերը նկարագրում են չափը պիքսելներով, այլ ոչ թե որպես հարաբերակցություն: Գրելու պահին առաջարկվող չափսերի շարքում նշվում է 1024x1024-ը որպես քառակուսի, 1536x1024-ը՝ որպես լանդշաֆտ և 1024x1536-ը՝ որպես դիմանկար, առաջարկվող չափերի մեջ՝ ավտոմատ տարբերակով: Իր նոր մոդելների համար այն նաև նկարագրում է հատուկ չափերը, որոնք գրված են լայնությամբ ըստ բարձրության, որտեղ երկու եզրերը պետք է լինեն 16-ի բազմապատիկ, իսկ երկար և կարճ եզրերի միջև հարաբերակցությունը պետք է մնա 3:1-ի սահմաններում: Նկատի ունեցեք, որ 1536x1024-ն ինքնին 3:2 ձև է:

Stable Diffusion և այլ գործիքներ

Hugging Face diffusers գրադարանում Stable Diffusion տեքստ-պատկեր խողովակաշարն ընդունում է բարձրության և լայնության արգումենտները պիքսելներով: Սկզբունքը նույնն է ամենուր. սկզբում որոշեք ձևը, այնուհետև սահմանեք այն, ինչ պահանջում է գործիքը՝ պիքսելներ կամ հարաբերակցություն: Երբ գործիքն առաջարկում է ընդամենը մի քանի չափս, ընտրեք ամենամոտը և այնուհետև կտրեք՝ բաղադրության մեջ թողնելով լուսանցք, որպեսզի բերքը չկտրվի առարկայի մեջ:

Պլանավորեք մեկից ավելի ձևաչափերի համար

Եթե պատկերը կօգտագործվի մի քանի վայրերում, ասենք լայն վեբ դրոշակակիր և ուղղահայաց պատմություն՝ ստեղծելով մեկ պատկեր և կտրելով այն երկու ձևով, հազվադեպ է աշխատում: Կամ ստեղծագործեք կենտրոնական թեմայի շուրջ մեծ դատարկ տարածությամբ, որպեսզի երկու մշակույթներն էլ գոյատևեն, կամ ստեղծեք յուրաքանչյուր ձևաչափ առանձին՝ նույն հուշումից՝ կոմպոզիցիայի նախադասություններով հարմարեցված: Երկրորդ տարբերակը սովորաբար ավելի լավ արդյունքներ է տալիս և արժե ընդամենը մի փոքր ավելի շատ ժամանակ:

Ընտրելու արագ միջոց

Հարցրեք, թե որտեղ է պատկերված պատկերը և ինչ ձև ունի առարկան: Մեկ օբյեկտը կամ կենտրոնացված սիմետրիկ տեսարանը համապատասխանում է քառակուսին: Լուսանկարը, որը նախատեսված է այնպես, ինչպես լուսանկարը համապատասխանում է 3:2 կամ 2:3: Լայն լանդշաֆտը կամ տեսահոլովակի շրջանակը համապատասխանում է 16:9-ին: Ամբողջ էկրանով հեռախոսի պատկերը կամ բարձր առարկան համապատասխանում է 9:16-ին: Երբ ոչինչ հստակորեն չի մատնանշում մի կողմ, 3:2-ը անվտանգ լուսանկարչական մեկնարկային կետ է, որը լավ ձևավորում է այլ ձևեր:

Որտեղ LarpGPT տեղավորվում է

LarpGPT-ը ճանապարհորդությունների, ճարտարապետության, մեքենաների և կենսակերպի տեսարանների լուսանկարների հուշումների գրադարան է, որի յուրաքանչյուր հուշում գրված է կոմպոզիցիան՝ թեմայի, լուսավորության և ոսպնյակի կողքին: Դուք պատճենում եք հուշումը, հարմարեցնում դրա շրջանակը ձեզ անհրաժեշտ հարաբերակցությանը և սահմանում այդ հարաբերակցությունը պատկերի գեներատորում, որն արդեն օգտագործում եք: LarpGPT-ը չի ստեղծում պատկերներ, և արդյունքները տարբերվում են փորձերից:

Հարցեր

Ո՞րն է AI պատկերների լավագույն կողմի հարաբերակցությունը:

Դա կախված է նրանից, թե որտեղից կերեւա պատկերը և թեմայի ձևը: 3:2-ը բնական լուսանկարչական լռելյայն է, 16:9-ը համապատասխանում է լայն տեսարաններին և տեսանյութերին, 9:16-ը՝ հեռախոսի լիաէկրան պատկերներին, իսկ 1:1-ը՝ առանձին կենտրոնացված առարկաներին:

Ինչպե՞ս փոխել կողմի հարաբերակցությունը Midjourney-ում:

Հուշման վերջում ավելացրեք --ar, որին հաջորդում են երկու ամբողջ թվեր, օրինակ --ar 3:2՝ համաձայն Midjourney-ի փաստաթղթերի: Տասնորդական թվերը չեն ընդունվում, իսկ կանխադրվածը քառակուսի է:

Ի՞նչ չափերի են աջակցում OpenAI-ի պատկերի մոդելները:

Գրելու պահին OpenAI-ի փաստաթղթերում առաջարկվող չափերի շարքում նշվում են 1024x1024, 1536x1024 և 1024x1536, գումարած ավտոմատ տարբերակ, և նկարագրում է նոր մոդելների համար նախատեսված չափերը սահմանված սահմաններում:

Կարո՞ղ եմ ավելի ուշ կտրել AI պատկերը մեկ այլ հարաբերակցությամբ:

Դուք կարող եք, բայց մի ձևի համար ստեղծված կոմպոզիցիան հաճախ կորցնում է իր թեման մյուսի մեջ: Տարածք թողեք կենտրոնական թեմայի շուրջ կամ ստեղծեք յուրաքանչյուր ձևաչափ առանձին՝ հարմարեցված կոմպոզիցիոն նախադասություններով:

Հետագա ընթերցում

Բոլոր հավելվածները