LarpGPT · Էքսկուրսավարներ
Տեսակետային հարաբերակցություններ AI պատկերների համար. ինչպես ընտրել և սահմանել դրանք
Քառակուսի, 3:2, 16:9 կամ ուղղահայաց 9:16. ինչպես ընտրել AI պատկերի հարաբերակցությունը, ինչպես է փոխվում դրա կազմը և ինչպես են սահմանում Midjourney և OpenAI:

Այս ուղեցույցում14
Ինչու է հարաբերակցությունը առաջին տեղում
Տեսակետի հարաբերակցությունը պատկերի լայնության և բարձրության հարաբերությունն է, որը գրված է որպես երկու թվեր, ինչպիսիք են 3:2 կամ 16:9: Սա լուսանկարչի առաջին որոշումն է, քանի որ այն որոշում է, թե ինչ կարող է պահել շրջանակը: Պատկերի ստեղծման ժամանակ դա ավելի կարևոր է. մոդելը կազմում է ամբողջ տեսարանը ձեր կողմից տրված կադրի համար, ուստի հարաբերակցությունը փոխելուց հետո նշանակում է կրճատում կամ վերածնում: Ընտրեք այն՝ նախքան մնացած հուշումը ճշգրտելը:
Հարաբերակցությունը լուծում չէ
Հարաբերակցությունը ոչինչ չի ասում պիքսելների քանակի մասին: Midjourney-ի փաստաթղթերն ուղղակիորեն ընդգծում են այս կետը. կողմերի հարաբերակցությունը նույնը չէ, ինչ պատկերի չափսերը, և վերջնական չափը կախված է տարբերակից և մեծացնողից: 3:2 պատկերը կարող է լինել փոքր կամ մեծ: Որոշեք այն ձևը, որտեղից երևալու է պատկերը և ինչպես պետք է սուբյեկտը նստի դրա մեջ, ապա լուծեք որպես առանձին հարց:
Քառակուսի, 1:1
Հրապարակը հավասարակշռված է և ստատիկ, առանց գերիշխող ուղղության: Այն համապատասխանում է առանձին օբյեկտներին, սիմետրիկ կոմպոզիցիաներին և կենտրոնացված առարկաներին, և դա այն շրջանակն է, որը շատ սոցիալական հարթակներ երկար ժամանակ օգտագործել են գրառումների և պրոֆիլի պատկերների համար: Այն նաև լռելյայն է Midjourney-ում, որի փաստաթղթերում նշվում են, որ պատկերները սկսվում են որպես քառակուսի: Քառակուսին վատ տեղավորվում է լանդշաֆտների և խմբային տեսարանների համար, որտեղ թեման բնականաբար տարածվում է մի կողմ:
Դասական լուսանկար՝ 3։2 և 2։3
3:2-ը անշարժ լուսանկարչության ավանդական հարաբերակցությունն է, որը ժառանգվել է 35 մմ ֆիլմից, և շատ տեսախցիկներ դեռ օգտագործում են այն: Լուսանկարչական հուշումի համար դա բնական է թվում, քանի որ դա այն ձևն է, որը մարդիկ կապում են լուսանկարների հետ: Հորիզոնական 3:2-ը համապատասխանում է փողոցներին, ինտերիերին և լանդշաֆտներին; ուղղահայաց 2:3-ը համապատասխանում է դիմանկարներին, դռներին և բարձր շենքերին, իսկ Midjourney-ի փաստաթղթերում նշվում է, որ այն սովորական է տպագիր լուսանկարչության և նկարների շրջանակների մեջ:
4։3 և 5։4
4:3-ը հեռուստատեսության սկզբնական հարաբերակցությունն էր և մինչ օրս օգտագործվում է շատ պլանշետների և կոմպակտ թվային տեսախցիկների կողմից: Այն մի փոքր ավելի քառակուսի է, քան 3:2, ինչը ավելի շատ տեղ է թողնում թեմայի վերևում և ներքևում: 5:4-ը կրկին ավելի քառակուսի է և տարածված է մեծ և միջին ձևաչափի լուսանկարչության մեջ և 8-ից 10 դյույմ տպագրության համար: Ե՛վ ինտերիերին, և՛ դիմանկարներին, որտեղ դուք ցանկանում եք մի փոքր շնչառական սենյակ ունենալ, առանց լայն ձևաչափի ուժեղ հորիզոնական ձգման:
Լայնէկրան, 16:9
16:9-ը հեռուստատեսության և առցանց տեսանյութերի ստանդարտ հարաբերակցությունն է. YouTube-ի օգնության կենտրոնն այն նկարագրում է որպես համակարգչի չափման ստանդարտ հարաբերակցություն: Նրա լայն շրջանակը համապատասխանում է բնապատկերներին, քաղաքային տեսարաններին, շարժվող մեքենաներին և կինեմատոգրաֆիկ տեսարաններին, որոնց առարկան դրված է մի կողմում: Այն ուժեղ ընտրություն է բաններների, ներկայացման սլայդների և վիդեո մանրապատկերների համար: Այն ավելի թույլ է միայնակ կանգնած ֆիգուրների համար, որոնք փոքր են հայտնվում լայն շրջանակում:
Ուղղահայաց, 9:16
9:16-ը կողքից շրջված նույն ձևն է՝ հեռախոսի ամբողջ էկրանը կանգնած է: Midjourney-ի փաստաթղթերում այն նկարագրվում է որպես սովորական սոցիալական ցանցերում բջջային բովանդակության համար, և YouTube-ը նշում է, որ ուղղահայաց 9:16 տեսանյութերը կարող են ցուցադրվել ներդիրներով համակարգչի էկրաններին: Այն համապատասխանում է կանգնած ֆիգուրներին, բարձր ճարտարապետությանը, ջրվեժներին և ուժեղ ուղղահայաց գիծ ունեցող ամեն ինչին: Կազմել դրա համար միտումնավոր; հորիզոնական տեսարանը, որը սեղմված է 9:16-ի վրա, սովորաբար կորցնում է իր առարկան դատարկ երկնքին և հատակին:
Ինչպես է կազմը փոխվում շրջանակի հետ
Ավելի լայն շրջանակն ավելի շատ տեղ է տալիս կարգավորելու և երրորդների կանոնների համար՝ առարկան կենտրոնից դուրս է և աչքի ճանապարհորդելու տարածք: Ավելի բարձր շրջանակն ընդգծում է բարձրությունը և հրավիրում է շերտավորվել առաջին պլանից դեպի հետին պլան: Հուշումում նշեք տեղադրումը. «մեքենան շրջանակի աջ երրորդում, ձախից ներս տանող դատարկ ճանապարհը» 16:9-ում և 1:1-ում շատ տարբեր է գրված: Երբ փոխում եք հարաբերակցությունը, վերընթերցեք կազմության նախադասությունները և կարգավորեք դրանք:
Սահմանել հարաբերակցությունը Midjourney-ում
Midjourney-ի փաստաթղթերում թվարկված է --ar պարամետրը կամ դրա երկար --aspect ձևը, որն ավելացվել է հուշման վերջում՝ գծիկներից առաջ բացատով, օրինակ՝ «հանգիստ նավահանգիստ լուսաբացին --ar 16:9»: Թվերը պետք է ամբողջական լինեն. փաստաթղթերում ասվում է, որ տասնորդականները չեն ընդունվում և առաջարկում են 139:100 1,39:1-ի փոխարեն, իսկ պիքսելների չափը, ինչպիսին 1920:1080-ն է, պարզեցված է մինչև 16:9: Այն նաև նշում է, որ որոշ գործակիցներ փոքր-ինչ փոխվում են, երբ մեծացնում են, և որ չափազանց լայն կամ բարձր գործակիցները փորձնական են:
Չափի կարգավորում OpenAI-ի պատկերի մոդելներով
OpenAI-ի պատկերների ստեղծման փաստաթղթերը նկարագրում են չափը պիքսելներով, այլ ոչ թե որպես հարաբերակցություն: Գրելու պահին առաջարկվող չափսերի շարքում նշվում է 1024x1024-ը որպես քառակուսի, 1536x1024-ը՝ որպես լանդշաֆտ և 1024x1536-ը՝ որպես դիմանկար, առաջարկվող չափերի մեջ՝ ավտոմատ տարբերակով: Իր նոր մոդելների համար այն նաև նկարագրում է հատուկ չափերը, որոնք գրված են լայնությամբ ըստ բարձրության, որտեղ երկու եզրերը պետք է լինեն 16-ի բազմապատիկ, իսկ երկար և կարճ եզրերի միջև հարաբերակցությունը պետք է մնա 3:1-ի սահմաններում: Նկատի ունեցեք, որ 1536x1024-ն ինքնին 3:2 ձև է:
Stable Diffusion և այլ գործիքներ
Hugging Face diffusers գրադարանում Stable Diffusion տեքստ-պատկեր խողովակաշարն ընդունում է բարձրության և լայնության արգումենտները պիքսելներով: Սկզբունքը նույնն է ամենուր. սկզբում որոշեք ձևը, այնուհետև սահմանեք այն, ինչ պահանջում է գործիքը՝ պիքսելներ կամ հարաբերակցություն: Երբ գործիքն առաջարկում է ընդամենը մի քանի չափս, ընտրեք ամենամոտը և այնուհետև կտրեք՝ բաղադրության մեջ թողնելով լուսանցք, որպեսզի բերքը չկտրվի առարկայի մեջ:
Պլանավորեք մեկից ավելի ձևաչափերի համար
Եթե պատկերը կօգտագործվի մի քանի վայրերում, ասենք լայն վեբ դրոշակակիր և ուղղահայաց պատմություն՝ ստեղծելով մեկ պատկեր և կտրելով այն երկու ձևով, հազվադեպ է աշխատում: Կամ ստեղծագործեք կենտրոնական թեմայի շուրջ մեծ դատարկ տարածությամբ, որպեսզի երկու մշակույթներն էլ գոյատևեն, կամ ստեղծեք յուրաքանչյուր ձևաչափ առանձին՝ նույն հուշումից՝ կոմպոզիցիայի նախադասություններով հարմարեցված: Երկրորդ տարբերակը սովորաբար ավելի լավ արդյունքներ է տալիս և արժե ընդամենը մի փոքր ավելի շատ ժամանակ:
Ընտրելու արագ միջոց
Հարցրեք, թե որտեղ է պատկերված պատկերը և ինչ ձև ունի առարկան: Մեկ օբյեկտը կամ կենտրոնացված սիմետրիկ տեսարանը համապատասխանում է քառակուսին: Լուսանկարը, որը նախատեսված է այնպես, ինչպես լուսանկարը համապատասխանում է 3:2 կամ 2:3: Լայն լանդշաֆտը կամ տեսահոլովակի շրջանակը համապատասխանում է 16:9-ին: Ամբողջ էկրանով հեռախոսի պատկերը կամ բարձր առարկան համապատասխանում է 9:16-ին: Երբ ոչինչ հստակորեն չի մատնանշում մի կողմ, 3:2-ը անվտանգ լուսանկարչական մեկնարկային կետ է, որը լավ ձևավորում է այլ ձևեր:
Որտեղ LarpGPT տեղավորվում է
LarpGPT-ը ճանապարհորդությունների, ճարտարապետության, մեքենաների և կենսակերպի տեսարանների լուսանկարների հուշումների գրադարան է, որի յուրաքանչյուր հուշում գրված է կոմպոզիցիան՝ թեմայի, լուսավորության և ոսպնյակի կողքին: Դուք պատճենում եք հուշումը, հարմարեցնում դրա շրջանակը ձեզ անհրաժեշտ հարաբերակցությանը և սահմանում այդ հարաբերակցությունը պատկերի գեներատորում, որն արդեն օգտագործում եք: LarpGPT-ը չի ստեղծում պատկերներ, և արդյունքները տարբերվում են փորձերից:
Հարցեր
Ո՞րն է AI պատկերների լավագույն կողմի հարաբերակցությունը:
Դա կախված է նրանից, թե որտեղից կերեւա պատկերը և թեմայի ձևը: 3:2-ը բնական լուսանկարչական լռելյայն է, 16:9-ը համապատասխանում է լայն տեսարաններին և տեսանյութերին, 9:16-ը՝ հեռախոսի լիաէկրան պատկերներին, իսկ 1:1-ը՝ առանձին կենտրոնացված առարկաներին:
Ինչպե՞ս փոխել կողմի հարաբերակցությունը Midjourney-ում:
Հուշման վերջում ավելացրեք --ar, որին հաջորդում են երկու ամբողջ թվեր, օրինակ --ar 3:2՝ համաձայն Midjourney-ի փաստաթղթերի: Տասնորդական թվերը չեն ընդունվում, իսկ կանխադրվածը քառակուսի է:
Ի՞նչ չափերի են աջակցում OpenAI-ի պատկերի մոդելները:
Գրելու պահին OpenAI-ի փաստաթղթերում առաջարկվող չափերի շարքում նշվում են 1024x1024, 1536x1024 և 1024x1536, գումարած ավտոմատ տարբերակ, և նկարագրում է նոր մոդելների համար նախատեսված չափերը սահմանված սահմաններում:
Կարո՞ղ եմ ավելի ուշ կտրել AI պատկերը մեկ այլ հարաբերակցությամբ:
Դուք կարող եք, բայց մի ձևի համար ստեղծված կոմպոզիցիան հաճախ կորցնում է իր թեման մյուսի մեջ: Տարածք թողեք կենտրոնական թեմայի շուրջ կամ ստեղծեք յուրաքանչյուր ձևաչափ առանձին՝ հարմարեցված կոմպոզիցիոն նախադասություններով:
