LarpGPT · מדריכים
יחסי גובה-רוחב עבור תמונות AI: כיצד לבחור ולהגדיר אותם
ריבוע, 3:2, 16:9 או אנכי 9:16: כיצד לבחור יחס רוחב-גובה לתמונת AI, כיצד הקומפוזיציה משתנה איתה וכיצד Midjourney ו-OpenAI מגדירים אותה.

במדריך הזה14
למה היחס קודם
יחס הגובה-רוחב הוא היחס בין רוחב וגובה של תמונה, כתוב כשני מספרים כגון 3:2 או 16:9. זו ההחלטה הראשונה שצלם מקבל, כי הוא מחליט מה הפריים יכול להחזיק. ביצירת תמונה זה משנה אפילו יותר: הדגם מרכיב את כל הסצנה עבור הפריים שאתה נותן לו, כך ששינוי היחס לאחר מכן פירושו חיתוך או חידוש. בחר אותו לפני שתחדד את שאר ההנחיה.
יחס הוא לא רזולוציה
יחס לא אומר כלום על מספר הפיקסלים. התיעוד של Midjourney מדגיש את הנקודה הזו באופן ישיר: יחס רוחב-גובה אינו זהה לממדים של תמונה, והגודל הסופי תלוי בגרסה ובעלייה. תמונה 3:2 יכולה להיות קטנה או גדולה. החלט את הצורה מהיכן תראה התמונה וכיצד הנושא צריך לשבת בה, ולאחר מכן התמודד עם הרזולוציה כשאלה נפרדת.
ריבוע, 1:1
הריבוע מאוזן וסטטי, ללא כיוון דומיננטי. הוא מתאים לאובייקטים בודדים, קומפוזיציות סימטריות ונושאים ממוקדים, וזו המסגרת שפלטפורמות חברתיות רבות השתמשו בהן זמן רב עבור פוסטים ותמונות פרופיל. זוהי גם ברירת המחדל ב-Midjourney, שהתיעוד שלה מציין שתמונות מתחילות כריבועים. ריבוע אינו מתאים לנופים ולסצנות קבוצתיות, כאשר הנושא מתפשט הצידה באופן טבעי.
תמונה קלאסית, 3:2 ו-2:3
3:2 הוא היחס המסורתי של צילום סטילס, שעבר בירושה מסרט 35 מ"מ, ומצלמות רבות עדיין משתמשות בו. זה מרגיש טבעי להנחיה צילום כי זו הצורה שאנשים מקשרים לצילומים. אופקי 3:2 מתאים לרחובות, פנים ונופים; אנכי 2:3 מתאים לפורטרטים, פתחים ומבנים גבוהים, והתיעוד של Midjourney מזכיר את זה כנפוץ בצילום מודפס ובמסגרות לתמונות.
4:3 ו-5:4
4:3 היה יחס הטלוויזיה המקורי והוא עדיין בשימוש על ידי טאבלטים רבים ועל ידי רוב המצלמות הדיגיטליות הקומפקטיות. הוא מעט מרובע מ-3:2, מה שמשאיר יותר מקום מעל ומתחת לנושא. 5:4 שוב מרובע יותר והוא נפוץ בצילום בפורמט גדול ובינוני ולהדפסות בגודל 8 על 10 אינץ'. שניהם מתאימים לעיצוב פנים וגם לפורטרטים שבהם אתה רוצה מעט מרחב נשימה ללא משיכה אופקית חזקה של פורמט רחב.
מסך רחב, 16:9
16:9 הוא היחס הסטנדרטי לטלוויזיה ווידאו מקוון; מרכז העזרה של YouTube מתאר זאת כיחס רוחב-גובה סטנדרטי במחשב. המסגרת הרחבה שלו מתאימה לנופים, נופים עירוניים, מכוניות בתנועה וסצנות קולנועיות עם נושא מוצב בצד אחד. זוהי בחירה חזקה עבור באנרים, שקופיות מצגות ותמונות ממוזערות של וידאו. הוא חלש יותר עבור דמויות בודדות, שבסופו של דבר קטנות במסגרת רחבה.
אנכי, 9:16
9:16 היא אותה צורה שהופנתה על צידה: המסך המלא של טלפון המוחזק זקוף. התיעוד של Midjourney מתאר אותו כנפוץ עבור תוכן סלולרי במדיה חברתית, ו-YouTube מציין שניתן להציג סרטונים אנכיים ב-9:16 עם ריפוד על מסכי מחשב. זה מתאים לדמויות עומדות, ארכיטקטורה גבוהה, מפלים וכל דבר עם קו אנכי חזק. הלחין עבורו בכוונה; סצנה אופקית שנדחסת ל-9:16 בדרך כלל מאבדת את נושאה לשמים ורצפה ריקים.
איך הקומפוזיציה משתנה עם המסגרת
מסגרת רחבה יותר נותנת יותר מקום להגדרה ולכלל השלישים, כשהנושא לא מרוכז ומקום לעין לנסיעה. מסגרת גבוהה יותר מדגישה את הגובה ומזמינה שכבות מהקדמה לרקע. ציין את המיקום בהנחיה: "המכונית בשליש הימני של המסגרת, הכביש הריק שמוביל פנימה משמאל" נקרא בצורה שונה מאוד ב-16:9 וב-1:1. כאשר אתה משנה את היחס, קרא שוב את משפטי החיבור והתאם אותם.
הגדרת היחס ב-Midjourney
התיעוד של Midjourney מפרט את הפרמטר --ar, או צורתו הארוכה --aspect, שנוסף בסוף ההנחיה עם רווח לפני המקפים, למשל "נמל שקט עם שחר --ar 16:9". המספרים חייבים להיות שלמים: התיעוד אומר שמספרים עשרוניים אינם מקובלים ומציע 139:100 במקום 1.39:1, וגודל פיקסל כגון 1920:1080 מפושט ל-16:9. כמו כן, הוא מציין שיחסים מסוימים משתנים מעט בעת העלאת קנה המידה וכי יחסים רחבים או גבוהים במיוחד הם ניסיוניים.
הגדרת הגודל עם דגמי התמונות של OpenAI
תיעוד יצירת התמונות של OpenAI מתאר את הגודל בפיקסלים ולא כיחס. בזמן כתיבת שורות אלה רשומים 1024x1024 כריבוע, 1536x1024 כנוף ו-1024x1536 לאורך בין הגדלים המומלצים, עם אפשרות אוטומטית. עבור הדגמים החדשים שלו הוא גם מתאר גדלים מותאמים אישית שנכתבו כרוחב לפי גובה, כאשר שני הקצוות חייבים להיות כפולות של 16 והיחס בין הקצוות הארוכים והקצרים חייב להישאר בטווח של 3:1. שימו לב ש-1536x1024 הוא עצמו צורה של 3:2.
Stable Diffusion וכלים אחרים
בספריית Hugging Face diffusers, צינור הטקסט לתמונה Stable Diffusion מקבל ארגומנטים של גובה ורוחב בפיקסלים. העיקרון זהה בכל מקום: תחילה החליטו על הצורה, ואז הגדר את מה שהכלי מבקש, פיקסלים או יחס. כאשר כלי מציע רק כמה גדלים, בחר את הקרוב ביותר וחתוך לאחר מכן, תוך השארת שוליים בקומפוזיציה כדי שהחיתוך לא ייחתך לנושא.
תכנן ליותר מפורמט אחד
אם תמונה תשמש בכמה מקומות, נניח באנר אינטרנט רחב וסיפור אנכי, יצירת תמונה אחת וחיתוך שלה לשני הכיוונים כמעט ולא עובד. או להלחין עם שטח ריק נדיב סביב נושא מרכזי כך ששני היבולים ישרדו, או ליצור כל פורמט בנפרד מאותה הנחיה עם משפטי החיבור מותאמים. האפשרות השנייה נותנת בדרך כלל תוצאות טובות יותר ועולה רק קצת יותר זמן.
דרך מהירה לבחירה
שאל היכן תראה התמונה ואיזו צורה יש לנושא. אובייקט בודד או סצנה סימטרית ממורכזת מתאים לריבוע. צילום שנועד להרגיש כמו צילום מתאים ל-3:2 או 2:3. נוף רחב או מסגרת וידאו מתאימה ל-16:9. תמונת טלפון במסך מלא או נושא גבוה מתאים ל-9:16. כאשר שום דבר לא מצביע בבירור לכיוון אחד, 3:2 הוא נקודת התחלה צילום בטוחה שחותכת היטב לצורות אחרות.
איפה LarpGPT מתאים
LarpGPT היא ספרייה של הנחיות צילום לנסיעות, ארכיטקטורה, מכוניות וסצנות חיים, עם קומפוזיציה כתובה בכל הנחיה לצד נושא, תאורה ועדשה. אתה מעתיק הנחיה, מתאים את המסגור שלה ליחס שאתה צריך, ומגדיר את היחס הזה במחולל התמונות שאתה כבר משתמש בו. LarpGPT אינו יוצר תמונות, והתוצאות משתנות בין הניסיונות.
שאלות
מהו יחס הגובה-רוחב הטוב ביותר עבור תמונות AI?
זה תלוי איפה התמונה תראה ובצורת הנושא. 3:2 הוא ברירת מחדל טבעית של צילום, 16:9 מתאים לסצנות רחבות ווידאו, 9:16 מתאים לתמונות טלפון במסך מלא ו-1:1 מתאים לנושאים במרכז יחיד.
כיצד אוכל לשנות את יחס הגובה-רוחב ב-Midjourney?
הוסף --ar ואחריו שני מספרים שלמים בסוף ההנחיה, למשל --ar 3:2, לפי התיעוד של Midjourney. לא מתקבלים מספרים עשרוניים, וברירת המחדל היא ריבוע.
באילו גדלים תומכים דגמי התמונות של OpenAI?
בזמן כתיבת שורות אלה, התיעוד של OpenAI מפרט 1024x1024, 1536x1024 ו-1024x1536 בין הגדלים המומלצים, בתוספת אפשרות אוטומטית, ומתאר גדלים מותאמים אישית לדגמים חדשים יותר במגבלות מוגדרות.
האם אוכל לחתוך תמונת AI ליחס אחר מאוחר יותר?
אתה יכול, אבל קומפוזיציה שנעשתה לצורה אחת מאבדת לעתים קרובות את הנושא שלה באחרת. השאירו מקום סביב נושא מרכזי, או צור כל פורמט בנפרד עם משפטי החיבור מותאמים.
