LarpGPT · מדריכים
הנחיות שליליות הוסברו: מתי להשתמש בהן וכיצד
מהי הנחיה שלילית, אילו כלי תמונה מתעדים אחד, כיצד פועלים ה---no של Midjourney וה-negative_prompt של Stable Diffusion, ומדוע להשתמש בהם במשורה.

במדריך הזה13
מהי הנחיה שלילית
הנחיה שלילית היא רשימה של דברים שאתה לא רוצה בתמונה שנוצרה, הניתנת לכלי בנפרד מהתיאור של מה שאתה כן רוצה. במקום לכתוב רחוב בלי אנשים, אתה מתאר את הרחוב ומכניס אנשים לרשימה השלילית. הרעיון הוא פשוט, אבל כלים מטפלים בו בצורה שונה מאוד, וחלקם כלל לא מציעים תחום שלילי נפרד. לדעת באיזה מצב אתה נמצא חוסך הרבה ניסיונות כושלים.
מדוע כתיבת לא בתוך ההנחיה נכשלת לעתים קרובות
דגמי תמונה מגיבים למילים הנוכחות בהנחיה. אזכור משהו, אפילו כדי לא לכלול אותו, יכול למשוך אותו לתמונה. התיעוד של Midjourney נותן בדיוק סוג זה של דוגמה כהנחיה גרועה: ציור טבע דומם המתואר כלא פרי, או עם בקשה מנומסת לא להוסיף פירות. החלופה המומלצת היא להעביר את האלמנטים הלא רצויים לפרמטר הייעודי. אותו היגיון חל במקומות אחרים: משפט מלא בהרחקות שומר את הדברים שלא נכללו בתשומת לב המודל.
Midjourney: הפרמטר --no
Midjourney מתעד פרמטר --no, שנוסף בסוף ההנחיה ואחריו הדבר או רשימת הדברים שאינך רוצה, מופרדים בפסיקים. הדוגמה שלו היא "ציור גואש טבע דומם --no פירות, תפוח, אגס". התיעוד גם מסביר ששימוש ב---no זהה למתן משקל של חלק מהנחיה מרובה של מינוס 0.5, וזה תזכורת שימושית שהוא מפחית משהו במקום להבטיח את היעדרו.
המלכודת ב---no של Midjourney
אותו תיעוד מזהיר שההדרכה של Midjourney קוראת כל מילה אחרי --no באופן עצמאי. ביטוי כגון לבוש מודרני נקרא כשתי מילים נפרדות, והמילה לבוש בפני עצמה יכולה להפעיל אזהרה. במקרים כאלה, התיעוד ממליץ לכלול את סוג הלבוש שאתה כן רוצה בהנחיה הראשית במקום להשתמש ב---no. באופן כללי יותר, שמור כל פריט שלא נכלל במילה אחת וחד משמעית איפה שאתה יכול.
Stable Diffusion: הארגומנט negative_prompt
בספריית Hugging Face diffusers, לצינור Stable Diffusion טקסט לתמונה יש ארגומנט negative_prompt אופציונלי, המתואר בתיעוד שלו כהנחיה או הנחיות המנחות מה לא לכלול ביצירת תמונה. התיעוד מוסיף פרט שכדאי לדעת: מתעלמים מההנחיה השלילית כאשר לא נעשה שימוש בהדרכה, כלומר כאשר סולם ההנחיה נמוך מאחד.
דגמי התמונות של ChatGPT ו-OpenAI
תיעוד יצירת התמונות של OpenAI, בזמן כתיבת שורות אלו, אינו מתאר שדה הנחיה שלילי נפרד עבור דגמי ה-GPT Image שלה. עם כלי שיחה אתה עדיין יכול לכתוב אי הכללות במשפט, אבל הגישה הכי אמינה היא זו שעובדת בכל מקום: תאר מה צריך להיות שם. אם אתה לא רוצה אנשים ברחוב, תאר רחוב ריק עם שחר כשהחנויות עדיין סגורות. זה נותן למודל תמונה חיובית לבנות ולא רשימה של דברים שיש להימנע מהם.
תאר קודם את החלופה
לפני שתגיעו לשלילה, שאל מה אתה רוצה במקום האלמנט הלא רצוי. העומס על השולחן הופך לשולחן כתיבה שקוף עם מחברת אחת ומנורה. רקע עמוס הופך לקיר בטון פשוט. צללים קשים הופכים לאור מעונן רך. כמעט לכל שלילי יש גרסה חיובית, והגרסה החיובית בדרך כלל עובדת טוב יותר, כי היא מגבילה את התמונה במקום להשאיר חלל שהמודל ממלא במשהו אחר.
כאשר הנחיה שלילית היא הכלי הנכון
השליליות שימושיות ביותר עבור דברים שנוטים להיראות לא מוזמנים ואין להם היפוך חיובי טבעי: טקסט, אותיות, סימני מים, סמלי לוגו, גבולות או מסגרות. הם גם עוזרים כאשר מחולל ממשיך להוסיף אלמנט חוזר, כגון אנשים בנוף או התלקחות עדשה בשקיעה, לאחר שכבר תיארת את הסצנה בבירור. במקרים אלה הדרה קצרה פשוטה יותר משכתוב את כל הסצנה.
שמור את הרשימה קצרה
רשימות שליליות ארוכות הן הרגל נפוץ המועתק מהנחיות משותפות, לרוב מלאות במילים כלליות על איכות. לעתים רחוקות הם עוזרים ויכולים להקשות על חיזוי התוצאות, מכיוון שכל מילה ברשימה דוחפת את התמונה לכיוון כלשהו. התחל בלי שליליות בכלל. הוסף אחד רק כאשר אלמנט לא רצוי מסוים ממשיך להופיע, בדוק אם הוא עבד והסר אותו שוב אם לא עשה זאת. קל יותר לנמק שניים או שלושה פריטים מדויקים מאשר עשרים פריטים מעורפלים.
השתמש בשמות עצם, לא בתכונות
השליליים עובדים הכי טוב עם דברים קונקרטיים: טקסט, אנשים, מכוניות, עצים, סימן מים. תכונות מופשטות כמו מכוער, גרוע או איכות נמוכה קשה לדוגמנית לפרש, והן לא אומרות דבר על מה אתה בעצם רוצה לשנות. אם תמונה נראית שגויה, חשבו מה לא בסדר בה פיזית, בין אם הידיים, ההשתקפויות או אובייקט נוסף, והתייחסו לכך ישירות, בין אם בתיאור או בהדרה מדויקת.
בדוק שלילי אחד בכל פעם
התייחס לשלילה כמו כל שינוי אחר להנחיה. צור את התמונה בלעדיה, ולאחר מכן הוסף אי הכללה אחת וצור שוב, תוך שמירה על זהות כל השאר. אם האלמנט הלא רצוי נעלם ושום דבר אחר לא נשבר, שמור אותו. אם התמונה משתנה בדרכים שלא ציפיתם, השלילי עשה יותר ממה שהתכוונת. ההרגל הזה גם מלמד אותך לאילו החרגות כדאי לשמור אחר כך ואילו היו אמונות טפלות.
שליליים אינם מחליפים בדיקה
שום הרחקה לא מבטיחה היעדרות. Midjourney מתאר את --no כהפחתה במשקל, ו-diffusers מתאר את negative_prompt כהדרכה. הסתכלו על כל תמונה לפני השימוש בה: טקסט עדיין יכול להופיע על שלטים, צורה דמוית לוגו יכולה להופיע על בגדים, ודמות יכולה להופיע מרחוק. אם ייתכן שתצלם תמונה עבור תמונה אמיתית, תייג אותה כפי שנוצרה.
איפה LarpGPT מתאים
LarpGPT היא ספרייה של הנחיות צילום לנסיעות, ארכיטקטורה, מכוניות וסצנות חיים, שנכתבות בעיקר כתיאורים חיוביים של נושא, קומפוזיציה, תאורה ועדשה, מה שמפחית את הצורך ברשימות שליליות ארוכות. אתה מעתיק הנחיה לתוך מחולל התמונות שאתה כבר משתמש בו ומוסיף את כל החרגות שהכלי תומך בו. LarpGPT אינו יוצר תמונות, והתוצאות משתנות בין הניסיונות.
שאלות
מהי הנחיה שלילית?
רשימה של דברים שאתה לא רוצה בתמונה שנוצרה, ניתנת בנפרד מהתיאור הראשי. Midjourney משתמש בפרמטר --no, ו-Stable Diffusion בספריית diffusers משתמש בארגומנט negative_prompt.
האם ChatGPT תומך בהנחיות שליליות?
תיעוד יצירת התמונה של OpenAI אינו מתאר שדה הנחיה שלילי נפרד בזמן כתיבת שורות אלה. תיאור מה שאתה רוצה במקום, כגון רחוב ריק ולא רחוב ללא אנשים, היא הגישה האמינה יותר.
למה כתיבה בלי משהו מוסיפה לתמונה?
מודלים מגיבים למילים הקיימות בהנחיה, כך שמתן שם לאובייקט, אפילו כדי לא לכלול אותו, יכול להכניס אותו לתמונה. התיעוד של Midjourney מפרט זאת כדפוס הנחיות גרוע וממליץ במקום זאת על הפרמטר --no.
כמה פריטים צריכה להכיל הודעה שלילית?
כמה שפחות. התחל עם אף אחד, הוסף פריט אחד מדויק כאשר אלמנט לא רצוי ממשיך להופיע, והסר אותו אם זה לא עוזר. רשימות גנריות ארוכות מקשות על חיזוי תוצאות.
