CADABRA AI

איך שומרים על אותה דמות בכל התמונות והסרטונים

זו השאלה שחוזרת יותר מכל אחרת. הדמות יוצאת מושלמת בתמונה הראשונה, ובשנייה זה כבר מישהו אחר. הנה למה זה קורה ומה בדיוק עושים כדי שזה יפסיק.

מייצרים דמות, והיא יוצאת בדיוק כמו שדמיינתם. מייצרים תמונה שנייה שלה בסצנה אחרת, ופתאום זו אישה אחרת לגמרי. אותו תיאור, אותו פרומפט, פנים שונות. זה התסכול הכי נפוץ שיש, וזו גם לא תקלה.

למה מילים לעולם לא יספיקו

תארו לעצמכם שאתם מתארים אדם לצייר בטלפון: "אישה בת שלושים, שיער חום גלי, עיניים ירוקות". כמה מיליוני נשים עונות לתיאור הזה? הצייר יצייר אחת מהן. תתקשרו שוב מחר ותקבלו אחרת. המודל עושה בדיוק את זה, וזה לא משנה כמה תוסיפו פרטים, כי תמיד יישאר טווח.

ולכן הפתרון הוא לא פרומפט טוב יותר. אנשים מבזבזים שבועות על ניסוח, כשהבעיה היא שהם מנסים לתאר פנים במקום להראות אותן. **זהות מגיעה מתמונה, לא מטקסט.**

השלב שרוב האנשים מדלגים עליו: דף דמות

תמונת רפרנס אחת עוזרת. אבל תמונה אחת מראה למודל את הפנים מזווית אחת בלבד, וברגע שהסצנה דורשת פרופיל או שלושת רבעי, הוא צריך להמציא את מה שלא ראה. וכל פעם הוא ימציא קצת אחרת.

דף דמות פותר את זה. מייצרים את אותה דמות מכמה זוויות בבת אחת, חזית, פרופיל, שלושת רבעי, ומשתמשים בכולן כרפרנס. עכשיו למודל יש מבנה תלת ממדי של הפנים במקום ניחוש מזווית אחת, והעקביות קופצת מדרגה שלמה.

  • חזית, פנים ישרות למצלמה, שתי עיניים נראות במלואן
  • שלושת רבעי, הזווית הכי שימושית בפועל כי רוב השוטים נמצאים בה
  • פרופיל צד, שמראה את קו האף והסנטר
  • תאורה אחידה ורכה בכולן. צל חזק על חצי פנים מסתיר בדיוק את מה שהמודל צריך לראות
  • בלי משקפיים, בלי כובע שמסתיר את קו השיער, בלי יד על הפנים

שווה לדעת: שמרו את דף הדמות בתיקייה ותנו לו שם. בעוד חודש, כשתרצו עוד סרטון עם אותה דמות, זה ההבדל בין להמשיך לבין להתחיל מאפס. יוצרים שעובדים עם דמות חוזרת מתייחסים לקובץ הזה כמו לנכס.

הטעות שמבטלת את הרפרנס

העליתם רפרנס, ואז כתבתם בפרומפט "אישה בת שלושים עם שיער חום גלי". בדיוק ביטלתם חלק מהעבודה. המודל מקבל עכשיו שני מקורות מידע על אותן פנים, התמונה והמילים, והמילים פתוחות לפרשנות. הן מושכות את התוצאה חזרה לכיוון הממוצע.

הכלל פשוט: אם העליתם תמונה, אל תתארו את המראה במילים. תארו רק את מה שהתמונה לא יכולה להגיד. מה קורה בסצנה, איפה זה קורה, איך המצלמה זזה, מה התאורה. את הפנים תשאירו לתמונה.

כמה דמויות בפריים אחד

כאן צריך לתייג במפורש. אם מעלים שתי דמויות בלי להגיד למודל מי זו מי, הוא ינחש, וכשהוא מנחש עם שתי דמויות בפריים הוא נוטה למזג ביניהן ולייצר אדם שלישי שלא היה קיים. תיוג מדויק, "התמונה הראשונה היא האישה, השנייה היא הגבר", שווה יותר מכל ניסוח יפה.

ואיך בודקים שזה עובד לפני שמשלמים

לפני שאתם מייצרים שוט ארוך ויקר, ייצרו את אותה דמות בשוט קצר וברזולוציה נמוכה. אם הזהות מחזיקה 5 שניות היא תחזיק גם 10. אם היא כבר נשברת ב-5, שוט ארוך יותר רק יעלה יותר וייכשל חזק יותר. זו הבדיקה שחוסכת הכי הרבה כסף מכל טריק אחר במדריך הזה.

עקביות היא לא פיצ'ר של המודל, היא הרגל עבודה. מי שמכין דף דמות פעם אחת ומפסיק לתאר פנים במילים, פותר את הבעיה לתמיד. מי שממשיך לנסח מחדש, ממשיך לקבל אנשים אחרים.

להמשיך מכאן


עמוד הבית · בלוג · וידאו AI · תמונות AI · קול AI · כל המנועים · קרדיטים ולא מנוי · AI בעברית · קורס מתחילים · מדריכים