CADABRA AI

Seedance 2.5: שלושים שניות בטייק אחד, וחמישים רפרנסים בבקשה אחת

רוב מנועי הוידאו נותנים 5 עד 10 שניות, ואז אתם מחביאים את התפרים בעריכה. Seedance 2.5 מייצר 30 שניות רצופות בטייק אחד, עם סאונד שנולד יחד עם התמונה. הנה מה זה משנה בפועל.

במשך שנתיים כל מנוע וידאו נתן בערך אותו דבר: 5 עד 10 שניות. אז למדנו לעבוד סביב זה. מייצרים שוט קצר, עוד אחד, עוד אחד, ומחביאים את התפרים בעריכה. כל קאט לא היה החלטה של במאי, הוא היה תירוץ. Seedance 2.5 מייצר 30 שניות רצופות בטייק אחד, וזה משנה יותר ממה שנשמע.

למה טייק ארוך הוא לא רק "יותר שניות"

כשמחברים שישה שוטים נפרדים לסרטון אחד, כל מעבר הוא נקודה שבה משהו יכול להשתנות. התאורה קופצת, הגוון זז, הדמות נראית קצת אחרת, הרקע לא ממש אותו רקע. הצופה לא בהכרח יודע להצביע על מה הפריע לו, אבל הוא מרגיש שזה מיוצר.

בטייק אחד ארוך אין נקודות כאלה. הדמות לא יכולה להשתנות באמצע כי אין אמצע. האור לא קופץ כי הוא נבנה פעם אחת. וברגע שהמנוע כבר לא מכתיב לכם איפה לחתוך, כל קאט שכן תעשו הוא בחירה שלכם. זה ההבדל בין להרכיב סרטון לבין לביים אותו.

שווה לדעת: 30 שניות זה לא תמיד הנכון. לרוב הרילס והסטוריז, 10 שניות טובות מנצחות 30 בינוניות, וגם עולות פחות. השתמשו בטייק הארוך כשהסצנה באמת צריכה להתפתח: מישהו נכנס לחדר, מסתכל, מגיב. לא כשרק רוצים "יותר".

חמישים רפרנסים בבקשה אחת

זה החלק שהכי קשה לתפוס עד שמנסים. במצב Omni אפשר להכניס לבקשה אחת עד 30 תמונות, 10 קטעי וידאו ו-10 קבצי אודיו. חמישים רפרנסים ביחד.

המשמעות המעשית: אתם כבר לא מתארים סצנה, אתם מספקים אותה. הדמות הראשית מכמה זוויות, הדמות המשנית, המיקום, התלבושת, המוצר, סרטון קצר שמראה איזו תנועה אתם רוצים, וקובץ קול. המנוע לא מנחש כמעט כלום, הוא מרכיב.

  • תמונות: דמויות, מיקומים, מוצרים, לוקים. זה מה שנועל את הזהות ואת המראה
  • וידאו: מראה למנוע תנועה או סגנון צילום במקום לנסות לתאר אותם במילים
  • אודיו: קול או פסקול שהסצנה תיבנה סביבו
  • וכל אלה יחד באותה בקשה, לא בשלבים נפרדים שצריך לחבר אחר כך

שווה לדעת: יותר רפרנסים זה לא אוטומטית יותר טוב. חמש תמונות נקיות וברורות עדיפות על עשרים תמונות שחלקן מטושטשות או סותרות. רפרנס גרוע לא מתעלמים ממנו, הוא מושך את התוצאה לכיוון הלא נכון.

סאונד שנולד יחד עם התמונה

ברוב הזרימות, קודם מייצרים וידאו ואז מחפשים לו סאונד. התוצאה כמעט תמיד קצת לא מסונכרנת: הצעד נשמע רבע שנייה אחרי שהרגל נגעה ברצפה. כאן האודיו והתמונה נוצרים באותו תהליך, אז מה שקורה בפריים ומה שנשמע הם אותו אירוע.

ארבע דרכים להתחיל

  • מטקסט: כותבים תיאור ומקבלים סצנה. הכי מהיר, והכי פחות שליטה על המראה המדויק
  • מתמונה: מעלים תמונה קיימת והמנוע מזיז אותה. הדרך הטובה ביותר לשלוט בתוצאה
  • פריים ראשון ואחרון: שתי תמונות, והמנוע ממציא את המעבר ביניהן
  • Omni: המצב שבו נכנסים כל הרפרנסים. כאן מביימים באמת

עוד שתי החלטות שנעשות לפני הלחיצה: אורך, מתוך 5, 10, 20 או 30 שניות, ואיכות. יש רמת טיוטה זולה יותר לצד רמת HD מלאה, וזו לא סתם אופציה, זו הדרך הנכונה לעבוד.

סדר העבודה שחוסך הכי הרבה כסף

טייק של 30 שניות באיכות מלאה הוא הדבר היקר ביותר שאפשר לייצר. אז לא מייצרים אותו כדי לבדוק אם הרעיון עובד. מייצרים בטיוטה, קצר, רואים אם הזהות מחזיקה ואם התנועה נכונה, ורק כשהשוט כבר עובד מייצרים אותו מחדש ארוך ובאיכות מלאה.

הכלל שנובע מזה פשוט: אם הזהות נשברת ב-5 שניות היא לא תחזיק ב-30. שוט ארוך יותר לא מתקן בעיה, הוא רק מגדיל אותה ומייקר אותה.

מה עדיין לא לבקש ממנו

טקסט בעברית בתוך הפריים יוצא הפוך או כג'יבריש, כמו בכל מנוע וידאו, כי אותיות מצוירות מחדש בכל פריים. כתוביות מוסיפים בעריכה, ושם ממילא יש שליטה מלאה. וכמו בכל מנוע, ידיים שמבצעות פעולה קטנה ומדויקת עדיין יוצאות מעוותות לפעמים.

ומכאן, המדריך המלא

מה שקראתם כאן הוא התמונה הכללית: מה המנוע יודע ואיך לחשוב עליו. המדריך המלא במועדון קאדאברה יורד לרזולוציה אחרת לגמרי, עם בונה פרומפטים שמרכיב את הסדר הנכון, בונה ביטים לציר הזמן של 30 השניות, מתכנן רפרנסים, ספריית פרומפטים מפורטים להעתקה עם קודי זמן, ושמונה הטעויות שהורגות שוט.

המנוע הפסיק להיות המגבלה. 30 שניות רצופות וחמישים רפרנסים אומרים שכמעט כל מה שלא יוצא טוב הוא כבר החלטה שלכם, לא מגבלה שלו. וזו בשורה טובה, כי החלטות אפשר ללמוד.

להמשיך מכאן


עמוד הבית · בלוג · וידאו AI · תמונות AI · קול AI · כל המנועים · קרדיטים ולא מנוי · AI בעברית · קורס מתחילים · מדריכים