כתבתם "מבצע" וקיבלתם "עצבמ", או ג'יבריש שנראה כמו עברית מרחוק. זו לא תקלה ולא משהו שאתם עושים לא נכון. הנה למה זה קורה, ומה הדרך שכן עובדת.
זו אחת התסכולים הכי נפוצים אצל יוצרים ישראלים. מייצרים פוסטר יפהפה, הכל מושלם, ואז מסתכלים על הכיתוב ורואים אותיות עבריות בסדר הפוך, או צירוף אותיות שנראה כמו עברית אבל לא אומר כלום. ואז מנסים שוב. ושוב. וזה לא משתפר.
מודל תמונות לא "כותב" טקסט. הוא מצייר אותו. מבחינתו אות היא צורה ויזואלית, בדיוק כמו עץ או פנים, והוא מנסה לשחזר צורה שהוא ראה בעבר. עכשיו תחשבו כמה מיליארדי תמונות עם טקסט אנגלי הוא ראה באימון, וכמה תמונות עם טקסט עברי. היחס הוא לא פי עשר, הוא בסדרי גודל.
ועל זה מתווספת הבעיה השנייה: עברית נכתבת מימין לשמאל. המודל למד כיוון כתיבה משמאל לימין ממאות מיליוני דוגמאות. גם כשהוא מזהה נכון את האותיות, הוא מסדר אותן בכיוון שהוא מכיר. זו הסיבה שאתם מקבלים מילה נכונה בסדר הפוך.
שווה לדעת: תפסיקו לנסות "לתקן" את זה בפרומפט. אין ניסוח קסם שמכריח מודל תמונות לכתוב עברית נכון, ובקשות כמו "כתוב מימין לשמאל" לא משנות כלום. כל ניסיון נוסף הוא כסף שנשרף על אותה בעיה.
הפתרון האמיתי הוא לא לבקש מהמודל טקסט בכלל. מייצרים תמונה נקייה בלי אף מילה, ומוסיפים את הטקסט אחר כך בשכבה נפרדת, עם פונט אמיתי. זה נשמע כמו פשרה, אבל זה בעצם עדיף בכל פרמטר: הטקסט חד לגמרי, בפונט שבחרתם, בגודל שאתם שולטים בו, וניתן לעריכה מחר בלי לייצר שום דבר מחדש.
אחרי שפתרתם את בעיית הכיוון, נשארת בעיה שנייה שאף אחד לא מדבר עליה: איפה שמים את הטקסט. הרבה מאוד עיצובים נהרסים כי הכיתוב נוחת בדיוק על מה שהופך את התמונה ליפה, בדרך כלל על הפנים.
הכלל אצלנו הוא חד: טקסט לעולם לא על פנים. לא עם רקע שקוף, לא עם צל, לא "רק קצת". פנים הן מה שמושך את העין בתמונה, ומילה שיושבת עליהן מבטלת את שתיהן. יש תמיד מקום אחר: מעל הראש, מתחת לכתפיים, בצד השני של הפריים.
שווה לדעת: אם אין מקום פנוי בתמונה, אל תוסיפו פלטה אפורה מאחורי הטקסט כדי "לפתור" את זה. תייצרו את התמונה מחדש עם יותר אוויר. פלטה מאחורי כיתוב היא הסימן הכי מובהק לעיצוב חובבני.
בווידאו הבעיה חמורה יותר, כי טקסט צריך להישאר יציב לאורך עשרות פריימים, והמנוע מצייר כל פריים מחדש. התוצאה היא אותיות שרוקדות ומשתנות תוך כדי. אז הכלל פשוט עוד יותר: לעולם לא מבקשים טקסט ממנוע וידאו. כתוביות וכיתובים נוספים תמיד בעריכה, ושם גם ממילא יש שליטה מלאה על עיתוי, גודל ותנועה.
עברית לא "נשברת" ב-AI, היא פשוט לא שייכת לשלב הזה בתהליך. תנו למודל לעשות את מה שהוא מדהים בו, את התמונה, ותשאירו את המילים לכלי שנולד בשבילן. התוצאה נראית טוב יותר מכל ניסיון לכפות את שניהם על אותו רגע.
עמוד הבית · בלוג · וידאו AI · תמונות AI · קול AI · כל המנועים · קרדיטים ולא מנוי · AI בעברית · קורס מתחילים · מדריכים