להחליף חברת הפקה שלמה בתהליך אחד - איך בונים סרטון תדמית בלי צוות ובלי ציוד
סרטון תדמית מקצועי לא חייב חברת הפקה, צוות של שמונה אנשים וציוד ביוקר. הוא כן חייב שלושה דברים - חזון, תסריט בשפה ויזואלית עקבית, ותהליך הפקה מסודר שלוקח אותך צעד-צעד. הסשן הזה פירק את כל הדרך, מהרעיון ועד היוטיוב, על דוגמה אמיתית - סרטון תדמית לאפליקציה שגל בנתה בארבע שעות, ואחר כך פרסומת לדבש שהיא בנתה מול העיניים בחצי שעה.

הערת הכתבת: הסשן הזה מזכיר מודלים וכלים ספציפיים - סורה, קלינג, מינימקס, אידאוגרם, גוגל סטודיו AI (VEO2), OpenAI FM ועוד. כולם עדיין כאן ועובדים, אבל תחום הווידאו ב-AI זז מהר מאוד, וייתכן שחלק מההמלצות הספציפיות התחדדו מאז. המיומנות הנצחית שגל מלמדת לא משתנה - קודם מאפיינים את המטרה, את הטון ואת האורך, ורק אחר כך בוחרים את הכלי לפי התוצאה שרוצים. אל תתאהבו בכלי, תתאהבו בתהליך.
כל מי שאי פעם רצה סרטון לעסק מכיר את הרגע - פונים לחברת הפקה, מקבלים הצעת מחיר, ומגלים שהתוצר הסופי יוצא יותר "חברת ההפקה" ופחות "אתה". גל אפרתי - אשת שיווק דיגיטלי שעובדת המון עם AI - נכנסה לעולם הזה כשהיא ושני חברים ניגשו להקאתון של בייס44, והיא נשלחה להכין סרטון תדמית לאפליקציה שלהם. מהניסוי הזה יצא תהליך מסודר, והיא באה לפרק אותו בפני הקהילה בלי לייפות - זו עבודה, לא קסם.

המסע: 10 תחנות
כל תחנה = מה קרה בסשן + הפרומפט שאורז את זה בשבילכם
מבינים את עולם הפקת וידאו ב-AI
הפתיחה הייתה מפוכחת ומרעננת - חברת הפקה קלאסית זה צוות שלם של תסריטאי, במאי, אנימטור, עורך סאונד ומעצב, ציוד יקר, ומעל הכל - שליטה מוגבלת שלך בתוצר. גל הצביעה על הכאב האמיתי: ככל שמעורבים יותר אנשים קריאייטיביים עם אגו משלהם, כך הסרטון יוצא פחות אתה ויותר הם. AI מציע דרך אחרת, אבל היא הבהירה מיד - זה לא פרומפט אחד ונגמר. כדי שיֵצא טוב צריך שלושה דברים בלבד: חזון, תסריט בשפה ויזואלית עקבית, ותהליך הפקה פשוט של 1-2-3-4 שמישהו לוקח אותך בו ביד.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
אבחון פרויקט הווידאו שלי — חזון, מטרה וקהל
לפני שנוגעים בשום כלי, השלב הראשון הוא אסטרטגיה. מה המטרה של הסרטון? מי קהל היעד? מה הטון ומה האורך? גל הדגישה עד כמה האורך משנה את הכל - סרטון של 30 שניות וסרטון של שתי דקות הם שני תהליכים שונים לחלוטין. הקצר יהיה קליל, עם מעט משחק. הארוך כבד יותר, עם הרבה יותר עבודה. בסרטון שהיא הכינה לאפליקציה, שהוגדר לשתי דקות, יצאו לה 26-27 תמונות לייצר. הרעיון פשוט - כשאתה מגדיר את המטרה נכון מההתחלה, כל שאר ההחלטות מתגלגלות מעצמן.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
כתיבת שתי גרסאות תסריט לבחירה
השלב השני הוא התסריט, וכאן הגיע רעיון יפה - במקום גרסה אחת, מקבלים שתיים. שתי גרסאות מלאות, לפי סצנות, עם תיאור ויזואלי לכל סצנה וקריאה לפעולה בסוף. למה שתיים? כדי שיהיה לך ממה לבחור, ואפילו לשלב. בדוגמת הדבש גל עשתה בדיוק את זה - "אני אוהבת את הוויזואלים של גרסה B אבל את הקריינות של A, תשלב לי". וזה שילב. ואם שתיהן לא מוצאות חן, מבקשים עוד שתיים. אם פספסת פרט בשלב האסטרטגיה, המערכת פשוט שואלת שאלות ובונה לפי התשובות - גמיש לגמרי, אפשר לחזור אחורה.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
בניית Story Board עם פרומפט תמונה ופרומפט תנועה
הסטוריבורד הוא הלב של התהליך - מושג ותיק מעולם ההפקה, שפעם היה לוח עם תמונות ולכל תמונה סצנה. היום זו טבלה: איזו סצנה, מה הפרומפט שלה, איפה מייצרים אותה, ואיך. גל הבהירה שסצנה צריכה להיות משהו קטן - 6-7 סצנות לסרטון של 30 שניות. הקסם כאן שהמערכת מייצרת לך שני פרומפטים נפרדים לכל סצנה: פרומפט לתמונה, ופרומפט נפרד לתנועה. הפרומפט של התנועה שונה - הוא מגדיר תזוזה, לא תוכן. "קבוצה מעורבת של אנשים עומדים בתור" זה פרומפט התמונה. "אנשים זזים מעט, העלים זזים, הרוח נושבת" זה פרומפט התנועה.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
עוגן ויזואלי לדמות ולסגנון עקביים
הבעיה הגדולה ביצירת תמונות ב-AI היא עקביות - איך שומרים על אותה דמות, אותם צבעים, אותה תאורה לאורך כל הסצנות. הפתרון שגל הציגה נקרא עוגן ויזואלי: מייצרים פרומפט אחד שמגדיר את הלוק אנד פיל - הדמות, פלטת הצבעים, התאורה - ומצרפים אותו לכל פרומפט תמונה. בסרטון האפליקציה היה לה "בן", גבר בן 40 פלוס, קצת לא מגולח, בטישרט, בסגנון צהוב ורגשי שנועד להזיל דמעה. יש שתי דרכים - להוסיף את העוגן לכל פרומפט בנפרד, או להגדיר אותו פעם אחת ולבקש היצמדות, "וזה יעבוד עד שזה יפסיק לעבוד" - כי המודל שוכח אחורה.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
בחירת המודלים הנכונים לכל סצנה
בחירת המודל הנכון לכל סצנה היא מיומנות בפני עצמה, וגל נתנה דגשים ממשיים - מבלי להתחייב שיש מודל אחד מנצח. לתמונות ריאליסטיות היא הצביעה על אידאוגרם וסטייבל דיפיוז'ן, ל-Pixar ו-3D על GPT שכבר "למד אותה" אחרי חצי שנה של שימוש. לאנימציה - סורה מנפיש יפה ריאליסטי אבל חלש בתנועות קטנות, קלינג טוב יותר לזה. הדוגמה שהמחישה את הכל: בסרטון של התור, סורה לא הצליחה לתת את התזוזות הקטנטנות של אנשים שעומדים ומשתעממים, אז היא עברה לקלינג - והוא נתן בדיוק את התחושה של "כבר לא בא לי לעמוד פה". ההמלצה שלה - להכיר שניים-שלושה כלים כדי שיהיה מבחר.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
קריינות, סאונד וסנכרון לסרטון
אחרי התמונות והאנימציות מגיע הסאונד, ויש שלושה סוגים: מוזיקת רקע שצריכה להיות נמוכה ולא להפריע, קריינות (voice-over) - מישהו שמדבר מעל התמונה, ודמויות מדברות שדורשות סינכרון שפתיים. גל המליצה בחום, אם בוחרים דמות מדברת, להיצמד לדמות אחת - סנכרון של שתי דמויות בו-זמנית עדיין לא בשל. את הסינכרון עושים בשתי דרכים: חישוב ידני שהמערכת נותנת, או להעלות את הסרטון בלי סאונד ולתת ל-GPT להחזיר בדיוק איפה כל חלק צריך לשבת על ציר הזמן. את ההרכבה הסופית גל עשתה בקנווה - הכל אחד אחרי השני, מוזיקה נמוכה, מעברים, לוגו, ייצוא ל-MP4.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
כתוביות וקריינות בעברית — פתרון בעיות הגייה
כאן נגענו בכאב מקומי אמיתי - עברית. הגייה שגויה, דגש במקום הלא נכון, כתוביות משובשות עם פסיקים ונקודות שקופצות לצד הלא נכון. גל פרסה ארסנל שלם של פתרונות. לקול - גוגל סטודיו AI ו-OpenAI FM עושים עברית מפתיעה, בתנאי שמגדירים להם בפרומפט שהם "voice over actor" (אחרת הם מתחילים להתווכח איתך). למילים בעייתיות - מעבירים בניקוד אוטומטי, או מבקשים מהמודל לנקד "כמו ששומעים ולא כמו שמנקדים", או עושים תעתיק באותיות לטיניות. "בסוף אתה מקבל טקסט שנראה בלאגן גדול בעיניים, אבל הוא מזמר אותו יפה". לכתוביות - הכלי האוטומטי של יוטיוב, קאפקאט או קאפ-קאט.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
אופטימיזציה לפרסום הסרטון ביוטיוב
השלב שאנשים שוכחים - שהסרטון בכלל יימצא. גל קראה לו שלב בונוס, אבל הוא קריטי. אחרי שהעלית ליוטיוב, כותבים תיאור כמו שצריך, מייצרים תמונת קאבר (thumbnail) שמופיעה ליד הסרטון, ומוסיפים תיאור של כ-150 תווים וחמישה האשטגים רלוונטיים. הכל בא כחלק מהתהליך - המערכת נותנת את התיאור, מציעה פרומפט לתמונת הקאבר, ומספקת את ההאשטגים. הרעיון פשוט: הפקה מושלמת שאף אחד לא מוצא היא בזבוז זמן.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
בדיקת זכויות שימוש מסחרי בכלי AI
התחנה האחרונה הפתיעה בחשיבותה - זכויות שימוש מסחרי. גל הזהירה חד וברור: יש כלים שהגרסה החינמית שלהם לא מאפשרת שימוש מסחרי. הדוגמה הכי חדה - סונו. אי אפשר להשתמש במוזיקה מסונו לסרטון מסחרי בלי מנוי בתשלום, הם כותבים שחור על גבי לבן "personal use" בלבד. וזה נכון גם לתמונות - חלק מהכלים נותנים אישור מסחרי וחלק לא. צריך ממש לקרוא את האותיות הקטנות לפני שמעלים משהו מסחרי. כמו שנתנאל אמר - זה סשן שלם של זכויות יוצרים. גם מי שלא רואה את עצמו כאיש אנימציה, כבעל עסק זה כלי שחשוב מאוד שיהיה.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
🎯 מה עושים עם זה עכשיו?
קראת איך זה נעשה. עכשיו קחו את הכלים ותעשו את זה בעצמכם - כל הפרומפטים של הסשן, מוכנים להריץ על העסק שלכם. פלוס ההקלטה המלאה והתמלול.
הצטרפו לאוטוטיוזדיי+· 49 ש״ח בחודשעוד לא בשלים? בואו ללייב הבא בחינם ←רוצים לעבוד על התמלול הנקי?
העתיקו אותו ותעבדו איתו איך שנוח לכם.
🔒 התמלול המלא שמור לחברי אוטוטיוזדיי+. עם המנוי אתם מעתיקים אותו בקליק ועובדים איתו איך שנוח לכם.
לפתוח את התמלול · 49 ש״ח בחודששאלות ששאלתם (וה-AI ישאל גם)
כמה זמן באמת לוקח להפיק סרטון תדמית ב-AI?
בפעם הראשונה, בלי תהליך מסודר, לקח לגל ארבע שעות לסרטון תדמית של שתי דקות. את פרסומת הדבש היא בנתה מול הקהילה בחצי שעה - כי היא ויתרה על קריינות ודיבוב, ששניהם החלק הכי כבד. הכלל שעלה: אחרי שעושים את התהליך פעמיים-שלוש, הזמן מתקצר משמעותית.
מה שלושת הדברים שחייבים כדי שהסרטון יֵצא טוב?
חזון - מה אתה רוצה לעשות. תסריט טוב בשפה ויזואלית עקבית - כדי שכל הסרטון ייראה מהודק. ותהליך הפקה מסודר של צעד-צעד - שיהיה קל לעקוב אחריו בלי לשכוח שלבים ובלי לחזור אחורה.
איך שומרים על אותה דמות ואותו סגנון לאורך כל הסרטון?
באמצעות עוגן ויזואלי - פרומפט אחד שמגדיר את הדמות, פלטת הצבעים והתאורה. אפשר לצרף אותו לכל פרומפט תמונה בנפרד, או להגדיר אותו פעם אחת ולבקש מהמערכת להיצמד אליו. שימו לב שהמודל שוכח אחורה, אז בסצנות רבות עדיף לצרף לכל אחת.
למה כדאי להכיר יותר ממודל אחד ליצירת תמונות ואנימציה?
כי לכל מודל יש חוזקות שונות - חלק חזקים בריאליסטי, חלק באילוסטריישן, חלק בתנועות קטנות. ובנוסף, כמו שגל תיארה, לכלים יש "מצבי רוח" - לפעמים סצנה לא יוצאת טוב, ואז פשוט לוקחים את אותה תמונה ועוברים לכלי אחר. המלצתה: להרגיש בבית עם שניים-שלושה.
מה עושים עם הגייה שגויה של מילים בעברית?
כמה שיטות בשילוב: מעבירים את הטקסט בניקוד אוטומטי ומנקדים במיוחד את המילים הבעייתיות, מבקשים מהמודל לנקד "כמו ששומעים ולא כמו שמנקדים", או עושים תעתיק באותיות לטיניות. לרוב צריך לבדוק כל מילה בעייתית בכמה דרכים עד שהיא נשמעת נכון.
💬 הדיון על הסשן
שאלות, תובנות, מה יישמנו - השרשור של הקהילה.
עוד אין תגובות - תהיו הראשונים לפתוח את הדיון 👇
