עריכת וידאו עם Gemini Omni 1.1: המדריך המלא

מאת מייטל סלע · עודכן 5.9.2026

Gemini Omni 1.1 Flash: איך מעלים סרטון שצילמתם ומשנים בתוכו דבר אחד, נוסחת העריכה, מה הוא נכשל בו, וכמה זה עולה.

מה תלמדו

  • לצלם סרטון אמיתי ולשנות בתוכו אובייקט אחד בדיוק תוך שמירה על כל השאר
  • לכתוב פרומפט עריכה קצר ומדויק עם משפט נעילה שמונע יצירה מחדש
  • לתכנן מראש את נקודת העריכה כבר בזמן הצילום - 'בימוי ל-AI'
  • לבצע שרשרת של 3-4 תיקונים מבוקרים מבלי לאבד עקביות
  • להאריך סצנה עד 40 שניות רצופות ללא חיתוך באמצעע הארכות מתוכננות
  • לייצר וידאו של 10 שניות מפרומפט בנוי בשש שכבות: מצלמה
  • סגנון
  • תאורה
  • מקום
  • פעולה
  • סאונד
  • לשלב צילום אמיתי עם אלמנטים בלתי אפשריים - כיסא שהופך לאריה
  • מראה שהופכת לנוזל
  • לבדוק רעיונות ב-360p בשליש מהמחיר לפני מעבר ל-1080p או 4K

למי זה מתאים

  • יוצרי תוכן שמצלמים סרטונים ורוצים אפקטים מיוחדים בלי עריכה מקצועית
  • משווקים שצריכים לערוך סרטוני מוצר או הדגמות בעלות נמוכה
  • יוצרים לרשתות חברתיות שרוצים וירליות - צילום רגיל עם טוויסט AI בלתי אפשרי
  • פרילנסרים בוידאו שרוצים להרחיב יכולות ללא צוות או אולפן
  • מורים ומציגים שצריכים הסברים מונפשים או הדגמות ויזואליות

מה אפשר לעשות עם זה בפועל

  • לערוך סרטון שצילמתי: להחליף רהיט בחפץ פנטסטי תוך שמירה על כל התנועה והתאורה
  • להדגים מוצר: להניח פריט על שולחן
  • לצלם
  • ואז לשנות רק את הרקע או התאורה
  • ליצור תוכן ויראלי: לצלם משהו רגיל לחלוטין ואז להפר חוק פיזיקלי אחד אחרי 3 שניות
  • להאריך סצנה קיימת: לקחת שוט של 10 שניות ולהמשיך אותו עד 40 שניות ללא חיתוך
  • להסיר אובייקט מסרטון: למחוק מיקרופון שנכנס לפריים או פריט לא רצוי מהרקע
  • לשנות סגנון של סרטון קיים: להחיל מראה של שנות ה-70 או אנימציה על צילום אמיתי
  • לייצר תמונה מדוברת: להעלות תמונת רפרנס של אדם ולגרום לו לדבר ישר למצלמה
  • לשלב צילום ריאלי עם טרנספורמציות: מראה שהופכת לנוזל ברגע המגע
  • קיר שהופך לזכוכית

רמה: בינוני · זמן משוער: 45 דקות

בקצרה: Gemini Omni 1.1 Flash הוא מנוע הווידאו של גוגל שיצא ב-27 באוגוסט 2026, ובניגוד לרוב המנועים אפשר להעלות אליו סרטון שכבר צילמתם ולבקש לשנות בתוכו דבר אחד — כשכל השאר נשאר. המדריך מלמד את נוסחת העריכה, מה לא לכתוב, מה הוא נכשל בו, כמה זה עולה, ועשרה פרומפטים מלאים להעתקה.

שני פריימים זהים מאותה סצנה: משמאל האישה יושבת על כיסא עץ, מימין הכיסא הוחלף באריה והיא באותה תנוחה בדיוק

המחשה: אותה דמות, אותו חדר, אותו אור — רק הכיסא השתנה. זה כל הרעיון של עריכת וידאו ב-Omni.

מצלמים סרטון, ומבקשים לשנות בתוכו משהו

גוגל הוציאה כלי חדש ליצירת סרטונים, Gemini Omni. יש בו משהו שכמעט לא קיים בכלים אחרים: אפשר להעלות אליו סרטון שכבר צילמתם, ולבקש לשנות בתוכו משהו אחד.

צילמתם את עצמכם יושבים על כיסא? תבקשו שהכיסא יהיה אריה. אתם נשארים אותו דבר, החדר נשאר, האור נשאר, התנועה נשארת. רק הכיסא משתנה. זה כל הרעיון, וכל השאר במדריך הוא איך לעשות את זה נכון: מה לכתוב, מה לא לכתוב, כמה זה עולה, ומה לא לצפות ממנו.

המדריך לא מניח שום ידע מוקדם. כל מילה מקצועית מוסברת במקום שבו היא מופיעה.

🎬 משנה סרטון שצילמתם💬 מבקשים במילים רגילות🔊 הקול יוצא ביחד עם התמונה🎞️ בודקים בזול, מגישים באיכות
מה שצריך לדעת ב-30 שניות
  • מעלים סרטון שצילמתם, כותבים מה לשנות, והשאר נשאר.

  • משנים דבר אחד בכל פעם. שלושה שינויים בבקשה אחת שוברים את הסרטון.

  • כותבים קצר. משפט או שניים. פרומפט ארוך מקלקל דווקא בעריכה.

  • תמיד מסיימים במשפט Keep everything else the same.

  • הסרטון שמעלים הוא עד עשר שניות, וגם מה שיוצא.

  • עברית לא נכנסת לתוך התמונה. כתוביות מוסיפים אחר כך בעריכה.

המדריך נכתב על ידי מייטל סלע מ-Cadabra AI, בשיתוף מועדון פרקטי AI, ב-30 באוגוסט 2026. כל המפרט נלקח מההודעה של גוגל על 1.1, מהתיעוד הרשמי של Gemini API ומדף המודל של Google DeepMind. המספרים בפרק 12 הם ממדידה עצמאית שפורסמה על 22 הרצות. התמונות במדריך הן המחשה שנוצרה במחולל תמונות, ולא פלט של Gemini Omni.

פרק 01 · מה Gemini Omni 1.1 יודע לעשות?

שווה לעשות סדר בשמות. Gemini Omni הוא המודל של Google DeepMind שמקבל טקסט, תמונה, קול ווידאו ומחזיר וידאו עם סאונד. הגרסה הראשונה שלו יצאה כפריוויו במאי, וזו הגרסה שכל הסרטונים והמדריכים ברשת מלמדים. 1.1 Flash הוא משהו אחר: הוא יצא ב-27 באוגוסט 2026, והוא המודל הרשמי והיציב.

כמה המנוע רואה אחורה לפני שהוא ממשיך את השוט
הגרסה הקודמתשנייה אחת
 
 
 
 
 
 
 
 
 
 
1.1 Flashעד עשר שניות
 
 
 
 
 
 
 
 
 
 
זו הסיבה שהדמות, התאורה וקצב המצלמה ממשיכים במקום להתאפס בכל המשך.
מהסטטוסהפרטים
עשר שניות של הקשר במקום שנייה אחתהשינוי המרכזיהמודל הקודם הסתכל אחורה על השנייה האחרונה בלבד לפני שהמשיך שוט. 1.1 קורא עד עשר שניות אחורה, ולכן הדמות, התאורה וקצב המצלמה ממשיכים במקום להתאפס בכל המשך.
הארכת סצנה עד 40 שניותחדשבמודל הקודם לא הייתה הארכה בכלל. עכשיו מוסיפים בקפיצות של עד עשר שניות, עם תקרה מצטברת של 40 שניות. זה מה שהופך שוט של עשר שניות לסצנה שלמה.
פריים ראשון ופריים אחרוןחדששתי תמונות, פתיחה וסיום, והמנוע בונה את כל התנועה ביניהן בשוט אחד רצוף. זה מה שנותן אורביט מלא, מעבר מדויק בין שתי נקודות, ולולאה שנסגרת על עצמה.
מצב טיוטה ב-360pחדשעד 60 אחוז מהר יותר מ-720p ובשליש מהמחיר. זו לא עוד רזולוציה ברשימה, זו מדרגה שנועדה לבדוק אם הרעיון עובד לפני שמשלמים על איכות.
1080p ו-4K להגשהחדשהמודל הקודם עצר ב-720p. 1.1 מעלה רזולוציה עד 4K, ולכן אפשר לעשות את כל הניסויים בזול ולהגיש ביקר רק את מה שעבד.
הוא יצא מפריוויו, והישן נסגרסטטוסהגרסה הקודמת נסגרת ב-30 בספטמבר 2026. מדריך שעדיין מלמד את הגרסה ההיא מלמד מנוע שעוד חודש לא יהיה קיים.

פרק 02 · למה משנים רק דבר אחד בכל פעם?

בכל מנוע אחר, כשמשהו לא מדויק כותבים פרומפט חדש ומקבלים סרטון חדש לגמרי. כאן אומרים מה לשנות, והשאר נשאר.

המנוע שומר את מה שלא ביקשתם לשנות רק אם אתם אומרים לו לשמור. השורה Keep everything else the same בסוף כל הוראה היא ההבדל בין תיקון לבין ייצור מחדש. בלעדיה הוא לוקח את ההוראה כפרומפט חדש, וכל הדמות משתנה.

✕ ככה זה נשבר
Make the lighting warmer, change her coat to red, move the camera lower and add rain.

ארבעה שינויים בבת אחת. בבדיקות, הוראות מרובות שברו את העקביות בערך פי שניים יותר מהוראה בודדת, ואין דרך לדעת איזה מהארבעה עשה את הנזק.

✓ ככה זה עובד
Change the camera to a low angle at knee height. Keep everything else the same.

שינוי אחד, ומשפט שמבקש לא לשנות את השאר בסוף. אם התוצאה טובה, ממשיכים לתיקון הבא על התוצאה החדשה. אם לא, חוזרים תיקון אחורה ומנסים ניסוח אחר. תמיד יודעים מה עשה מה.

⚠️

כל תיקון הוא ייצור חדש
העריכה לא נוגעת בפיקסלים המקוריים — היא מייצרת תוצאה חדשה. אחרי שלוש או ארבע עריכות רצופות התמונה מתחילה להתרכך. זו סיבה מצוינת לתכנן את התיקונים לפני שמתחילים, ולא תוך כדי.

פרק 03 · למה כדאי לצלם בעצמכם?

Don’t generate reality when you can edit it.

אם כבר יש לנו פנים אמיתיות, משחק אמיתי, תנועה אמיתית, תאורה אמיתית ומצלמה אמיתית, לפעמים הדבר הכי חכם הוא לא לבקש מה-AI ליצור אותם שוב. מצלמים את המציאות, ואז נותנים ל-AI לעשות רק את החלק שאי אפשר היה לצלם.

הסיבה שזה עובד היא טכנית לגמרי. וידאו AI צריך לפתור בבת אחת המון דברים: איך האדם נראה, איך הוא הולך, איך הידיים זזות, איך הבגד מתנהג, איך המצלמה זזה, איך החדר בנוי, מאיפה מגיע האור. כשמתחילים מצילום אמיתי, חלק גדול מהמידע הזה כבר נמצא בתוך הווידאו, ולכן אפשר לתת למודל משימה הרבה יותר ממוקדת.

הגישהמה כותבים
לבקש מהמודל להמציא הכלCreate a woman sitting on a lion in a living room.
לצלם אישה על כיסא, ואזReplace the chair with a realistic lion.
Keep everything else the same.

למה דווקא צילום משעמם הוא חומר גלם מעולה?

כי ככל שהצילום מרגיש אמיתי יותר, הטוויסט מרגיש בלתי אפשרי יותר. אישה יושבת בסלון. מישהו פותח מקרר. אדם מחזיק קרטון. מישהו נכנס למעלית. מישהי שותה קפה. לא צריך לצלם סרט הוליוודי, להפך.

💡

היחס שקובע
אם הכל נראה AI, הצופה אומר "יפה, סרטון AI". אם 95 אחוז מהפריים מרגיש אמיתי ורק 5 אחוז ממנו בלתי אפשריים, המוח אומר "רגע, איך לעזאזל עשו את זה?".
עד היום שאלנומעכשיו שואלים
איזה וידאו AI יכול לייצר לי?איזו מציאות אני יכולה לצלם, כדי ש-AI יוכל לעשות איתה משהו שאי אפשר היה לצלם?

פרק 04 · מה מעלים: כלום, תמונה או סרטון?

אלה לא חמישה מנועים: זה אותו מודל, וההבדל הוא מה מצרפים אליו. רוב הכישלונות הם בחירה לא נכונה של מה להעלות, לא פרומפט גרוע.

⚠️

ההבדל שהכי קל לפספס: מקור מול רפרנס
גוגל מבדילה במפורש בין Source Video, הסרטון שאותו עורכים, לבין Video Reference, סרטון שרק מלמד איך דמות, אובייקט או תנועה נראים. אם צילמתם משהו ואתם רוצים לערוך אותו, הוא חייב להיכנס בדרך העריכה כמקור. אם תצרפו אותו כרפרנס, המנוע ילמד ממנו ויבנה שוט חדש, והצילום שלכם לא באמת ייערך.
SOURCE VIDEO
הסרטון שאותו עורכים
הקליפ שצילמתם נכנס לכאן. המנוע שומר את התנועה, האנשים והאורך, ומשנה רק את מה שביקשתם.
← זה מה שצריך כדי לערוך
VIDEO REFERENCE
סרטון שרק מלמד
הקליפ משמש דוגמה לתנועה, לדמות או לסגנון. המנוע לומד ממנו ובונה שוט חדש לגמרי.
← הצילום שלכם לא ייערך
המסלולמה מצרפיםמה חשוב לדעת
t2v — טקסט לוידאופרומפט בלבד, בלי שום קובץ3 עד 10 שניות לבחירתכם. זה המסלול עם הכי מעט שליטה על זהות: אם יש לכם דמות קבועה, אל תתחילו כאן.
i2v — תמונה לוידאותמונה אחת, או שתייםתמונה אחת היא פריים הפתיחה. שתי תמונות הן פתיחה וסיום, והמנוע ממלא את התנועה ביניהן. זו היכולת החדשה של 1.1, והיא מה שנותן אורביט שלם ולולאה סגורה. הסדר קריטי כאן.
r2v — תמונות דוגמה לסרטוןעד 10 תמונות ועד 3 קליפיםלזהות, לסגנון או לתנועה. הסדר לא נושא משמעות. האודיו שבתוך סרטון דוגמה מתעלמים ממנו: הוא מלמד תנועה וזהות, לא קול.
edit — עריכת וידאוקליפ מקור אחד + עד 10 תמונותהתמונות מסבירות לאן לשנות. האורך לא נבחר: התוצאה יוצאת באורך הקליפ שהעליתם, ולכן גם המחיר.
extend — הארכת וידאוקליפ קייםמוסיפים 3 עד 10 שניות בסוף, וחוזרים על זה עד תקרה מצטברת של 40 שניות. רק בסוף: אין הוספה בהתחלה ואין הזרקה באמצע.

פרק 05 · איך משנים משהו בתוך סרטון שצילמתם?

כאן Gemini Omni עושה משהו שמנועים אחרים לא עושים. מעלים קליפ — כל קליפ: משהו שיצרתם במנוע אחר, קטע מסרטון ישן, או צילום גולמי מהטלפון — ואומרים במשפט מה לשנות בתוכו. התוצאה יוצאת באורך המקור, עם אותה תנועת מצלמה ואותם אנשים, ורק הדבר שביקשתם משתנה.

⚠️

החוק החשוב ביותר כאן, והוא הפוך ממה שלמדתם: אל תכתבו מגילה
גוגל עצמה אומרת שבעריכת וידאו פרומפטים פשוטים עובדים טוב יותר, ושפרומפט מפורט מדי גורם למודל לשנות דברים שלא ביקשתם לשנות. זה בדיוק ההפך משש השכבות שבפרק 09, וזו לא סתירה: שש השכבות הן ליצירה, כשהמנוע צריך להמציא עולם. בעריכה הוא כבר רואה את הווידאו, ואין צורך להסביר לו מחדש מה הוא רואה.
✕ לא
In this cinematic photorealistic video of a woman sitting elegantly on a chair inside a beautifully illuminated modern living room, replace the chair beneath her with...
✓ כן
Replace the chair with a realistic lion.
Keep everything else the same.

נוסחת ארבעת החלקים

הפרומפט קצר, אבל כדאי לחשוב עליו בארבע שכבות. רובן שורה אחת, וחלקן לא תמיד נחוצות. השורה האחרונה כן.

 
1
CHANGE — מה בדיוק משתנה
Replace the chair with a realistic lion.
2
ACTION — מה הדבר החדש עושה
The lion remains calmly underneath the seated person.
3
PRESERVE — מה אסור שישתנה
Preserve the person’s identity and original movement.
4
LOCK — משפט הנעילה
Keep everything else the same.

Replace the chair with a realistic lion. The lion remains calmly underneath the seated person. Preserve the person's identity and original movement. Keep everything else the same.

משפט הנעילה בסוף הוא החלק שאסור לוותר עליו. בלעדיו המנוע לוקח את ההוראה כפרומפט חדש ומייצר מחדש במקום לתקן.

 

שבעה סוגי עריכה

 

שבעה סוגי עריכה שכדאי להתחיל לנסות:

סוג העריכהמה זה עושההפרומפט
Object Replacement
החלפת אובייקט
להחליף חפץ אמיתי בחפץ בלתי אפשרי.Replace the coffee mug with a transparent glass orb.
Keep everything else the same.
Object Addition
הוספת אובייקט
להכניס יצור, מוצר או אובייקט שלא היה בצילום.Add a small realistic dragon sleeping on the table.
Keep everything else the same.
Object Removal
הסרת אובייקט
להעלים דברים מתוך הסצנה. שימו לב לניסוח: לא מוחקים, הופכים לבלתי נראה.Make the phone invisible.
Keep everything else the same.
Environment Transformation
שינוי הסביבה
להשאיר את האדם ולשנות את העולם סביבו.Turn the room outside the window into a futuristic Tokyo skyline at night.
Keep the person and the interior unchanged.
Material Transformation
שינוי חומר
להפוך זכוכית למים, עור למתכת, שולחן לקרח, קיר לצמחייה.When I touch the mirror, make its surface ripple like liquid.
Keep everything else the same.
Action Editing
שינוי פעולה
לשנות את מה שקורה בתוך הפעולה המקורית.She opens the box and light pours out of it.
Keep her movement and the camera unchanged.
Reality Breaking
שבירת מציאות
להתחיל מצילום נורמלי לחלוטין ואז להפר חוק פיזיקלי אחד.After 3 seconds, gravity reverses and the papers float upward.
Keep the person and the room unchanged.

שורות השימור, ומתי להוסיף כל אחת

אלה שורות שמצילות עריכה שהתחילה להתפרק, אבל אל תדביקו את כל הרשימה לכל פרומפט. תוסיפו רק את זו שמתאימה לבעיה שראיתם.

השורהמתי להוסיף אותה
Preserve the person’s exact identity.כשהפנים משתנות
Preserve the original body movement.כשהתנועה נשברת
Preserve the original camera motion.כשהמצלמה מתחילה לזוז אחרת
Preserve the lighting.כשהאור קופץ
Preserve the composition.כשכל הסצנה מתחילה לזוז

פרומפט טוב הוא לא הפרומפט הארוך ביותר. הוא הפרומפט שמתקן בדיוק את הבעיה הנוכחית.

 

שש עבודות, בניסוח מלא

 
 
1
01 · החלפת סגנון
פילם משנות השבעים, אנימציה, ווקסלים, ליין ארט. עובד הכי טוב כשנוקבים בשם התקופה או בסוג הפילם, לא באווירה.
Apply a late 1970s New Hollywood look: desaturated warm tones, shallow depth of field, fine grain, practical lamps visible in frame. Keep the subject, the framing and the timing identical.
2
02 · הסרה והחלפה של אובייקט
מיקרופון שנכנס לפריים, בקבוק שהופך למוצר שלכם, שלט שיורד מהרקע. המנוע ממלא את הרקע לאורך כל השוט.
Remove the microphone at the top of the frame and fill the wall behind it. Keep the person, the lighting and the camera move identical.
3
03 · שינוי תאורה
להזיז מקור אור, לשנות שעה ביום, להוסיף מנורה פרקטית. תנקבו במקור ובאיכות שלו, לא במילה כמו דרמטי.
Relight the scene as late golden hour: low warm key from the window on the left, soft falloff, no fill. Keep the subject, the wardrobe and the action identical.
4
04 · זווית וקומפוזיציה
אותה סצנה מזווית אחרת. עובד טוב כשיש הפרדה ברורה בין נושא לרקע ותנועה מתונה, פחות טוב בתנועה מהירה.
Change the camera to an over the shoulder angle from behind her right shoulder, same lens, same distance. Keep the room, the light and the performance identical.
5
05 · טרנספורמציה של חומר
המראה מתאדה כמו נוזל, הקיר הופך לזכוכית, העיר נהיית ווקסלים. היכולת הכי מרשימה כאן, כי הפיזיקה ממשיכה לעבוד תוך כדי.
When her hand touches the mirror, make the mirror surface ripple like liquid mercury, the ripples spreading out from the point of contact. Keep everything else the same.
6
06 · תנועה ואפקט
גשם, אדים, חלקיקים, האטה של רגע אחד. תגידו איפה זה מתחיל ואיפה נגמר, אחרת האפקט משתלט על השוט.
Add light rain starting two seconds in and continuing to the end, with visible droplets on the coat shoulders. Keep the character, the street and the camera move identical.

רצף התיקונים, מוכן להעתקה

שינוי אחד לכל תיקון, לפי הסדר שתריצו. שימו לב שבתיקון השלישי נשתל משפט שמזכיר מה לא לשנות — שם ההתקלקלות מתחילה להצטבר. התיקון הרביעי הוא הגבול: הוא עדיין עובד, אבל אם צריך יותר, עדיף לייצר את השוט מחדש עם כל מה שלמדתם בשרשרת.

Turn 1: Apply a late 1970s New Hollywood look: desaturated warm tones, fine grain, practical lamps visible in frame. Keep everything else the same. Turn 2: Relight so the key comes from the lamp on the left and the right side of the face falls into shadow. Keep everything else the same. Turn 3: Keep the character, the wardrobe, the room and the lighting exactly as they are now. Remove the poster on the back wall and fill the wall behind it. Keep everything else the same.

מה דרך העריכה לא תעשה

לכתוב מחדש דיאלוג שכבר נאמר בקליפ שהעליתם. גוגל חוסמת את זה במפורש.
לשנות את אורך הקליפ. התוצאה יוצאת באורך המקור.
להסתכל על שני קליפים ולהשוות ביניהם באותה בקשה. הוא מנמק על קליפ אחד בכל פעם.
להחליף טיימליין. זה לא עורך וידאו: אין חיתוכים, אין רצועות, אין מיקס.
לצרף קובץ אודיו משלכם. אין קלט אודיו בכלל.
לשנות גיל של פנים או לכלול שם מותג מוכר. שניהם נחסמים לעיתים קרובות בלי אזהרה מראש.

פרק 06 · איך חושבים על השינוי כבר בזמן הצילום?

💡

הטיפ הכי חשוב במדריך
אל תצלמו קודם ואז תשאלו "מה אפשר לעשות עם זה". תכננו מראש את נקודת העריכה. אנחנו עדיין מצלמים וידאו אמיתי, אבל אנחנו כבר חושבים על השכבה הגנרטיבית שתגיע אחריו. זו מיומנות חדשה, ואפשר לקרוא לה בימוי ל-AI.

מה זה אומר כשהמצלמה ביד

  • אם אתם רוצים שהכיסא יהפוך לאריה, צלמו ישיבה שמאפשרת למודל להבין היטב את הגוף ואת הכיסא.
  • אם אתם רוצים שהכוס תהפוך למשהו אחר, ודאו שהכוס נראית בבירור.
  • אם משהו אמור להיכנס דרך דלת, תנו לדלת מספיק זמן בפריים.
  • אם רוצים שהמראה תשתנה, אל תסתירו אותה כל הזמן עם הגוף.
  • צלמו קצר. עד עשר שניות נכנסות לעריכה, אז אין טעם בטייק של דקה.

סדר העבודה, מהמצלמה עד הקובץ הסופי

 
1
מצלמים
שוט אמיתי קצר שמתוכנן מראש לעריכת AI.
2
בוחרים
אלמנט אחד מרכזי שאותו רוצים לשנות.
3
מעלים
את הסרטון כווידאו המקור, לא כרפרנס.
4
כותבים
הוראת עריכה פשוטה מאוד.
5
נועלים
מגדירים מה חייב להישאר ללא שינוי.
6
בודקים
את התוצאה.
7
מתקנים בשיחה
במקום להתחיל מחדש, ממשיכים ומתקנים רק את מה שלא עבד.
8
מגישים
רק כשהעריכה טובה עוברים לרזולוציה הסופית ולעריכת הסרט כולו.

פרק 07 · איך אומרים לו מתי בדיוק משהו קורה?

המנוע מבין הוראות זמן בשפה טבעית, וגם קודי זמן. זה נשמע טכני וזה בעצם הכלי הדרמטי הכי חזק שיש כאן: הוא מאפשר להתחיל במציאות נורמלית לגמרי, ורק אחרי כמה שניות להכניס את הצופה לעולם בלתי אפשרי. שוט שמתחיל מוזר הוא שוט AI. שוט שנהיה מוזר בשנייה השלישית הוא טריק.

בשפה טבעית
After 3 seconds, the mirror begins to ripple.
At 5 seconds the lights suddenly flicker.

[0-3s] Everything remains normal. [3-6s] The mirror begins to ripple. [6-10s] A hand slowly emerges from the mirror. Keep everything else the same.

שלושה פריימים מאותו שוט: מראה רגילה, מראה שמתחילה להתנוזל, ויד שיוצאת מתוכה

המחשה: שלושה רגעים מתוך שוט אחד של עשר שניות. השוט מתחיל נורמלי לגמרי, וההפרה נכנסת רק בשנייה השלישית.
המבנה שעובד
  • שניות ראשונות: כלום לא קורה, והצופה מקבל את הצילום כאמיתי.

  • אחר כך: הפרה אחת של חוק פיזיקלי.

  • בסוף: התוצאה של אותה הפרה.

  • עשר שניות מספיקות לשלושת השלבים, ושלושתם באותה הרצה.

פרק 08 · איך מאריכים סרטון שנגמר מוקדם?

בגרסה הקודמת הארכה פשוט לא הייתה. מוסיפים 3 עד 10 שניות בסוף קליפ קיים, וחוזרים על זה עד תקרה מצטברת של 40 שניות. זו הדרך היחידה לעבור את מגבלת עשר השניות בלי חיתוך אחד: שוט של עשר שניות שמוארך שלוש פעמים הוא סצנה שלמה של 40 שניות רצופות. וזה עובד דווקא עכשיו כי המנוע קורא עשר שניות אחורה, לא שנייה.

10 שנ׳
הקליפ המקורי
10 שנ׳
הארכה 1
10 שנ׳
הארכה 2
10 שנ׳
הארכה 3
 

תקרה מצטברת: 40 שניות

 
כל הארכה מוסיפה 3 עד 10 שניות בסוף בלבד, בלי חיתוך אחד. אין הוספה בהתחלה ואין הזרקה באמצע.
עובדלא עובד
להמשיך תנועת מצלמה שכבר רצה, באותה מהירות ובאותה עדשה.להוסיף שניות בהתחלה. אין הוספה לפני.
לתת לפעולה להסתיים: הדמות מסיימת את הסיבוב, החפץ נוחת, הדלת נסגרת.להזריק שוט באמצע.
להכניס דמות או חפץ חדש להמשך, בעזרת תמונת דוגמה.לעבור את 40 השניות המצטברות. זו תקרה של המודל.
לחזור על ההארכה עד 40 שניות מצטברות.להוסיף דיאלוג להמשך של קליפ שכבר יש בו דיבור.

הדבר המעניין בהארכה הוא לא האורך. צילמתי את עצמי פותחת דלת במשך שבע שניות, שם הסרטון האמיתי נגמר, ואני מבקשת Continue the scene. Behind the door is a vast magical forest. הווידאו מתחיל בעולם שצילמנו באמת, וממשיך לתוך עולם שמעולם לא צולם.

Continue the same camera move at the same speed with no cut and no change of lens. [what finishes]. Same lighting, same grade, same grain. Audio: continue the same ambience, add [one new sound] at the very end. No music. No text.

⚠️

שלוש המילים שאסור להשמיט
שימו לב ל-same grade, same grain. בלעדיהן ההמשך יוצא נקי יותר מהמקור, וזה נראה כמו חיתוך — בדיוק מה שניסיתם למנוע.

פרק 09 · איך כותבים בקשה לסרטון חדש?

גוגל מפרסמת מסגרת של חמישה רכיבים, ולמעשה יש שישה כי הסאונד חייב שכבה משלו. איכות התוצאה תלויה במבנה הרבה יותר מבאורך. חשוב מכל: מצלמה תמיד ראשונה, כי היא קובעת את כל הדקדוק החזותי שאחריה.

 
1
שכבה 1 — מסגור ותנועה
איפה המצלמה, כמה קרוב, ולאן היא זזה.
Medium tracking shot at shoulder height, camera follows from behind
2
שכבה 2 — סגנון
תקופה, סוג פילם, ז’אנר או במאי. לא "קולנועי", אלא משהו שאפשר להצביע עליו.
1990s Hong Kong noir, desaturated blues, 35mm grain
3
שכבה 3 — תאורה
מה מקור האור ואיזה אופי יש לו.
One streetlamp overhead, rain making halos in the beam
4
שכבה 4 — מקום
ביטוי קצר שמפעיל את הידע של המודל על העולם. שתי מילים מספיקות.
A narrow market street, vendors closing up
5
שכבה 5 — פעולה
החלק הכי מפורט. מה קורה, בסדר, ומה גורם למה.
She walks fast, glances over her shoulder, then slows at the corner
6
שכבה 6 — סאונד וטקסט
מה נשמע ומה כתוב על המסך. בלי השכבה הזו המנוע ממציא פסקול.
Rain on canvas awnings, her heels on wet stone, no music. No text

שימו לב: לפני שכבת הקול מוסיפים את המילה Audio: — כך המנוע קורא אותה נכון. ובאנגלית תמיד, זו השפה היחידה שגוגל בדקה. ככה נראית התבנית כשהיא מורכבת:

Medium tracking shot at shoulder height, camera follows from behind. Documentary, available light, fine 35mm grain. One practical lamp in frame on the left, the rest falls into shadow. A narrow market street at night, vendors closing up. She walks fast, glances over her shoulder at the fourth second, then slows at the corner. Audio: Rain on canvas awnings, her heels on wet stone. No music. No text on screen.

פרק 10 · אילו מילים הוא מבין הכי טוב?

מילים כמו oner, locked off, push in, dolly zoom ו-orbit מתפקדות כפקודות טכניות והמנוע מציית להן במדויק. לעומת זאת "אווירתי", "דרמטי" ו"קולנועי" נותנים תוצאה אחרת בכל הרצה, כי אין להם משמעות מדידה. במקום "תאורה דרמטית" תכתבו "מנורה פרקטית אחת משמאל, כל השאר בצל".

קטגוריההמילים שעובדות
מסגורextreme wide / establishing · wide shot · medium shot · close-up · extreme close-up · over-the-shoulder · POV · two shot · low angle · high angle · dutch angle
תנועת מצלמהoner · locked off / static · push in · pull back · dolly zoom · orbit / arc · tracking shot · tilt up / down · pan left / right · crane up · handheld · rack focus
תאורהgolden hour, low warm key · single practical lamp in frame · hard sunlight, sharp shadows · overcast soft light · backlit, rim light · neon spill from off screen · firelight flicker · window light from the left · moonlight, cool blue
סגנון1970s New Hollywood · Kodak Portra tones, fine grain · documentary, available light · anime cel shading · stop motion clay · watercolour illustration · minimalist vector · VHS, scan lines · 3D voxel art · macro product studio
✕ חלש
A woman walking in a city at night, moody and cinematic.
✓ חזק
Medium tracking shot, camera follows at shoulder height. 1990s Hong Kong noir, desaturated blues. One streetlamp overhead, rain making halos in the light. A narrow market street, vendors closing up. A woman in her thirties in a long coat walks fast, checking over her shoulder. No text.

פרק 11 · איך מביימים קול, מוזיקה ודיבור?

הקול נוצר יחד עם התמונה, באותו מעבר, בלי תוספת מחיר ובלי מתג. זה יתרון עצום ומלכודת באותה מידה: אם לא כתבתם מה נשמע, המנוע ימציא פסקול, ובדרך כלל יהיה שם מלמול לא ברור או מוזיקה גנרית שלא ביקשתם.

דיאלוג — התחביר המדויק

תנקבו במי מדבר, איך, ומה בדיוק נאמר בין מרכאות. המנוע מייצר את הקול, את תנועת השפתיים ואת המיקום בזמן בבת אחת.

התחביר
She says quietly, looking away from the lens: "I should not have come back."

💡

תקציב מילים
עשר שניות נושאות בערך 25 עד 30 מילים בקצב טבעי. יותר מזה, והמנוע דוחס והדיבור נשמע מהיר ולא טבעי.

סנכרון לאירוע — הטריק הכי לא מנוצל

אפשר לבקש שאירוע חזותי ואירוע קולי יקרו יחד, והמנוע מבצע. הסנכרון שנמדד עומד סביב 200 מילישניות, מספיק טוב לרשתות ולפרסומת קצרה.

סנכרון
Apartment windows light up one by one, each in time with a piano note.
Each metal letter lands with a deep thud as it hits the table.
מוזיקה — חלשמוזיקה — חזק
Cinematic emotional score.A single low cello note that builds over five seconds, then cuts to silence.

שלוש מגבלות אודיו שחייבים להכיר:

אין קלט אודיו. אי אפשר לצרף קובץ קול משלכם. הקול נוצר, לא מולבש.
האודיו בתוך סרטון דוגמה מתעלמים ממנו.
אי אפשר להוסיף דיאלוג לקליפ שהעליתם שכבר יש בו דיבור.

פרק 12 · כמה פעמים אפשר לתקן, ומה הוא נכשל בו?

גוגל לא פרסמה תקרה לשיחה, אבל בבדיקה עצמאית על 22 הרצות היא נמדדה: ארבעת התיקונים הראשונים שמרו על הסצנה, ובתיקון החמישי התנועה התחילה לזוז לבד והדמות הפסיקה להיות אותה דמות. זה חזר בשלוש הרצות נפרדות. שתילת משפט עוגן בתיקון השלישי האריכה את היציבות בתיקון אחד בשניים משלושה ניסיונות. זמן הייצור הממוצע שם היה 48 שניות, המהיר ביותר 31 והאיטי ביותר דקה ו-24.

התיקוןמה קורה
1יצירה
2סגנון
3תאורה
4זווית — זה הגבול
5התקלקלות: התנועה זזה לבד והדמות מפסיקה להיות אותה דמות

משפט העוגן, להעתקה:

Keep the character, the wardrobe, the room and the lighting exactly as they are now. Change only [the one thing].

חמישה פורטרטים של אותה אישה בשורה: ארבעה הראשונים זהים, בחמישי הפנים, התאורה והבגד השתנו

המחשה: ארבעת התיקונים הראשונים שומרים על הדמות. בחמישי היא כבר לא אותה דמות.

מה נמדד שהוא נכשל בו

🔤
טקסט לא לטיני נשבר
באנגלית הכתב יוצא נקי, כולל כל 26 האותיות בשלט או בכותרת תחתונה. ביפנית נמדד כשל של 76 אחוז בהיראגנה, ובסינית התווים הצפופים נשברו בכל ההרצות. אותה משפחת בעיה חלה על עברית.
🎱
יותר משלושה אובייקטים נעים
מעקב אמין אחרי אחד עד שניים, סביר בשלושה, לא אמין בארבעה ומעלה. בבדיקה עם ארבע גולות שתיים התמזגו ואחת יצאה מהפריים.
🚫
הוראות שלילה מצייתות ב-80 אחוז
משפט כמו "בלי טקסט" או "בלי מוזיקה" עובד ברוב הפעמים, לא בכולן. תכתבו אותו בכל זאת, ותבדקו את התוצאה.
🏷️
שמות מותג וגיל של פנים נחסמים
אזכור מותג מוכר, או בקשה להזקין דמות בעשר שנים, נחסמו בלי דרך לחזות את זה מראש. אין הודעה מקדימה, יש רק כישלון.
💥
תנועה כאוטית מתפרקת
פיזיקה בסיסית עובדת מצוין, אבל תנועה מהירה ומורכבת עם הרבה גופים מפרקת את הייצור. תכתבו שרשרת סיבה ותוצאה, לא בלגן.
🔁
כל תיקון הוא ייצור מחדש
עריכה לא נוגעת בפיקסלים המקוריים, היא מייצרת תוצאה חדשה. אחרי שלוש או ארבע עריכות רצופות התמונה מתרככת.
ומה כן עבד באותה בדיקה
  • עריכה בשיחה עד ארבעה תיקונים: הדמות נשארה עקבית לאורך שינוי סביבה, העלמת חפץ ושינוי זווית.

  • טרנספורמציות של חומר: מראה שהופכת לנוזל עבדה בהרצה ראשונה.

  • פיזיקה של גוף אחד: גולה על מסלול, כבידה ותנופה יצאו משכנעות.

  • סקיצה לצילום ריאליסטי: use the drawing only as a guide for movement עבד, והציור עצמו לא הופיע בתוצאה.

  • טקסט באנגלית: כותרות תחתונות עם כל 26 האותיות יצאו קריאות ונקיות.

פרק 13 · מה עובד בעברית ומה לא?

זה החלק שאף מדריך באנגלית לא יכתוב לכם. גוגל כותבת במפורש שאנגלית נתמכת במלואה ושפות אחרות לא נבדקו. זה לא אומר שעברית אסורה, זה אומר שאין שום התחייבות, ובפועל זה נראה בדיוק כמו שנמדד ביפנית ובסינית: כתב לא לטיני נשבר.

שני שלטים על קיר: העליון עם אותיות עבריות מעוותות ובלתי קריאות, התחתון עם טקסט אנגלי נקי וברור

המחשה: כתב לא לטיני יוצא שבור, בעוד אותיות לטיניות באותו פריים נשארות קריאות.

אל תעשו:

לכתוב את הפרומפט בעברית. תרגמו לאנגלית, תמיד.
לבקש טקסט עברי על המסך: שלט, כותרת תחתונה או לוגו. האותיות ייצאו מעוותות.
לסמוך על דיבור עברי. אין שום התחייבות לגבי מבטא, הגייה או משקל.
כן תעשו
  • תייצרו את השוט בלי טקסט, ותוסיפו כתוביות עברית בעריכה. שם הן יוצאות מושלמות.

  • לדיבור עברי אמיתי: תקליטו קול קודם, ואז ליפסינק על התוצאה. זה הסדר שעובד.

  • תכתבו בפרומפט No text on screen במפורש. זה מוריד הרבה שלטים מומצאים ברקע.

  • אם חייבים טקסט בתוך הפריים, תבקשו אותו באנגלית: שם המנוע מדויק.

שורה תחתונה: להשתמש ב-Gemini Omni בשביל התמונה, התנועה והאווירה, ולהשאיר את העברית לשלב העריכה. אם אתם עובדים הרבה עם עברית בכלי AI, שווה לראות גם את המדריך לתיקון בעיות עברית ב-ChatGPT.

פרק 14 · כמה זה עולה?

פרמטרמה אפשר
אורך3 עד 10 שניות בהרצה אחת. הארכה מוסיפה עוד 3 עד 10 בכל פעם, עד תקרה מצטברת של 40 שניות.
רזולוציה360p · 720p · 1080p · 4K
יחסי מסךauto, 16:9, 9:16. בעריכה ובהארכה חייב auto: היחס נשמר מהמקור.
סאונדדיבור, מוזיקה ואפקטים בכל דרך, ללא תוספת מחיר. אין קלט אודיו.
רפרנסיםעד 10 תמונות. עד 3 קליפים כשמעלים תמונות דוגמה, כל אחד עד 10 שניות.
קליפ מקורעד 30 שניות ב-360p וב-720p, עד 20 ב-1080p, עד 10 ב-4K.

טבלת הקרדיטים ביצירה חדשה

המחירים בקרדיטים של Cadabra AI. תמונות דוגמה וקליפים נספרים בנוסף ומוסיפים מעט. בעריכה אין בחירת אורך: המחיר נגזר מאורך הקליפ שהעליתם, והאורך נמדד מהקובץ עצמו.

שניות360p720p1080p4K
3s24510
4s25713
5s26816
6s371019
7s381122
8s391325
9s4101428
10s4111631

💡

המדרגה שחוסכת הכי הרבה
מצב הטיוטה ב-360p עולה בערך שליש מ-720p ורץ עד 60 אחוז מהר יותר. שוט של 10 שניות ב-360p הוא 4 קרדיטים, מול 31 ב-4K. תבדקו שם שהרעיון עובד, ורק אז תעלו רזולוציה.

פרק 15 · אילו עשר טעויות חוזרות אצל כולם?

לשנות שלושה דברים בתיקון אחד. הוראות מרובות שברו את העקביות בערך פי שניים יותר מהוראה בודדת. דבר אחד, תיקון אחד. אם חייבים שניים, תמספרו אותם.
לשכוח את משפט הנעילה. בלי Keep everything else the same בסוף, המנוע מייצר מחדש במקום לתקן.
לכתוב מצב רוח במקום בימוי. "אווירתי ומסתורי" נותן תוצאה אחרת בכל הרצה. "מנורה פרקטית אחת, כל השאר בצל" נותן את אותה תוצאה כל פעם.
לא לכתוב סאונד בכלל. שדה ריק לא נותן שקט, הוא נותן ניחוש.
להעלות קליפ ארוך לעריכה בלי לבדוק מחיר. בעריכה המחיר הולך לפי אורך המקור.
להתחיל ב-4K. מצב הטיוטה ב-360p קיים בדיוק בשביל לבדוק שהרעיון עובד, בשליש מהמחיר ובעד 60 אחוז פחות זמן.
להכניס רפרנס חדש באמצע שרשרת. זה פירק את הסצנה באופן עקבי בבדיקות.
לצפות שהוא יערוך דיאלוג קיים. חסום. תייצרו את השוט מחדש עם הדיאלוג הנכון.
לתאר במילים דמות שכבר נתתם כרפרנס. שני מקורות אמת נותנים ממוצע.
לתכנן שבעה תיקונים. בתיקון החמישי מתחילה התקלקלות. תכננו שלושה.

פרק 16 · ספריית פרומפטים מוכנים

עשרה פרומפטים, כל אחד בנוי בשש השכבות מפרק 09 ובאנגלית, כי זו השפה היחידה שנתמכת במלואה. לכל אחד רשום גם המסלול, הרזולוציה והאורך שבהם הוא נבדק.

 

מוצר על שולחן, אונר של שמונה שניות

 

מוצר על שולחן, אונר של שמונה שניות

טקסט לוידאו1080p8 שניות

One continuous shot, no cuts. Camera orbits slowly around a matte black skincare bottle standing on a wet slate slab, completing a half circle over six seconds, then pushes in on the cap for the last two. Macro product studio style, clean, no props. Single soft key from above left with a long falloff, one hard rim from the right edge. A dark studio, seamless charcoal backdrop. Water beads slide down the glass as the camera moves. Audio: low room tone and the faint sound of a single water drop landing at the moment the push in starts. No music. No text on screen.

 

רחוב בלילה, מעקב מאחור

 

רחוב בלילה, מעקב מאחור

טקסט לוידאו1080p10 שניות

Medium tracking shot at shoulder height, camera follows from behind and never overtakes. 1990s Hong Kong noir, desaturated blues, 35mm grain. One streetlamp overhead, rain making halos in the beam, no fill. A narrow market street, vendors closing their stalls. A woman in her thirties in a long coat walks fast, glances over her right shoulder at the fourth second, then slows at the corner and stops. Audio: rain on canvas awnings, her heels on wet stone, a shutter rolling down somewhere behind. No music. No text.

 

תמונה אחת שמתחילה לזוז

 

תמונה אחת שמתחילה לזוז

תמונה לוידאו720p5 שניות

Hold the framing of the reference exactly. The only movement is a slow push in of about ten percent over five seconds, and the subject breathing. Wind moves a single strand of hair. Nothing else in the frame moves. Audio: quiet outdoor ambience, distant traffic, no music. No text.

 

פריים ראשון ואחרון, אורביט שנסגר

 

פריים ראשון ואחרון, אורביט שנסגר

תמונה לוידאו1080p6 שניות

Travel from the first frame to the last frame as one continuous camera move with no cut. The camera arcs a full half circle around the subject and lands exactly on the framing of the last image. The subject stays in the same position throughout and only turns their head toward the window at the very end. Even pacing, no acceleration in the last second. Audio: room tone, one chair creak as the head turns. No music. No text.

 

אותה דמות בסצנה חדשה

 

אותה דמות בסצנה חדשה

תמונות דוגמה לסרטון1080p8 שניות

The person in the reference images, unchanged: same face, same hair, same jacket. Medium shot, locked off camera at eye level. Documentary style, available light. Late afternoon sun through a window on the right, soft bounce from a white wall on the left. A small kitchen, morning dishes still on the counter. She sets a cup down, sits, looks straight at the lens and gives a short nod. Audio: the cup meeting the table, a fridge hum, no music. No text.

 

דמות מדברת למצלמה

 

דמות מדברת למצלמה

תמונות דוגמה לסרטון1080p8 שניות

The person in the reference images, unchanged. Medium close-up, locked off, eye level, 50mm feel. Clean documentary look, no grade. Soft window light from camera left, gentle fill from the right. A plain office wall behind, slightly out of focus. He looks straight at the lens and says warmly: "I built this in one afternoon, and it still surprises me." He pauses, then smiles. Audio: his voice close and dry, faint room tone, no music. No text.

 

ניקוי פריים: להעיף מה שלא צריך

 

ניקוי פריים: להעיף מה שלא צריך

עריכת וידאו1080p5 שניות

Remove the microphone entering from the top of the frame and the power cable on the floor, and fill the wall and floor behind them so they match the surrounding surfaces across the whole shot. Keep the person, the wardrobe, the lighting, the camera move and the timing identical.

 

טרנספורמציה של חומר

 

טרנספורמציה של חומר

עריכת וידאו1080p6 שניות

At the moment her fingertips touch the mirror, make the mirror surface ripple outward like liquid mercury, the rings spreading from the point of contact and settling by the end of the shot. Her reflection distorts with the ripples. Keep her, the room, the lighting and the camera identical. Audio: add a low resonant tone that rises as the ripples spread. Keep the existing ambience.

 

הארכה שממשיכה תנועה

 

הארכה שממשיכה תנועה

הארכת וידאו720p5 שניות

Continue the same camera move at the same speed with no cut and no change of lens. The subject completes the turn they started, takes two more steps away from camera and stops at the doorway. Same lighting, same grade, same grain. Audio: continue the same ambience, add two footsteps and a door handle turning at the very end. No music. No text.

 

הסבר מונפש, חומר אחד

 

הסבר מונפש, חומר אחד

טקסט לוידאו720p10 שניות

Locked off camera, straight on, no movement. Stop motion clay style, everything in the frame is made of clay including the labels. Flat even studio light from the front, soft shadows underneath. A plain cream backdrop. A clay ribbon folds itself into a compact shape step by step, one fold per beat, and holds still at the end. Audio: soft clay squeeze sounds on every fold, a calm voice says: "This is how a protein finds its shape." No music. No text on screen other than the clay labels.

פרק 17 · מה סדר העבודה הנכון?

 
1
בודקים בזול
את הרעיון ב-360p וחמש שניות. שליש מהמחיר, עד 60 אחוז מהר יותר, ומספיק כדי לדעת אם זה עובד.
2
מעלים רזולוציה
כשהתנועה נכונה, מריצים את אותו פרומפט בדיוק ב-720p או 1080p.
3
עוברים לעריכה
מורידים את התוצאה, מעלים אותה בדרך של עריכה, ומשנים דבר אחד עם משפט הנעילה.
4
עוצרים בזמן
עד שלושה או ארבעה תיקונים. אם עדיין לא שם, מייצרים מחדש עם מה שלמדתם.
5
מאריכים במקום לחתוך
צריך יותר מעשר שניות? מאריכים, עד 40 שניות מצטברות.
6
עברית בעריכה
כתוביות עברית, קריינות ומוזיקה: בעורך הווידאו, לא במנוע.

שאלות נפוצות

אפשר לכתוב את הפרומפט בעברית?

אפשר, אבל אין שום התחייבות שזה יעבוד. גוגל כותבת במפורש שרק אנגלית נתמכת במלואה, ושאר השפות לא נבדקו. תרגמו לאנגלית תמיד — הדרך הנוחה היא לתאר את הסצנה בעברית ל-ChatGPT או ל-Claude, לבקש להמיר אותה לשש השכבות שבפרק 09, ולהדביק את התוצאה.

אפשר לשים כתוביות בעברית על הסרטון?

לא מתוך המנוע. כתב לא לטיני נשבר — ביפנית נמדד כשל של 76 אחוז, ובסינית בכל ההרצות, ואותה בעיה חלה על עברית. תייצרו את השוט עם No text on screen, ותוסיפו את הכתוביות בעורך וידאו רגיל. שם הן יוצאות מושלמות.

מה ההבדל בין הגרסה הזו לגרסה שכל הסרטונים ברשת מלמדים?

הגרסה שברשת היא הפריוויו ממאי 2026, והיא נסגרת ב-30 בספטמבר 2026. 1.1 Flash יצא ב-27 באוגוסט 2026 והוא המודל הרשמי. ההבדלים המעשיים: הוא קורא עשר שניות אחורה במקום שנייה אחת, יש בו הארכה עד 40 שניות, פריים ראשון ואחרון, מצב טיוטה ב-360p, ורזולוציה עד 4K.

העליתי סרטון וביקשתי שינוי, אבל יצא סרטון אחר לגמרי. מה קרה?

כמעט תמיד אחת משתיים. או שהקובץ נכנס כרפרנס ולא כווידאו מקור — ואז המנוע לומד ממנו ובונה שוט חדש במקום לערוך את שלכם. או שחסר משפט הנעילה Keep everything else the same בסוף, ואז ההוראה נקראת כפרומפט חדש.

כמה תיקונים אפשר לעשות על אותו סרטון?

שלושה או ארבעה. בבדיקה על 22 הרצות, ארבעת הראשונים שמרו על הסצנה ובחמישי הדמות הפסיקה להיות אותה דמות. שתילת משפט עוגן בתיקון השלישי הרוויחה תיקון אחד נוסף בשניים משלושה ניסיונות. אחרי זה עדיף לייצר מחדש.

אפשר לצרף מוזיקה או הקלטת קול משלי?

לא. אין קלט אודיו בכלל — הקול נוצר יחד עם התמונה, לא מולבש עליה. אי אפשר גם להוסיף דיאלוג לקליפ שכבר יש בו דיבור. מוזיקה וקריינות משלכם מוסיפים בעורך הווידאו.

למה כדאי לצלם בעצמי אם המנוע יכול לייצר הכל?

כי כשמתחילים מצילום אמיתי, הפנים, התנועה, הבד, החדר והאור כבר נמצאים בתוך הווידאו, והמנוע מקבל משימה אחת ממוקדת במקום עשר. וזה גם עובד טוב יותר על הצופה: אם 95 אחוז מהפריים מרגיש אמיתי ורק 5 אחוז בלתי אפשריים, זה נראה כמו טריק ולא כמו סרטון AI.

לסיכום

מה שחשוב לזכור
  • דבר אחד בכל פעם. שלושה שינויים בבקשה אחת שוברים את הסרטון פי שניים יותר.

  • משפט הנעילה בסוף, תמיד. Keep everything else the same. הוא ההבדל בין תיקון לייצור מחדש.

  • בעריכה כותבים קצר. זה הפוך מיצירה: המנוע כבר רואה את הווידאו.

  • מקור ולא רפרנס. סרטון שרוצים לערוך נכנס בדרך העריכה, אחרת הוא רק חומר לימוד.

  • בימוי ולא מצב רוח. "מנורה פרקטית אחת משמאל" מנצח "תאורה דרמטית" בכל הרצה.

  • 360p קודם. שליש מהמחיר, ומספיק כדי לדעת אם הרעיון עובד.

  • עברית בעריכה. המנוע לתמונה ולתנועה, הכתוביות בעורך.

ומעבר לכל אלה, השאלה שכדאי לקחת מהמדריך: לא "איזה וידאו AI יכול לייצר לי", אלא "איזו מציאות אני יכולה לצלם, כדי ש-AI יוכל לעשות איתה משהו שאי אפשר היה לצלם".

💡

רוצים להעמיק ביצירת וידאו?
במועדון יש את המדריך ל-Seedance 2.5 (30 שניות בטייק אחד, עם תכנון רפרנסים) ואת המדריך ל-Higgsfield. לייצור תמונות הרפרנס עצמן — Nano Banana 2.

המדריך עוסק ב-Gemini Omni 1.1 Flash, שיצא ב-27 באוגוסט 2026, ולא בגרסת הפריוויו ממאי שנסגרת ב-30 בספטמבר 2026. המפרט והמגבלות נלקחו מההודעה של גוגל על 1.1, מהתיעוד הרשמי של Gemini API ומדף המודל של Google DeepMind. המספרים בפרק 12 הם ממדידה עצמאית שפורסמה על 22 הרצות. המחירים בקרדיטים הם של Cadabra AI. נכתב ב-30 באוגוסט 2026 מאת מייטל סלע · Cadabra AI · בשיתוף מועדון פרקטי AI.

תכנים קשורים

להצטרפות למועדון AI פרקטי ולגישה מלאה לכל הקורסים, המדריכים והסדנאות ›