Gemini Omni סקירה: מודל הוידאו של גוגל ששובר את שיטת ה-Prompt
גוגל השיקה ב-Google I/O 2026 מודל וידאו AI חדש שמשלב טקסט, תמונה, קול ווידאו, ועורך את הוידאו בשיחה. בדקנו את היכולות, המחירים וההשוואה מול Veo ו-Sora.
Gemini Omni הוא מודל וידאו AI חדש של גוגל, הושק במאי 2026 בכנס I/O. הוא מקבל כל קומבינציה של טקסט, תמונה, קול ווידאו ומחזיר קליפ של עד 10 שניות. הפיצ'ר הבולט: עריכה בשיחה, ללא צורך להתחיל פרומפט מאפס בכל פעם.
ב-19 במאי 2026 גוגל הציגה בכנס I/O את Gemini Omni, מודל AI שיודע ליצור וידאו מכל קלט. אפשר להזין לו טקסט, תמונה, קליפ קצר או הקלטה קולית, והוא מייצר וידאו של עד 10 שניות. ההבדל הגדול מ-Veo ומ-Sora, אפשר לערוך את הוידאו בשיחה: לכתוב "תחליף את הרקע לשקיעה" או "תסובב את הדמות שמאלה", והמודל מבצע. בלי להתחיל מאפס.
בדקנו את הכלי, השווינו אותו לכלי וידאו אחרים ועברנו על המחירים. במאמר תמצאו מה הוא יודע באמת לעשות, איפה הוא חזק ואיפה חלש, כמה זה עולה ולמי זה מתאים. גם נסביר איך מתחילים, כולל גישה חינמית דרך YouTube Shorts.
מה זה Gemini Omni בעצם
Gemini Omni הוא מודל וידאו AI חדש מבית Google DeepMind. הוא חלק ממשפחה רחבה יותר של מודלי Omni שגוגל בנתה, שכולם מסוגלים לקבל ולפלוט כל קומבינציה של מדיה: טקסט, תמונה, אודיו ווידאו, באותו מרחב טוקנים אחד. השם Omni בא מהיוונית "כל", הכוונה שהמודל לא משתמש בכלי נפרד לקול ובכלי נפרד לתמונה. הכל בתוך מערכת אחת.
בפועל, זה אומר שאפשר להעלות תמונה של מוצר, להזין הקלטה של קריינות, להוסיף הוראה טקסטואלית "הצג את המוצר על שולחן עץ עם תאורה חמה", והמודל יבנה את הסצנה. הוא מבין פיזיקה בסיסית, גרביטציה, נוזלים, אנטומיה מרחבית ותאורה עקבית בין פריימים. השמלות לא חוזרות לאחור פתאום והאור לא קופץ בין סצנות.
Veo ו-Sora הם מודלי וידאו ייעודיים, מקבלים פרומפט ומחזירים סרטון. אם משהו לא טוב, צריך לכתוב פרומפט חדש מאפס. ב-Gemini Omni אפשר לייצר קליפ ואז להמשיך לערוך אותו בשיחה. שמירת ההקשר היא מה שמייחד את הכלי.
היכולות המרכזיות של Gemini Omni
01עריכה בשיחה
מי שכבר ניסה כלי וידאו AI יודע: רוב הזמן הולך על ניסיון ושגיאה עם פרומפטים. ב-Gemini Omni אפשר לייצר קליפ ראשוני, ואז להגיד "תחליף את הרקע לשקיעה", "תסיר את ההילה הכחולה", "תוסיף שינוי בתאורה אחרי 3 שניות". המודל זוכר את ההקשר ומעדכן רק את מה שביקשתם. הקליפ נשאר עקבי.
02קלט מולטימודלי משולב
אפשר להזין למודל בו זמנית: תמונה, וידאו קצר כרפרנס סגנון, הקלטה קולית, וטקסט. הוא ינסה לאחד את כולם לתוצר אחד. כלי וידאו אחרים, כולל Veo 3.1, לרוב מקבלים רק טקסט או טקסט עם תמונה.
03הבנת פיזיקה ותרבות
המודל מאומן על דאטה גדול שכולל לא רק תמונות וטקסט, אלא גם וידאו ואודיו. התוצאה: הוא מתמודד טוב יחסית עם תנועה של נוזלים, גרביטציה ואינטראקציה בין אובייקטים. גם הקשר תרבותי, חתונה הודית תיראה אחרת מחתונה אירופאית ולא חיבור גנרי.
04יצירת אווטר אישי
אחת היכולות החדשניות: אפשר להקליט סרטון קצר של עצמכם עם הצהרת הסכמה, והמודל ייצור וידאו שדומה לכם ונשמע כמוכם. שימושי לבעלי עסקים שרוצים לייצר תוכן וידאו במסה בלי לעמוד מול מצלמה כל יום.
05שילוב ב-YouTube Shorts
זה כנראה החדשות הגדולות לקריאטורים. Gemini Omni משולב חינם ב-YouTube Shorts Remix וב-YouTube Create. כל יוצר תוכן בן 18 ומעלה יכול ליצור קליפים ישירות בפלטפורמה, בלי מנוי בתשלום ל-Google AI.
Gemini Omni לא מנסה להתחרות מול הסרטונים הקולנועיים של Sora 2. הוא בונה לעצמו נישה אחרת: יצירה מהירה, איטרציה בשיחה, ושילוב טבעי בתוך אפליקציות שאתם כבר משתמשים בהן.
Gemini Omni מול Sora 2, Veo 3.1 ו-Kling 3.0
השוואה ישירה בין כלי וידאו AI לא תמיד מובנת מאליה, כי כל אחד התעצב לתרחיש שימוש אחר. ריכזנו פה את ההבדלים החשובים שכדאי לדעת לפני שבוחרים.
| קטגוריה | Gemini Omni | Veo 3.1 | Sora 2 | Kling 3.0 |
|---|---|---|---|---|
| אורך קליפ | עד 10 שניות | עד 60 שניות | עד 20 שניות | עד 30 שניות |
| עריכה בשיחה | כן, מובנה | לא | לא | חלקי |
| קלט מולטימודלי | טקסט, תמונה, קול, וידאו | טקסט, תמונה | טקסט, תמונה | טקסט, תמונה |
| דירוג Elo Arena | לא דורג רשמית | במקום 3 | במקום 4 | במקום 2 |
| מחיר התחלה | חינם ב-YouTube Shorts | 19.99 דולר בחודש | 20 דולר בחודש | 10 דולר בחודש |
לפי בדיקות עצמאיות מ-Artificial Analysis Video Arena, Seedance 2.0 מובילה את הליגה (Elo 1,269 לטקסט-לוידאו), ואחריה Kling 3.0, Veo 3.1 ו-Sora 2. Gemini Omni עוד לא דורג רשמית, אבל בדיקות איכותיות מציבות אותו מתחת ל-Seedance באיכות יצירה גולמית, ומעליו בעבודה זרימתית ובשילוב כלים.
האם זה עובד טוב עם עברית
השאלה החשובה לכל קריאטור ישראלי, מה לגבי תוכן בעברית. גוגל לא פרסמה מספרים ספציפיים על איכות הפלט בעברית, אבל בדיקות שעשינו מראות שהמודל מבין הוראות בעברית ובונה סצנות לפי תיאור. הקול שמוטמע בוידאו עדיין נקי יותר באנגלית, אבל אפשר להוסיף קריינות בעברית חיצונית בעריכה.
בנוסף, המודל מבין הקשר תרבותי ישראלי. סצנה של "שוק מחנה יהודה" או "חוף הים בתל אביב" יוצאת אותנטית יחסית, לעומת כלי שמייצר שוק גנרי במזרח התיכון. עדיין יש מקום לשיפור בייצוג מדויק של מקומות מוכרים.
כל וידאו שיוצא מהמודל קצר. עד 10 שניות לקליפ אחד. אם צריך תוכן ארוך יותר, חייבים להרכיב כמה קליפים בעריכת וידאו רגילה. גם הגבלת "4 turns" קיימת בעריכה בשיחה, אחרי 4 איטרציות צריך להתחיל קליפ חדש.
כמה זה עולה
Gemini Omni נגיש דרך מספר רמות מנוי של Google AI. הגישה החינמית הכי נוחה היא דרך YouTube Shorts Remix, שם כל משתמש בן 18 ומעלה יכול ליצור קליפים בלי תשלום. למי שצריך יכולות מתקדמות יותר ושילוב ב-Google Flow, יש מנויים בתשלום.
איך מתחילים עם Gemini Omni
אם רוצים להתחיל לעבוד עם Gemini Omni, התהליך פשוט יחסית. הנה שלושה שלבים שיביאו אתכם מ-0 לסרטון ראשון תוך כמה דקות.
01הרשמה ל-Google AI
אם יש לכם חשבון Google, אתם כבר חצי שם. היכנסו לאתר gemini.google.com והתחברו עם המייל. אם יש לכם מנוי AI Plus או גבוה יותר, Gemini Omni כבר זמין לכם בתפריט. אם לא, אפשר לעבור ל-YouTube Shorts ולנסות שם בחינם.
02יצירת קליפ ראשון
פתחו שיחה חדשה בג'מיני ובחרו במצב יצירת וידאו (Create with Gemini Omni). תארו מה אתם רוצים לראות במשפט פשוט: "פרסומת קצרה למסעדה איטלקית, פיצה יוצאת מהתנור, צוהריים שטופי שמש". המתינו 30-90 שניות עד שהקליפ נוצר.
03עריכה בשיחה
לאחר שהקליפ מוכן, אל תקבלו אותו כפי שהוא. הקלידו שיפורים: "תוסיף תפריט על השולחן בצד", "תחליף את הצלחת ללוח עץ", "תוסיף תנועה איטית של בוקה". כל איטרציה משפרת. אחרי 3-4 איטרציות בדרך כלל מקבלים תוצר טוב.
למי Gemini Omni באמת מתאים
- אתם קריאטורים של YouTube Shorts או TikTok וצריכים תוכן וידאו במסה
- אתם בעלי עסקים קטנים בלי תקציב לפרסומאי, רוצים פרסומות קצרות לסושיאל
- אתם משווקים שצריכים להפיק וריאציות מהירות של פרסומת לבדיקות A/B
- אתם רגילים לערוך תוכן בכלי שיחה ולא רוצים להחזיק בעורך מקצועי
- אתם רוצים פלט וידאו עם דיוק פיזיקלי בלי השקעה גדולה בפרומפט הנדסי
- אתם זקוקים לקליפים ארוכים מ-10 שניות בלי עריכה חיצונית
- אתם רוצים שליטה קולנועית מתקדמת על מצלמה, צילום ועומק שדה
- אתם מחפשים איכות סופית גולמית עליונה, שם Seedance עוד מובילה
- אתם רוצים פלט מקצועי בעברית בלי שום פערים בקריינות
- אתם בעסק עם רגישות גבוהה לחתימת SynthID, אסור לכם למתג תוכן AI
✓מה חשוב לזכור
- Gemini Omni השיק ב-19 במאי 2026 כחלק ממשפחת מודלים מולטימודליים של גוגל.
- היכולת הבולטת היא עריכה בשיחה, פיצ'ר שמתחרים עוד לא מציעים באותה רמת אינטגרציה.
- הגישה חינמית דרך YouTube Shorts, בתשלום החל מ-7.99 דולר בחודש דרך AI Plus.
- אורך קליפ מקסימלי הוא 10 שניות, הגבלה שצריך לקחת בחשבון לתוכן ארוך.
- בעברית הוא מבין הוראות וקונטקסט, אבל קריינות נקייה עדיין דורשת עבודה חיצונית.
שאלות ותשובות
מה ההבדל בין Gemini Omni ל-Veo 3.1? ▼
Veo 3.1 הוא מודל וידאו ייעודי לסרטונים קולנועיים עם שליטה גבוהה על מצלמה. Gemini Omni הוא מודל מולטימודלי שמייצר וידאו קצר עם אפשרות עריכה בשיחה. Veo טוב לפרסומות מקצועיות. Omni טוב ליצירה מהירה ולקריאטיב בשיחה.
האם Gemini Omni חינמי? ▼
יש גישה חינמית דרך YouTube Shorts Remix לכל משתמש בן 18 ומעלה. לשימוש מלא דרך אפליקציית Gemini או Google Flow צריך מנוי בתשלום, החל מ-7.99 דולר בחודש.
האם Gemini Omni מבין עברית? ▼
כן. המודל מקבל הוראות בעברית ובונה סצנות לפי תיאור. הקול הפנימי שיוצא מהוידאו נשמע נקי יותר באנגלית, אבל אפשר להוסיף קריינות עברית חיצונית. ההקשר התרבותי הישראלי, כמו שווקים או נופים, נשמר טוב יחסית.
כמה זמן לוקח ליצור קליפ? ▼
בין 30 ל-90 שניות לקליפ של 10 שניות, תלוי בעומק הפרומפט ובעומס על השרת. עריכות בשיחה נוטות להיות מהירות יותר, כי המודל לא בונה מאפס אלא מעדכן.
האם יש חתימת מים בוידאו? ▼
כן. כל וידאו שיוצא מ-Gemini Omni נושא חתימת SynthID, חתימת מים דיגיטלית מוצפנת שלא נראית בעין, אבל מאפשרת לאמת שמקור הוידאו ב-AI. זה חלק מהמדיניות של גוגל לזיהוי תוכן מלאכותי.
האם המודל יחליף עורכי וידאו? ▼
לא בטווח הקרוב. Gemini Omni מצוין לקליפים קצרים ולסושיאל, אבל הוא לא מחליף שליטה מקצועית על עריכה, סאונד דיזיין ופוסט פרודקשן. למקצוענים הוא יותר כלי שמעצים את התהליך מאשר מחליף אותו.