جيميني أومني من غوغل: تحويل أي نص أو صورة أو صوت إلى فيديو بالذكاء الاصطناعي

كشفت غوغل في مؤتمر I/O 2026 عن نموذج جيميني أومني متعدد الوسائط القادر على توليد الفيديو من أي مزيج من المدخلات، مع علامة مائية رقمية لمكافحة التزييف العميق.

تحرير
ألمعي · هيئة التحرير
النشر
٢٠ مايو ٢٠٢٦
المصدر
TechCrunch
القراءات
٠
الوقت
قراءة دقيقتين
نموذج جيميني أومني من غوغل لتوليد الفيديو بالذكاء الاصطناعي

كشفت شركة غوغل في مؤتمر المطورين السنوي I/O 2026 عن نموذج جديد يُعدّ الأكثر طموحاً في تاريخ الشركة؛ إذ أطلقت "جيميني أومني"، وهو النموذج متعدد الوسائط الذي يجمع بين فهم النصوص والصور والصوت والفيديو وتوليدها في آنٍ واحد.

وصف الرئيس التنفيذي لغوغل سوندار بيتشاي الهدف من النموذج بأنه "إنشاء أي شيء من أي مدخل"، مضيفاً أن الجديد لا يكتفي بدمج المدخلات تقنياً، بل يفهم السياق العلمي والثقافي والتاريخي المحيط بها. وهذا ما جعل جلسة الإطلاق مثيرةً بشكل استثنائي: طُلب من النموذج توليد مقطع فيديو بأسلوب الصلصال يشرح ظاهرة طيّ البروتينات، فأنتج مقطعاً بالحركة الإطارية مرفقاً بتعليق علمي دقيق.

النموذج متاح اليوم في نسختين: "جيميني أومني فلاش" الموجّهة للمستخدمين العامين، وتُدمج مع تطبيق جيميني ومنصة يوتيوب شورتس واستوديو الإبداع Flow. أما نسخة "أومني برو" المخصصة للمحترفين، فلا تزال قيد التطوير. وستُتاح واجهة برمجة التطبيقات للمطورين خلال أسابيع.

من الناحية التقنية، يُولّد النموذج مقاطع فيديو بمدة تصل إلى عشر ثوانٍ مع إمكانية التوسيع مستقبلاً. ويدعم النموذج أيضاً تحرير الصور بأوامر نصية بسيطة، وإنشاء صور رمزية رقمية مزوّدة بالتحقق الصوتي لمنع إساءة الاستخدام. وتتراوح الاستخدامات بين إنشاء مشاهد افتراضية للسفر في الفضاء وتوليد إعلانات تجارية احترافية.

غير أن الإضافة الأبرز ربما تكون نظام SynthID للعلامة المائية الرقمية الذي يُضمّنه غوغل في كل محتوى يُولّده الذكاء الاصطناعي التوليدي، مما يتيح التحقق من مصدر أي محتوى ويُضيّق الخناق على التزييف العميق. في عصر تتكاثر فيه مخاوف تزوير المحتوى الرقمي، يمثّل هذا النظام خطوةً تشغيلية حقيقية لا رمزية.

يأتي جيميني أومني في سياق سباق محتدم؛ فشركة OpenAI أطلقت نموذج Sora لتوليد الفيديو، وتدمج أدوبي قدرات مشابهة في Firefly، فيما تواصل ميتا تطوير نماذجها متعددة الوسائط. إلا أن ما يميّز جيميني أومني هو عمق تكامله مع منظومة غوغل الكاملة: من يوتيوب إلى غوغل درايف إلى غوغل لينز، مما يعني أن ملايين المستخدمين سيصطدمون بهذا النموذج دون قصد حين يبدأون في تصفح شورتس أو تحرير صورهم.

ثمة تحدٍّ عملي يُذكره المختبرون الأوائل: التعليمات التحريرية الدقيقة ضرورة لا ترف. إذا جاءت أوامر التحرير مبهمة، أحدث النموذج تغييرات غير مقصودة في الصورة أو الفيديو. وهذا يعني أن المستخدم العادي قد يحتاج وقتاً للتكيّف مع لغة المطالبات التي يفهمها النموذج.

في العالم العربي يفتح جيميني أومني أفقاً إبداعياً ضخماً، إذ يُمكّن المحتوى العربي من مزاحمة المنصات العالمية بأدوات إنتاج بصري متقدمة: من شركات الإعلانات في القاهرة ودبي، إلى صنّاع المحتوى المستقلين على «يوتيوب» و«تيك توك»، إلى استوديوهات الأنيميشن في الأردن والمغرب. غير أن التحدي الموازي حقيقي: يحتاج النموذج إلى تدريب أعمق على اللهجات والثقافات البصرية العربية كي يُنتج محتوى أصيلاً لا نسخةً متفرنجة بأرقام عربية. وفي الوقت ذاته تتنامى المخاوف من التزييف العميق لأصوات وصور سياسيين وفنانين عرب، ما يجعل العلامة المائية SynthID خط دفاع أول ضمن منظومة تشريعية إقليمية لا تزال غائبة.

المصدر الأصلي
TechCrunch
قراءة المقال الأصلي ↗
قصة اليوم · كل صباح

أعجبك التقرير؟ استلم واحداً كل صباح.

قصةٌ تقنية واحدة تستحقّ وقتك، بالعربية. بلا إعلانات، بلا إزعاج.

بلا إعلانات · إلغاء الاشتراك بنقرة واحدة · بياناتك آمنة

اقرأ أيضًا

المزيد من ذكاء اصطناعي

معدات كاتربيلر الثقيلة في معرض تقني تعرض تقنيات LiDAR والمركبات ذاتية القيادة

كاتربيلر تنقل دروس أتمتة المناجم إلى نشر الذكاء الاصطناعي في مصانع المستقبل

تستثمر شركة كاتربيلر العملاقة عقودها من خبرة الأتمتة في مناجم المعادن لنشر الذكاء الاصطناعي عبر 1.6 مليون أصل متصل، ومساعد صوتي للتقنيين في الميدان، وتوائم رقمية لمواقع البناء.

TechCrunch
طائرة مسيّرة تجارية تحلق في السماء تمثيلاً للتنافس التكنولوجي بين الولايات المتحدة والصين في قطاع الطائرات المسيّرة والروبوتات

أمريكا تُحكم قبضتها على الطائرات المسيّرة والروبوتات لكن الصين تملك ما لا يمكن حظره: الحجم

فرضت الولايات المتحدة رسوماً جمركية على الطائرات المسيّرة والروبوتات الأجنبية بذريعة الأمن القومي، غير أن الصين التي تمسك بـ86% من سوق الروبوتات الإنسانية العالمية قد تُحوّل هذه القيود إلى فرصة للسيطرة على الأسواق الدولية.

TechCrunch
جنسن هوانغ مع رقاقة إنفيديا الجديدة

إنفيديا تتجاوز حدود المعالج الرسومي نحو ميزة تنافسية جديدة في الذكاء الاصطناعي

تكشف إنفيديا عن استراتيجية تتخطى صراع المعالجات نحو التحكم الذكي في حركة البيانات وتنسيق أنظمة مراكز البيانات بالكامل، مستفيدةً من بنيتها الجديدة فيرا روبن.

TechCrunch
معدات تسجيل موسيقي في استوديو

شركتا سوني ميوزيك ووارنر تُقاضيان أنثروبيك بتهمة سرقة الأعمال الموسيقية المحمية

وجّهت عملاقتا النشر الموسيقي سوني ميوزيك ووارنر شابيل دعوى قضائية ضد شركة أنثروبيك، متهمتَيْن إياها باستخدام آلاف الأعمال الموسيقية المحمية بحقوق النشر لتدريب نموذجها كلود دون إذن.

TechCrunch
حرب الاستحواذ على شركات الذكاء الاصطناعي في وادي السيليكون

حرب الاستحواذ على شركات الذكاء الاصطناعي مفتوح الأوزان تشتعل في سيليكون فالي

صفقات بمليارات تُعيد تشكيل مشهد الذكاء الاصطناعي: إنفيديا تتفاوض على هاغينغ فيس بـ13 مليار دولار وسترايب تستحوذ على OpenRouter بـ7 مليارات، في مؤشر على حرب الهيمنة على النماذج مفتوحة الأوزان.

TechCrunch
مكاتب شركة أندريسن هوروويتز للاستثمار التقني

أندريسن هوروويتز تُطلق صندوق 1.1 مليار دولار لبناء البنية المادية للذكاء الاصطناعي

تتحول شركة الاستثمار التقني الشهيرة نحو الهاردوير بتأسيس صندوق ضخم يستهدف رقائق إلكترونية ومراكز بيانات وروبوتات، في رهان على أن ذكاء اصطناعياً ناجحاً يحتاج أولاً إلى أساس مادي صلب.

TechCrunch
جيميني أومني من غوغل: تحويل أي نص أو صورة أو صوت إلى فيديو بالذكاء الاصطناعي — ألمعي