وسعت Google قدرات مساعدها Gemini بإطلاق نموذج Gemini Omni المخصص لإنشاء مقاطع الفيديو وتحريرها باستخدام الذكاء الاصطناعي، في خطوة تجعل التعامل مع الفيديو أقرب إلى إجراء محادثة عادية مع روبوت دردشة.
ويتيح النموذج للمستخدم إنشاء فيديو انطلاقًا من أوامر نصية أو صور أو مقاطع فيديو موجودة، كما يمكن الجمع بين أكثر من نوع من هذه المدخلات للحصول على النتيجة المطلوبة.
تعديل الفيديو عبر أوامر بسيطة
من أبرز خصائص Gemini Omni إمكانية تعديل الفيديو من خلال التعليمات المكتوبة، دون الحاجة إلى إتقان برامج المونتاج التقليدية.
ويستطيع المستخدم، على سبيل المثال، الاعتماد على صور مرجعية لإنشاء مشهد جديد، أو إجراء تعديلات على فيديو موجود، مع إمكانية تطوير النتيجة تدريجيًا عبر الحوار مع Gemini. ويدعم النظام استخدام ما يصل إلى خمس صور مرجعية في بعض عمليات إنشاء الفيديو.
وتقول Google إن النموذج يستفيد من قدرات Gemini متعددة الوسائط وفهمه للعالم الحقيقي، ما يساعده على إنتاج مشاهد أكثر اتساقًا مع التعليمات المقدمة.
من يمكنه استخدام Gemini Omni؟
يتوفر Gemini Omni للمستخدمين الذين تبلغ أعمارهم 18 عامًا فما فوق ضمن خطط Google AI Plus وPro وUltra، وفي الأسواق واللغات التي يتوفر فيها تطبيق Gemini. وقد تكون بعض الخصائص، مثل إنشاء الشخصيات الافتراضية أو تعديل فيديو اعتمادًا على فيديو آخر، محدودة في بعض الدول.
كما توفر Google تقنيات إنشاء الفيديو عبر Gemini API، حيث تضم منظومتها حاليًا نماذج مخصصة لمهام مختلفة، من بينها Gemini Omni Flash وVeo.
ويعكس هذا التطور اشتداد المنافسة في سوق أدوات الذكاء الاصطناعي المخصصة لصناعة المحتوى، إذ تسعى الشركات إلى جعل إنشاء الفيديو وتعديله أكثر سهولة للمستخدم العادي.
