أطلقت جوجل، مساء اليوم الخميس، نموذج Gemini Omni 1.1 Flash لتوليد الفيديو وتحريره بالذكاء الاصطناعي، مستهدفةً المطورين بأدوات جديدة تعزز دقة التحكم في المشاهد وتقلل وقت اختبار الأفكار قبل الوصول إلى النسخة النهائية.
ويتيح النموذج مواصلة الفيديو من النقطة التي انتهى عندها مقطع سابق بدل إنشاء مشهد منفصل، إذ يمكنه التعامل مع ما يصل إلى 10 ثوانٍ من المحتوى السابق لفهم السياق البصري والسردي. ويمكن تمديد المقاطع على مراحل تبلغ كل منها 10 ثوانٍ، حتى حد إجمالي يصل إلى 40 ثانية.
كما يمنح النموذج المستخدمين القدرة على تحديد الإطارين الأول والأخير للمشهد، ليتولى إنشاء الحركة بينهما. وتساعد هذه الإمكانية في تنفيذ انتقالات أكثر سلاسة، مثل تحريك الكاميرا حول العناصر وعمليات التكبير والانتقال بين المشاهد، إلى جانب إنتاج مقاطع قابلة للتكرار دون قفزات واضحة.
معاينات أسرع ومخرجات حتى 4K
أضافت جوجل خيارًا لإنتاج فيديوهات تجريبية بدقة 360p، وقالت إن إنشاء هذه المعاينات يمكن أن يكون أسرع بما يصل إلى 60% مقارنة بإنتاج الفيديو بدقة 720p، وبتكلفة تقدر بنحو ثلث تكلفة الدقة الأعلى. وتستهدف الميزة تسريع إعداد القصص المصورة وتجربة الأوامر النصية وتقييم الأفكار الأولية.
وفي المقابل، يدعم Gemini Omni 1.1 Flash إنتاج مخرجات بدقتي 1080p و4K. كما يمكن إدخال مقطع مرجعي مدته حتى 3 ثوانٍ ضمن المدخلات متعددة الوسائط، لمساعدة النموذج على الحفاظ على ملامح المشهد والشخصيات واتساقها في النتائج الجديدة.
وبدأت جوجل إتاحة النموذج ضمن منظومتها للمطورين عبر استوديو جوجل للذكاء الاصطناعي، ولعملاء المؤسسات عبر منصة وكلاء جيميناي إنتربرايز. كذلك وصل Omni 1.1 إلى جوجل فلو عالميًا لمشتركي جوجل للذكاء الاصطناعي بلس وبرو وألترا، فيما أصبحت ميزة تمديد المشاهد متاحة عبر تطبيق جيميناي للمشتركين في الخطط نفسها.

نور في الطريق






