نموذج جديد من "ميتا" لتوليد الفيديو بالذكاء الاصطناعي
نون - أعلنت مجموعة "ميتا" أمس عن إطلاق واجهة الذكاء الاصطناعي التوليدي الجديدة "موفي جن" (Movie Gen)، التي تتيح للمستخدمين إنشاء مقاطع فيديو مصحوبة بالصوت استنادًا إلى نصوص أو صور، وهو ما تقدمه أيضًا خدمات رائدة أخرى في مجال الذكاء الاصطناعي.
تعتبر "موفي جن" النموذج الثالث لتوليد الصور الذي تطوره "ميتا"، بعد النموذج الأول الذي تم إطلاقه في يوليو 2022، والثاني في نوفمبر 2023.
حتى الآن، لم يتم إتاحة أي من هذه الواجهات الثلاث للجمهور، حيث تخضع للاختبار من قبل صانعي المحتوى والمخرجين الذين يقومون بتقييم "موفي جن" ويساهمون في تحسين البرنامج.
ولم ترد "ميتا" على الفور على استفسار وكالة فرانس برس حول موعد إطلاق "موفي جن". بالإضافة إلى مقاطع الفيديو التوضيحية، نشرت المجموعة يوم الجمعة وثيقة بحثية تتضمن وصفًا للنموذج الجديد.
تعتمد نماذج اللغة على قواعد بيانات ضخمة، مما يمكنها من إنشاء محتوى متنوع، سواء كان نصًا أو صورة أو فيديو أو صوت أو رموز معلوماتية، استجابةً لطلبات مكتوبة بلغة يومية.
يمكن لـ Movie Gen إنتاج مقاطع فيديو بناءً على طلبات مكتوبة أو من خلال الصور. كما يقدم أيضًا ميزات تحرير لمقاطع الفيديو الموجودة.
يسمح النموذج بإضافة مقطع صوتي إلى الفيديو، وفقًا لنفس المبدأ القائم على الطلبات بلغة بسيطة.
في مقطع قصير نُشر على موقع "ميتا"، يكفي أن تقول جملة واحدة لتعديل فيديو عن طريق إضافة مشاهد لسيارة رباعية الدفع في الصحراء مع صوت محرك قوي ونغمة غيتار.
وأشارت "ميتا" إلى أن نسخة Movie Gen قد تصبح متاحة للاستخدام في المستقبل عبر شبكتي إنستغرام وفيسبوك، أو حتى من خلال رسائل واتساب. وليس "ميتا" هو أول مطور للذكاء الاصطناعي الذي يبتكر نموذجًا لإنشاء الفيديو.
في هذا السياق، يتيح برنامج "رانواي" Runway، من شركة "رانواي إيه آي" الناشئة، إمكانية إنشاء لقطة مدتها بضع ثوانٍ بناءً على طلب مكتوب، أو تحويل مجموعة من الصور الثابتة إلى فيديو قصير، أو إعادة تشكيل تسلسل موجود لتحويله، مثل تحويل صورة إلى لوحة فنية.
وفي فبراير، أطلقت "أوبن إيه آي" نسختها المسماة "سورا" Sora، بينما تعمل غوغل على نموذج يُدعى "لوميير" Lumiere.
