أعلنت مجموعة علي بابا عن توفر نموذج Wan3.0 لتوليد الفيديوهات بنسخة تجريبية، وهو نظام متقدم يستقبل مدخلات متعددة الأنواع ويُنتج مقاطع فيديو تصل مدتها إلى 30 ثانية، مقابل 15 ثانية في الإصدار السابق Wan2.5.
يتميز النموذج الجديد بقدرته على معالجة النصوص والصور ومقاطع الفيديو والملفات الصوتية في الوقت ذاته، حيث يقبل المِدخَل الواحد عشر صور وخمس مقاطع فيديو وخمس ملفات صوتية، إضافة إلى صفحات الويب والملفات المستندية مثل PDF وملفات العروض التقديمية، مما يحول البيانات الثابتة إلى محتوى فيديو حركي. يوصي النموذج أيضًا بالمدة الأمثل للفيديو بناءً على طلب المستخدم، ويضم أداة إضافية لإطالة الفيديوهات القائمة.
ركزت علي بابا على معالجة مشكلة شائعة في الفيديوهات المولدة بالذكاء الاصطناعي وهي التشوهات البصرية والانجراف البصري خاصة في الوجوه والواجهات، حيث يحافظ Wan3.0 على اتساق أكبر للتفاصيل مثل الشخصيات والأدوات والتخطيطات المكانية المستخلصة من المواد المرجعية.
تتوفر النسخة التجريبية عبر موقع wan.video وعبر Alibaba Cloud Model Studio وواجهة برمجية على منصة Qwen Cloud بنسختين: نسخة قياسية تُقدم حاليًا بخصم 30 بالمائة، ونسخة Prime أسرع. وتستهدف علي بابا تطبيقات واسعة تتراوح بين تسريع الإنتاج السينمائي وتوليد المسلسلات القصيرة والمقاطع الموجهة لمنصات التواصل الاجتماعي، إلى تحويل النصوص والصور إلى مقاطع تسويقية وتدريبية للشركات.
يأتي هذا الإطلاق في وقت تعزز فيه علي بابا استثماراتها في مجال الذكاء الاصطناعي، بعد أن أعلنت عن أكبر عملية طرح أسهم قام بها سهم مدرج في هونج كونج لتمويل هذه التوسعات، وأفادت تقارير بانخفاض أرباح الشركة ربع السنوية بنسبة 75 بالمائة على أساس سنوي.
التعليقات (0)
لا توجد تعليقات بعد. كن أول المعلّقين.