أطلقت جوجل نسخة محدثة من نموذج Gemini Omni 1.1 Flash، المتخصص في توليد وتحرير الفيديو بشكل أصلي. الترقية تنقل النموذج من مرحلة التوليد البسيط إلى التحكم الموجه، حيث يمكن الآن تمديد المشاهد بناءً على سياق يصل إلى 10 ثوان بدلاً من الاعتماد على الإطار الأخير فقط.
يدعم النموذج الجديد تثبيت الإطارات الأول والأخير للتحكم الدقيق في حركة الكاميرا، كما يوفر معاينات بدقة 360p بتكلفة أقل بثلث من دقة 720p. الفيديوهات النهائية قابلة للترقية إلى دقة 4K، ويمكن استخدام مقاطع فيديو كمراجع لضمان تناسق الشخصيات. يعتمد النموذج على معالجة متعددة الأنماط بشكل أصلي، حيث يدمج النصوص والصور والصوت والفيديو معاً.
تعمل آلية التحرير بطريقة تحتفظ بحالة البيانات، بحيث يحافظ النموذج على التعديلات السابقة عند طلب تغييرات جديدة دون الحاجة لإعادة تحميل الفيديو الأصلي. يمكن تمديد المقاطع بزيادات قدرها 10 ثوان حتى تصل إلى 40 ثانية إجمالية، مع إمكانية توليد استمرار بطول 3 إلى 10 ثوان لكل استدعاء.
تحدد جوجل تسعيراً محدداً للخدمة: 1.50 دولار لكل مليون رمز إدخال، و9 دولارات لكل مليون رمز نصي في المخرجات، و17.50 دولار لكل مليون رمز فيديو. تبلغ كفاءة الفيديو حوالي عشرة سنتات لكل ثانية من دقة 720p. كل فيديو مولد يحمل علامة مائية SynthID غير مرئية للمشاهدين لكن قابلة للكشف البرمجي.
تتوفر الخدمة عبر واجهة برمجية جوجل في Google AI Studio ومنصة Gemini Enterprise Agent Platform. أعلنت جوجل عن عملاء إنتاجيين بالفعل مثل Adobe و Figma Weave و GMI Cloud و Runway. النموذج متاح أيضاً في Google Flow لمشتركي AI Plus و Pro و Ultra.
Comments (0)
No comments yet. Be the first.