أعلنت جوجل عن إضافة ميزة تحليل فيديو متقدمة لعدة نماذج من Gemini، تعتمد على منطق ذكي يختار الأقسام المهمة من الفيديو بشكل مستقل، بدلًا من المعالجة الثابتة التقليدية التي تسير بمعدل ثابت. تحقق هذه الطريقة الجديدة توفيرًا ملموسًا في استهلاك الرموز والتكاليف المرتبطة بها.
النماذج الأحدث، Gemini 3.7 Flash و 3.6 Flash و 3.5 Flash-Lite، يمكنها التقاط لحظات أقصر من الثانية الواحدة، تشمل التغييرات المفاجئة والقطع التي قد تضيع بالطريقة التقليدية. يتيح هذا تحرير الفيديو الآلي بدقة أعلى بكثير، كما يمكنها تتبع المشاهد المختلفة في ساعات من المقاطع دون استهلاك ملايين الرموز، وكشف الحالات الشاذة بإعادة أخذ عينات من النوافذ الزمنية المريبة بمعدل إطارات أعلى.
تعتمد الميزة الجديدة على ربط استدلال النموذج مباشرة بأدوات معالجة الفيديو الأصلية. يقرر النموذج بنفسه أي أجزاء يجب فحصها وبأي سرعة وعبر أي وسيط، سواء كانت الإطارات أو الصوت أو النصوص المكتوبة. يسحب فقط اللحظات والإشارات التي يحتاجها فعليًا للمهمة المطلوبة، بدلًا من معالجة الملف كاملًا.
تبني هذه الميزة على مزايا "الرؤية الذكية" التي أطلقتها جوجل مع Gemini 3 Flash في يناير، والتي سمحت للنموذج بكتابة وتنفيذ أكواد Python لتكبير وقص والتعليق على الصور. تظهر مكاسب الكفاءة بوضوح مع الفيديوهات الطويلة من دروس بعشر دقائق إلى محاضرات بتسعين دقيقة وتسجيلات متعددة الساعات.
الميزة متاحة حاليًا لتحميل الفيديوهات وفيديوهات YouTube عبر Google AI Studio و Gemini Enterprise Agent Platform. يمكن للمطورين تعيين وضع المعالجة على "agentic" في إعدادات واجهة البرمجيات، والدفع بأسعار رموز Gemini القياسية دون رسوم إضافية. تخطط جوجل لإدراج هذه التحسينات في منتجاتها أيضًا، مع طرح الميزة قريبًا على جميع مستخدمي تطبيق Gemini على أجهزة Flash و Flash Lite.
التعليقات (0)
لا توجد تعليقات بعد. كن أول المعلّقين.