أحرزت DeepMind تقدمًا كبيرًا في مجال الروبوتات الذكية من خلال إطلاق Gemini Robotics 2، وهو نموذج ذكاء اصطناعي يمنح الروبوتات القدرة على فهم البيئة المحيطة والتصرف بذكاء. يشكل هذا الإصدار قفزة نوعية نحو بناء آلات قادرة على التعامل مع مجموعة واسعة من المهام المعقدة، بدلًا من الاقتصار على عمليات محددة مبرمجة مسبقًا.

تعالج التقنية الجديدة مشكلة أساسية طالما واجهت صناعة الروبوتات: معظم الآلات الحالية تفتقر إلى القدرة على التعلم الذاتي والتكيف مع البيئات غير المتوقعة، وينطبق الشيء ذاته على نقل المهارات بين أجسام روبوتية مختلفة. يوفر النموذج الجديد حلًا متطورًا يتيح للروبوتات التحكم الكامل بأجسامها من الأطراف إلى الرأس، بما يشمل الحركات المعقدة مثل الانحناء والمشي والوصول إلى الأشياء.

أدرجت DeepMind في النموذج الجديد نسخة استدلالية تسمى Gemini Robotics ER 2، تعمل بمثابة الدماغ العليا للروبوت، حيث تعالج تعليمات المستخدم وتتواصل معهم وتنسق العمليات والتعديلات اللازمة. يسمح هذا النموذج للروبوتات بتنفيذ سلاسل طويلة من المهام تمتد لعدة دقائق وتتضمن مئات القرارات، مع القدرة على التصحيح الذاتي والتعامل مع حالات جديدة لم تواجهها من قبل.

أضافت الشركة ميزة تعاون متعدد الروبوتات تتيح لآلات مختلفة التواصل والعمل معًا لإنجاز مهام معقدة لا يستطيع روبوت واحد القيام بها. يعمل نموذج Gemini Robotics On-Device 2 محليًا على أجهزة الروبوتات نفسها دون الاعتماد على الاتصال بالإنترنت، مما يقلل زمن الاستجابة ويعزز الاستقلالية. تمكن تقنية نقل الحركة المتقدمة الآلات من التكيف مع أجسام روبوتية جديدة في غضون ساعات قليلة وعشرات الأمثلة الموجهة فحسب.

أولت DeepMind اهتمامًا خاصًا بالسلامة ضمن أبحاثها، حيث قدمت معايير جديدة تدعى ASIMOV-Agentic لقياس السلامة والتعامل مع الشكوك. يتمكن النموذج من رصد قرب الأشخاص من الروبوت والتوقف الآمن عند الحاجة، وهو مطلب أساسي للعمل المشترك بين الإنسان والآلة. وضعت الشركة النموذج الاستدلالي الجديد في الوصول المحدود للشركاء الأوائل، بينما أتاحت نسخة Gemini Robotics ER 2 عبر منصة Google AI Studio وفي معاينة خاصة على منصة Gemini Enterprise Agent Platform.