تكنولوجيا

عقل “جوجل” الجديد يمنح الروبوتات قدرة التفكير والتعاون الجماعي لأول مرة

Gemini Robotics ER 2 ينهي عصر التوقف الآلي

صحفي في قسم التكنولوجيا بمنصة النيل نيوز، يتابع أحدث الأخبار التقنية

أطلقت شركة جوجل نموذج Gemini Robotics ER 2، الذي يمثل “عقلاً” فائقاً للروبوتات يهدف إلى تسريع الوصول إلى الذكاء الاصطناعي العام، وفق ما أعلنته الشركة عبر موقعها الرسمي. هذا النموذج يتيح للآلات إجراء محادثات مع البشر وفهم المحيط المادي وتخطيط تسلسلات معقدة من الأفعال، بدلاً من مجرد تنفيذ أوامر برمجية جامدة.

دمج المهندسون في DeepMind تقنيات “البث ثنائي الاتجاه” عبر واجهة برمجة تطبيقات Gemini Live لتقليل زمن الاستجابة، مما ينهي فترات التوقف التي كانت تعاني منها الروبوتات سابقاً “للتفكير” قبل تنفيذ الخطوة التالية. وتعتمد المعالجة الجديدة على تفويض التحكم في الحركات لنماذج رؤية ولغة وحركة (VLA) منخفضة المستوى، مما يسمح للروبوت بالتخطيط للخطوة القادمة أثناء تنفيذه للعمل الحالي.

أظهرت تجارب جوجل قدرة الروبوتات على العمل الجماعي من خلال فهم دلالي مشترك، حيث قام الروبوت Franka F3 Duo بوضع الأشياء في صناديق بينما تولى الروبوت Apollo 2 التابع لشركة Apptronik ترتيبها على الأرفف. هذه المهام التعاونية لم يكن بمقدور أي من الروبوتات إنجازها بشكل منفرد قبل هذا التحديث.

يحقق النموذج دقة تصل إلى 91.3% في تحديد اللحظات الحرجة داخل المهام، وبسرعة تتجاوز نماذج LLM التقليدية بأربعة أضعاف، وفقاً لبيانات الأداء التي نشرتها جوجل. كما يخصص النظام مستوى تقدم لكل إطار فيديو بدقة تبلغ 57.4%، مما يساعد الآلة على اكتشاف الأخطاء وتصحيح مسارها دون الحاجة لإعادة تشغيل تدفق العمل بالكامل في حال حدوث خلل.

يستطيع Gemini Robotics ER 2 استدعاء أدوات خارجية مثل Búsqueda de Google للحصول على معلومات إضافية لإتمام المهام المعقدة.

تتوقف الروبوتات البشرية التي تعمل بهذا النظام تلقائياً عند رصد اقتراب أي شخص، وتستأنف عملها ذاتياً بمجرد خلو المنطقة، حيث يتفوق النموذج الجديد بشكل كبير على سلفه في اختبارات تتبع تعليمات السلامة. النموذج متاح حالياً للمطورين عبر منصة Google AI Studio.

مقالات ذات صلة