كل المقالات

Gemini Robotics 2: نموذج جديد من DeepMind للتحكم بأي روبوت من الأذرع المكتبية إلى الروبوتات البشرية

عمر حسن1 أغسطس 2026 في 12:21 ص4 دقيقة للقراءة
Gemini Robotics 2: نموذج جديد من DeepMind للتحكم بأي روبوت من الأذرع المكتبية إلى الروبوتات البشرية

أبرز النقاط

  • Gemini Robotics 2 يتحكم بروبوتات متنوعة من الأذرع الصغيرة إلى الروبوتات البشرية الكاملة
  • النموذج يجمع بين رؤية الصور ومعالجة اللغة والتحكم بالحركة في طبقة ذكاء موحدة
  • DeepMind أطلقت أيضاً Gemini Robotics ER 2 للاستدلال المجسّد عبر Google AI Studio

كشفت Google DeepMind عن Gemini Robotics 2، الذي تصفه بأنه أكثر نماذج الرؤية-اللغة-الفعل (Vision-Language-Action) تطوراً حتى الآن. هذا النموذج قادر على التحكم بأنظمة روبوتية متباينة تماماً، بدءاً من الأذرع الآلية الصغيرة المثبتة على الطاولات وصولاً إلى الروبوتات البشرية كاملة الجسم.

Advertisements

ما هي نماذج VLA ولماذا تُغيّر قواعد اللعبة؟

نماذج VLA تدمج ثلاث قدرات محورية في بنية واحدة: التعرف على الصور، ومعالجة اللغة الطبيعية، والتحكم بالأفعال الفيزيائية. هذا الدمج يتيح للروبوتات فهم بيئتها البصرية، واستيعاب التعليمات اللغوية، ثم تنفيذ إجراءات ملموسة في العالم الحقيقي — كل ذلك عبر نموذج موحد بدلاً من أنظمة منفصلة متصلة ببعضها.

تصف DeepMind نموذجها الجديد بأنه "طبقة ذكاء" لجيل جديد من الروبوتات التكيفية. الفكرة هنا أن الروبوت لا يحتاج برمجة مسبقة لكل مهمة، بل يستطيع التكيف مع مواقف جديدة لم يُدرَّب عليها صراحةً.

ما الذي يستطيع Gemini Robotics 2 فعله؟

  • إدارة حركة الجسم الكامل للروبوتات البشرية (humanoids)
  • تنفيذ مهام حركية دقيقة تتطلب تحكماً عالياً بالأصابع والمفاصل
  • تنسيق العمل بين روبوتات متعددة تعمل معاً على مهمة مشتركة
  • التعامل مع أشكال مختلفة من الأجسام الروبوتية دون إعادة تدريب جذرية
من الذراع المكتبية إلى الروبوت البشري
نطاق الأنظمة التي يدعمها Gemini Robotics 2 يغطي طيفاً واسعاً من الأشكال الروبوتية

Gemini Robotics ER 2: طبقة الاستدلال المجسّد

إلى جانب النموذج الرئيسي، أطلقت DeepMind نموذج Gemini Robotics ER 2 المخصص لما تسميه "الاستدلال المجسّد" (Embodied Reasoning). هذا المصطلح يشير إلى قدرة النظام على فهم العالم الفيزيائي واتخاذ قرارات بشأن الأفعال المناسبة بناءً على ذلك الفهم.

يعمل ER 2 كنظام تحكم عالي المستوى، أي أنه يتولى التخطيط والقرارات الاستراتيجية بينما تتولى طبقات أدنى تنفيذ الحركات الفعلية. هذا النموذج يحل محل Gemini Robotics ER 1.6 الذي أُطلق في أبريل الماضي، وهو متاح الآن عبر Google AI Studio.

Advertisements

كيف يمكن للمطورين الوصول إلى النموذج؟

أتاحت DeepMind قائمة انتظار للوصول المبكر إلى Gemini Robotics 2. المطورون وفرق المنتجات المهتمون بدمج النموذج في أنظمتهم الروبوتية يمكنهم التقديم عبر هذه القائمة. أما Gemini Robotics ER 2 فهو متاح مباشرةً عبر Google AI Studio، مما يتيح للمطورين البدء بتجربة قدرات الاستدلال المجسّد دون انتظار.

ℹ️

رأي Logicity

هذا الإعلان يضع DeepMind في موقع تنافسي مباشر مع Figure AI (التي تجمع بين OpenAI ونماذجها الخاصة) وBoston Dynamics (المدعومة من Hyundai) وTesla Optimus. الفارق الجوهري هنا هو نهج "النموذج الواحد للجميع": بدلاً من تدريب نموذج لكل شكل روبوتي، تراهن DeepMind على نموذج عام يتكيف مع أي جسم. إذا نجح هذا النهج، فقد يخفض تكلفة تطوير الروبوتات الذكية بشكل جذري ويُسرّع دورة الابتكار — لكن التحدي يبقى في الأداء الفعلي عند الانتقال من العروض التوضيحية إلى البيئات الصناعية الحقيقية.

ماذا يعني هذا لمستقبل الروبوتات؟

التحول نحو نماذج VLA العامة يعكس توجهاً أوسع في صناعة الذكاء الاصطناعي: بناء أنظمة أساسية (foundation models) للروبوتات بدلاً من حلول مخصصة لكل تطبيق. هذا يشبه ما حدث في معالجة اللغة مع GPT وفي توليد الصور مع DALL-E — نموذج واحد قوي يُكيَّف لاستخدامات متعددة.

النتيجة المحتملة: شركات الروبوتات الناشئة لن تحتاج لبناء "عقل" روبوتها من الصفر، بل ستستخدم طبقة ذكاء جاهزة مثل Gemini Robotics 2 وتركز على الأجهزة والتطبيقات المتخصصة.

الأسئلة الشائعة

ما الفرق بين Gemini Robotics 2 و Gemini Robotics ER 2؟

Gemini Robotics 2 هو نموذج VLA للتحكم المباشر بحركة الروبوتات، بينما ER 2 هو نموذج للاستدلال المجسّد يعمل كطبقة تخطيط عالية المستوى تفهم البيئة الفيزيائية وتقرر الأفعال المناسبة.

هل يمكن استخدام Gemini Robotics 2 مع أي روبوت؟

وفقاً لـ DeepMind، النموذج مصمم للتعامل مع أنظمة روبوتية متنوعة من الأذرع المكتبية إلى الروبوتات البشرية، لكن الوصول حالياً عبر قائمة انتظار للمطورين.

كيف أحصل على وصول مبكر لـ Gemini Robotics 2؟

يمكنك التقديم عبر قائمة الانتظار التي أتاحتها DeepMind. أما Gemini Robotics ER 2 فهو متاح مباشرةً عبر Google AI Studio.

ما هي نماذج VLA في الذكاء الاصطناعي؟

نماذج Vision-Language-Action تجمع بين التعرف على الصور ومعالجة اللغة والتحكم بالأفعال الفيزيائية في نموذج موحد، مما يتيح للروبوتات فهم بيئتها وتنفيذ مهام بناءً على تعليمات لغوية.

ℹ️

هل تحتاج مساعدة في التطبيق؟

إذا كنت تعمل على مشروع روبوتات وتريد فهم كيفية دمج نماذج VLA مثل Gemini Robotics 2 في نظامك، تواصل مع فريق Logicity للحصول على استشارة تقنية متخصصة.

ع

عمر حسن

كاتب تقني وابتكار

أُنتِج هذا المقال بمساعدة الذكاء الاصطناعي وراجعه فريق التحرير في لوجيسيتي. اعرف المزيد في سياسة التحرير.

اقرأ أيضاً