جيميني روبوتيكس 2 تجلب الذكاء الكامل للجسم إلى الروبوتات
Google/DeepMind
DeepMind
تقدم جوجل ديب مايند جيميني روبوتيكس 2، وهي مجموعة من نماذج الذكاء الاصطناعي تتيح التحكم الكامل بالجسم والبراعة والتعاون بين عدة روبوتات لتكييف الروبوتات. تتضمن النماذج نموذج الرؤية-اللغة-الفعل (VLA)، ونموذج التفكير المجسد (ER)، وVLA على الجهاز، لدعم مهام من المشي البشري إلى التلاعب الدقيق.
أعلنت جوجل ديب مايند عن روبوتات جيميني 2 (Gemini Robotics 2)، وهي طبقة ذكاء جديدة للروبوتات تتيح التحكم الكامل بالجسم، والبراعة الدقيقة، والتعاون بين عدة روبوتات. يتضمن النظام ثلاثة نماذج: روبوتات جيميني 2 (Gemini Robotics 2)، وهو نموذج رؤية-لغة-فعل (VLA) للتحكم الحركي؛ روبوتات جيميني إي آر 2 (Gemini Robotics ER 2)، وهو نموذج استدلال تجسيدي للتخطيط والتواصل؛ روبوتات جيميني أون-ديفايس 2 (Gemini Robotics On-Device 2)، وهو نموذج VLA فعال مُحسَّن للتنفيذ المحلي. يمكن لهذه النماذج التحكم في الروبوتات البشرية مثل أبولو 2 (Apollo 2) من أبرترونيك من القدمين إلى أطراف الأصابع، وأداء مهام دقيقة مثل ربط العُقد بيد خماسية الأصابع، وتمكين العمل الجماعي بين عدة روبوتات. يتوفر نموذج الاستدلال التجسيدي (ER) على جوجل إيه آي ستوديو (Google AI Studio) وفي معاينة خاصة على منصة جيميني إنتربرايز إيجنت (Gemini Enterprise Agent Platform)، بينما تكون نماذج VLA والنموذج المحلي متاحة لشركاء الوصول المبكر. تشمل إجراءات السلامة معيار ASIMOV-Agentic للمكالمات الآمنة للأدوات وكشف الاقتراب البشري. يمثل هذا العمل علامة فارقة نحو الذكاء الاصطناعي الفيزيائي متعدد الاستخدامات.
المصدر: Google DeepMind —
الأصلي
