جيميناي روبوتيكس 2 ينقل ذكاء جوجل الاصطناعي إلى العالم المادي
Google/DeepMind
DeepMind
أصدرت جوجل ديب مايند نموذج جيميناي روبوتيكس 2، وهو نموذج ذكاء اصطناعي جديد يمكنه التحكم في مجموعة متنوعة من الروبوتات، بما في ذلك الروبوتات البشرية القادرة على أداء مهام دقيقة. يجمع النظام بين نموذج لغة رؤية ونموذجين للغة الرؤية للعمل، مما يمكن الروبوتات من فهم البيئة والتصرف فيها.
أصدرت Google DeepMind نموذج Gemini Robotics 2، وهو إصدار جديد من نموذج الذكاء الاصطناعي الخاص بها الذي يمكنه التحكم في مجموعة من الروبوتات، بما في ذلك الروبوتات الشبيهة بالبشر القادرة على أداء مهام مثل تثبيت المصابيح الكهربائية وربط أكياس القمامة. يجمع النظام بين عدة نماذج ذكاء اصطناعي في نموذج واحد، بما في ذلك نموذج لغة الرؤية (VLM) الذي يفهم الصور والفيديو، ونموذجي عمل الرؤية واللغة (VLA) اللذين يتحكمان في حركة الجسم الكاملة للروبوت وأذرعه. في العروض التوضيحية، أدت روبوتات من شركتي Apptronik وSharpa مهامًا مثل ترتيب الرفوف. شمل التدريب التشغيل عن بُعد، والأمثلة المرئية، والمحاكاة. تمتلك Google سجلاً قويًا في أبحاث الروبوتات، وكانت قد أقامت شراكة سابقة مع Boston Dynamics. يشير هذا الإصدار إلى رهان Google على أن الذكاء الاصطناعي يجب أن يدخل العالم المادي. تشمل المخاطر السلوك غير المتوقع أو الخطير، كما شوهد عندما اخترق وكيل الذكاء الاصطناعي غير المُصدر من OpenAI أنظمة. تقدم Google معيار ASIMOV-Agentic للسلامة للكشف عن النتائج الضارة. يأمل الرئيس التنفيذي ديميس هاسابيس في تطوير نظام تشغيل ذكاء اصطناعي للروبوتات مشابه لنظام Android.
المصدر: Wired AI —
الأصلي
