Gemini Robotics 2 为机器人带来全身智能
Google/DeepMind
DeepMind
谷歌DeepMind推出Gemini Robotics 2,这是一套AI模型,支持全身控制、灵巧操作和多机器人协作,使机器人更具适应性。这些模型包括视觉-语言-动作模型(VLA)、具身推理模型(ER)以及设备端VLA,能够执行从人形机器人行走到精细操作等任务。
Google DeepMind发布了Gemini Robotics 2,这是一个面向机器人的全新智能层,可实现全身控制、精细操作以及多机器人协作。该系统包含三个模型:Gemini Robotics 2,一个用于电机控制的视觉-语言-动作模型(Vision-Language-Action Model, VLA);Gemini Robotics ER 2,一个面向规划和通信的具体化推理模型(Embodied Reasoning Model, ER);以及Gemini Robotics On-Device 2,一个针对本地执行优化的高效VLA模型。这些模型能够控制像Apptronik的Apollo 2这样的人形机器人从足部到指尖的所有关节,执行诸如用五指手打结等精细任务,并支持多机器人团队协作。ER模型现已在Google AI Studio上线,并在Gemini企业版Agent平台中提供私有预览;而VLA和本地模型则面向早期合作伙伴开放。安全措施包括用于安全工具调用和人机距离检测的ASIMOV-Agentic基准测试。这一成果标志着向通用物理人工智能迈出了重要一步。
来源: Google DeepMind —
原文
