机器人研究 🇺🇸 30.07.2026 18:02

Gemini Robotics 2 为机器人带来全身智能

Google/DeepMindGoogle/DeepMind DeepMindDeepMind
谷歌 DeepMind 推出 Gemini Robotics 2,这是一套 AI 模型,能够实现机器人的全身控制、灵巧操作和多人协作,使机器人适应各种任务。模型包括视觉-语言-动作模型 (VLA)、具身推理模型 (ER) 和端侧 VLA,支持从人形机器人行走到精细操作等任务。
Google DeepMind发布了Gemini Robotics 2,这是一个面向机器人的全新智能层,可实现全身控制、精细操作以及多机器人协作。该系统包含三个模型:Gemini Robotics 2,一个用于电机控制的视觉-语言-动作模型(Vision-Language-Action Model, VLA);Gemini Robotics ER 2,一个面向规划和通信的具体化推理模型(Embodied Reasoning Model, ER);以及Gemini Robotics On-Device 2,一个针对本地执行优化的高效VLA模型。这些模型能够控制像Apptronik的Apollo 2这样的人形机器人从足部到指尖的所有关节,执行诸如用五指手打结等精细任务,并支持多机器人团队协作。ER模型现已在Google AI Studio上线,并在Gemini企业版Agent平台中提供私有预览;而VLA和本地模型则面向早期合作伙伴开放。安全措施包括用于安全工具调用和人机距离检测的ASIMOV-Agentic基准测试。这一成果标志着向通用物理人工智能迈出了重要一步。
来源: Google DeepMind — 原文
我们之前关于此话题的帖子 ↓
最新新闻