模型机器人 🇺🇸 30.07.2026 18:01

Gemini Robotics ER 2:借助视频理解、任务编排与多机器人协作赋能机器人

Google/DeepMindGoogle/DeepMind Boston DynamicsBoston Dynamics
Google DeepMind 发布了 Gemini Robotics ER 2,这是一种用于机器人技术的新型具身推理模型。它能够实现实时视频理解、多步骤任务规划以及多机器人协作,并可通过 Gemini API 和 Google AI Studio 使用。
Google DeepMind 推出了 Gemini Robotics ER 2,这是一款用于机器人的具身推理模型,充当机器人的高级大脑。它可以与人对话,理解物理世界,规划多步骤任务,并将电机执行交给底层视觉-语言-动作(VLA)模型。该模型原生调用诸如 Google 搜索或用户自定义函数等工具。相较 ER 1.6,它通过处理连续视频流来跟踪进度、适应失败并判断任务完成情况,从而实现了改进。多机器人协作功能被引入,使得不同类型的机器人能够协同工作。Gemini Robotics ER 2 在进度分类任务上达到 57.4% 的准确率,在瞬间定位任务上达到 91.3% 的准确率,且延迟低于亚秒级。它在安全基准测试上优于之前的模型,包括当有人靠近时让人形机器人停止动作。该模型可通过 Gemini 应用程序接口、Google 人工智能工作室公开获取,并可通过 Gemini 企业智能体平台以私有预览版形式获取。
来源: Google DeepMind — 原文
我们之前关于此话题的帖子 ↓
最新新闻