ModelosRobótica 🇺🇸 30.07.2026 18:01

Gemini Robotics ER 2: potenciando la robótica con comprensión de video, orquestación de tareas y colaboración multirobot

Google/DeepMindGoogle/DeepMind Boston DynamicsBoston Dynamics
Google DeepMind ha lanzado Gemini Robotics ER 2, un nuevo modelo de razonamiento incorporado para robótica. Permite comprensión de video en tiempo real, planificación de tareas de múltiples pasos y colaboración entre múltiples robots, y está disponible a través de la API de Gemini y Google AI Studio.
Google DeepMind presentó Gemini Robotics ER 2, un modelo de razonamiento incorporado para robótica que actúa como un cerebro de alto nivel para robots. Puede conversar con humanos, comprender el mundo físico, planificar tareas de múltiples pasos y delegar la ejecución motora a modelos de visión-lenguaje-acción (VLA, por sus siglas en inglés) de nivel inferior. El modelo invoca de forma nativa herramientas como Google Search o funciones definidas por el usuario. Mejora respecto a ER 1.6 al procesar flujos de video continuos para rastrear el progreso, adaptarse a fallos y determinar la finalización de tareas. Se introduce la colaboración multi-robot, permitiendo que diversos robots trabajen juntos. Gemini Robotics ER 2 alcanza un 57,4% de precisión en clasificación de progreso y un 91,3% de precisión en tareas de búsqueda de momentos con latencia de menos de un segundo. Supera a modelos anteriores en pruebas de seguridad, incluyendo la detención de un robot humanoide cuando una persona está cerca. El modelo está disponible públicamente a través de la API de Gemini, Google AI Studio y en vista previa privada en la Plataforma de Agentes Empresariales de Gemini.
Fuente: Google DeepMind — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas