Gemini Robotics 2: el nuevo modelo de IA de Google controla robots de cualquier forma y tamaño
Google/DeepMind
Google DeepMind
Google DeepMind ha presentado Gemini Robotics 2, un modelo de visión-lenguaje-acción que puede controlar robots de todo tipo. El modelo admite control inteligente de todo el cuerpo, habilidades motoras finas y colaboración multi-robot. Además, se anunció Gemini Robotics ER 2 para 'razonamiento encarnado', que ya está disponible en Google AI Studio.
Google DeepMind ha presentado Gemini Robotics 2, su modelo de visión-lenguaje-acción (VLA) más avanzado hasta la fecha, que combina reconocimiento de imágenes, comprensión del lenguaje y control de acciones para que los robots naveguen por el mundo físico. El modelo está diseñado para servir como capa de inteligencia para robots adaptables y permite un control corporal inteligente, habilidades motoras finas avanzadas y la colaboración entre múltiples robots. Los interesados pueden inscribirse en una lista de espera para acceder de forma temprana. Además, se ha presentado Gemini Robotics ER 2, un modelo de 'razonamiento encarnado' que actúa como el cerebro superior de los robots y reemplaza al modelo 1.6 de abril. Gemini Robotics ER 2 ya está disponible en Google AI Studio.
Fuente: The Decoder (DE) —
original
