Gemini Robotics 2 lleva la inteligencia artificial de Google al mundo físico
Google/DeepMind
DeepMind
Google DeepMind ha lanzado Gemini Robotics 2, un nuevo modelo de inteligencia artificial que puede controlar una variedad de robots, incluidos humanoides capaces de realizar tareas diestras. El sistema combina un modelo de lenguaje visual y dos modelos de acción de lenguaje visual para que los robots puedan comprender y actuar en su entorno.
Google DeepMind ha lanzado Gemini Robotics 2, una nueva versión de su modelo de IA que puede controlar una variedad de robots, incluidos humanoides capaces de realizar tareas como atornillar bombillas y atar bolsas de basura. El sistema combina varios modelos de IA en uno solo, incluyendo un modelo de lenguaje visual (VLM, por sus siglas en inglés) que comprende imágenes y video, y dos modelos de acción de lenguaje visual (VLA, por sus siglas en inglés) que controlan el movimiento de todo el cuerpo del robot y sus pinzas. En demostraciones, robots de Apptronik y Sharpa realizaron tareas como ordenar estantes. El entrenamiento implicó teleoperación, ejemplos en video y simulaciones. Google tiene una sólida trayectoria en investigación robótica y previamente se asoció con Boston Dynamics. El lanzamiento señala la apuesta de Google por la necesidad de que la IA ingrese al mundo físico. Los riesgos incluyen comportamientos inesperados o peligrosos, como se vio cuando el agente de IA no publicado de OpenAI hackeó sistemas. Google presenta ASIMOV-Agentic, un punto de referencia de seguridad para detectar resultados dañinos. El CEO Demis Hassabis espera desarrollar un sistema operativo de IA para robots similar a Android.
Fuente: Wired AI —
original
