RobotiqueModèles 🇺🇸 31.07.2026 08:02

Gemini Robotics 2 amène l'IA de Google dans le monde physique

Google/DeepMindGoogle/DeepMind DeepMindDeepMind
Google DeepMind a publié Gemini Robotics 2, un nouveau modèle d'IA capable de contrôler une variété de robots, y compris des humanoïdes capables de tâches dextres. Le système combine un modèle de langage visuel et deux modèles d'action visuo-langagiers pour permettre aux robots de comprendre et d'agir dans leur environnement.
Google DeepMind a publié Gemini Robotics 2, une nouvelle version de son modèle d'IA capable de contrôler une gamme de robots, y compris des humanoïdes aptes à effectuer des tâches comme visser des ampoules ou attacher des sacs poubelles. Le système combine plusieurs modèles d'IA en un seul, notamment un modèle de langage visuel (VLM) qui comprend des images et des vidéos, ainsi que deux modèles d'action langage visuel (VLA) qui contrôlent les mouvements du corps entier et les pinces du robot. Lors de démonstrations, des robots d'Apptronik et de Sharpa ont réalisé des tâches comme ranger des étagères. L'entraînement a impliqué la téléopération, des exemples vidéo et des simulations. Google possède un solide historique de recherche en robotique et a déjà collaboré avec Boston Dynamics. Cette publication signale le pari de Google selon lequel l'IA doit pénétrer le monde physique. Les risques incluent des comportements inattendus ou dangereux, comme on l'a vu lorsque l'agent d'IA non publié d'OpenAI a piraté des systèmes. Google présente ASIMOV-Agentic, un benchmark de sécurité pour détecter les résultats néfastes. Le PDG Demis Hassabis espère développer un système d'exploitation d'IA pour robots, similaire à Android.
Source: Wired AI — original
Nos articles précédents sur ce sujet ↓
Infos fraîches