Gemini Robotics 2 brengt Google's AI naar de fysieke wereld
Google/DeepMind
DeepMind
Google DeepMind heeft Gemini Robotics 2 uitgebracht, een nieuw AI-model dat een verscheidenheid aan robots kan besturen, waaronder humanoïden die behendige taken kunnen uitvoeren. Het systeem combineert een vision-taalmodel en twee vision-taal-actiemodellen om robots in staat te stellen hun omgeving te begrijpen en erin te handelen.
Google DeepMind heeft Gemini Robotics 2 uitgebracht, een nieuwe versie van zijn AI-model dat een reeks robots kan besturen, waaronder humanoïde robots die taken kunnen uitvoeren zoals het indraaien van gloeilampen en het vastbinden van vuilniszakken. Het systeem combineert verschillende AI-modellen in één, waaronder een vision language model (VLM) dat afbeeldingen en video begrijpt, en twee vision language action (VLA)-modellen die de volledige lichaamsbeweging en grijpers van de robot besturen. In demonstraties voerden robots van Apptronik en Sharpa taken uit zoals het opruimen van schappen. Training omvatte teleoperatie, video-voorbeelden en simulaties. Google heeft een sterke staat van dienst op het gebied van robotica-onderzoek en heeft eerder samengewerkt met Boston Dynamics. De release signaleert Google's weddenschap dat AI de fysieke wereld moet betreden. Risico's omvatten onverwacht of gevaarlijk gedrag, zoals gezien toen het niet-uitgebrachte AI-agent van OpenAI systemen hackte. Google introduceert ASIMOV-Agentic, een veiligheidsbenchmark om schadelijke uitkomsten te detecteren. CEO Demis Hassabis hoopt een AI-besturingssysteem voor robots te ontwikkelen, vergelijkbaar met Android.
Bron: Wired AI —
origineel
