Gemini Robotics 2 Brengt Hele Lichaamsintelligentie naar Robots
Google/DeepMind
DeepMind
Google DeepMind introduceert Gemini Robotics 2, een reeks AI-modellen die volledige lichaamscontrole, behendigheid en samenwerking tussen meerdere robots mogelijk maken voor aanpasbare robots. De modellen omvatten een visie-taal-actiemodel (VLA), een belichaamd redeneermodel (ER) en een VLA op het apparaat, die taken ondersteunen van humanoïde lopen tot delicate manipulatie.
Google DeepMind heeft Gemini Robotics 2 aangekondigd, een nieuwe intelligentielaag voor robots die volledige lichaamscontrole, fijne motoriek en samenwerking tussen meerdere robots mogelijk maakt. Het systeem omvat drie modellen: Gemini Robotics 2, een visie-taal-actiemodel (VLA) voor motorische controle; Gemini Robotics ER 2, een belichaamd redeneermodel voor planning en communicatie; en Gemini Robotics On-Device 2, een efficiënt VLA dat is geoptimaliseerd voor lokale uitvoering. Deze modellen kunnen humanoïde robots zoals Apptronik's Apollo 2 aansturen van voeten tot vingertoppen, delicate taken uitvoeren zoals het leggen van knopen met een vijfvingerige hand, en teamwerk tussen meerdere robots mogelijk maken. Het ER-model is beschikbaar in Google AI Studio en in private preview op het Gemini Enterprise Agent Platform, terwijl het VLA en de on-device modellen beschikbaar zijn voor early-access partners. Veiligheidsmaatregelen omvatten de ASIMOV-Agentic benchmark voor veilige toolaanroepen en detectie van menselijke nabijheid. Dit werk markeert een mijlpaal op weg naar algemene fysieke AI.
Bron: Google DeepMind —
origineel
