RobotikModelle 🇺🇸 31.07.2026 18:03

Google stellt Gemini Robotics 2.0 vor und verspricht verbesserte Geschicklichkeit und Sicherheit

Google/DeepMindGoogle/DeepMind
Google DeepMind hat Gemini Robotics 2.0 vorgestellt, eine Reihe neuer Modelle zur Steuerung von Robotern, die es Robotern ermöglichen, komplexere Aufgaben auszuführen, sich ändernde Umgebungen zu analysieren und mit anderen Robotern zu interagieren. Die Schlüsselkomponente, Gemini Robotics ER 2, ist für Entwickler über die Gemini Live API verfügbar und zeigt eine deutliche Verbesserung beim Verständnis von Videos im Vergleich zur vorherigen Version.
Google hat Gemini Robotics 2.0 vorgestellt, eine Reihe von Modellen, die es Robotern ermöglichen, komplexere Aufgaben auszuführen, veränderliche Umgebungen zu analysieren und mit anderen Robotern zu kooperieren. Im Kern basiert das Ganze auf einem Verkörperungsmodell namens Gemini Robotics ER 2, das eine deutliche Verbesserung gegenüber der vorherigen Version 1.6 darstellt. Dieses Modell ist in die Gemini Live API integriert, sodass Entwickler seine Fähigkeiten nutzen können. ER 2 ist ein Vision-Sprachmodell, das in der Lage ist, Live-Videoströme von Roboter-Kameras zu verarbeiten, um den Fortschritt zu verfolgen. Google behauptet, dass ER 2 die Vollständigkeit von Videofragmenten mit einer Genauigkeit von fast 60 Prozent klassifizieren kann, was besser ist als bei konkurrierenden KI-Modellen. Das Ziel des Projekts ist die Schaffung eines universellen Roboters, der beliebige menschliche Handlungen ausführen kann, was manchmal als "physische AGI" bezeichnet wird.
Quelle: Ars Technica — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten