ModelRobotika 🇺🇸 30.07.2026 18:01

Gemini Robotics ER 2: memberdayakan robotika dengan pemahaman video, orkestrasi tugas, dan kolaborasi multi-robot

Google/DeepMindGoogle/DeepMind Boston DynamicsBoston Dynamics
Google DeepMind telah meluncurkan Gemini Robotics ER 2, model penalaran embodied baru untuk robotika. Model ini memungkinkan pemahaman video real-time, perencanaan tugas multi-langkah, dan kolaborasi multi-robot, dan tersedia melalui Gemini API dan Google AI Studio.
Google DeepMind memperkenalkan Gemini Robotics ER 2, sebuah model penalaran berwujud (embodied reasoning) untuk robotika yang berfungsi sebagai otak tingkat tinggi bagi robot. Model ini dapat berkomunikasi dengan manusia, memahami dunia fisik, merencanakan tugas multi-langkah, serta menyerahkan eksekusi motorik ke model visi-bahasa-aksi (vision-language-action/VLA) tingkat rendah. Model ini secara native memanggil alat seperti Google Search atau fungsi yang ditentukan pengguna. Dibandingkan ER 1.6, model ini lebih baik karena memproses umpan video kontinu untuk melacak kemajuan, beradaptasi terhadap kegagalan, dan menentukan penyelesaian tugas. Kolaborasi multi-robot diperkenalkan, memungkinkan berbagai robot bekerja sama. Gemini Robotics ER 2 mencapai akurasi 57,4% pada klasifikasi kemajuan dan 91,3% pada tugas pencarian momen dengan latensi di bawah satu detik. Model ini mengungguli model sebelumnya pada tolok ukur keselamatan, termasuk menghentikan robot humanoid saat ada orang di dekatnya. Model ini tersedia untuk publik melalui Gemini API, Google AI Studio, dan dalam pratinjau pribadi di Gemini Enterprise Agent Platform.
Sumber: Google DeepMind — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru