Google Luncurkan Gemini Robotics 2.0, Menjanjikan Kelincahan dan Keamanan yang Lebih Baik
Google/DeepMind
Google DeepMind telah meluncurkan Gemini Robotics 2.0, serangkaian model baru untuk mengendalikan robot yang memungkinkan robot melakukan tugas yang lebih kompleks, menganalisis lingkungan yang berubah, dan berinteraksi dengan robot lain. Komponen kunci, Gemini Robotics ER 2, tersedia bagi pengembang melalui Gemini Live API dan menunjukkan peningkatan signifikan dalam pemahaman video dibandingkan versi sebelumnya.
Google telah memperkenalkan Gemini Robotics 2.0, serangkaian model yang memungkinkan robot untuk melakukan tugas yang lebih kompleks, menganalisis lingkungan yang berubah, dan bekerja sama dengan robot lain. Inti dari ini adalah model penalaran berwujud yang disebut Gemini Robotics ER 2, yang merupakan peningkatan signifikan dibandingkan versi sebelumnya, yaitu 1.6. Model ini terintegrasi dengan Gemini Live API, sehingga pengembang dapat memanfaatkan kemampuannya. ER 2 adalah model bahasa visi (VLM) yang mampu memproses aliran video langsung dari kamera robot untuk melacak kemajuan. Google mengklaim bahwa ER 2 dapat mengklasifikasikan kelengkapan segmen video dengan akurasi hampir 60 persen, lebih baik daripada model AI pesaing. Tujuan proyek ini adalah menciptakan robot universal yang mampu melakukan tindakan manusia apa pun, yang kadang disebut sebagai 'AGI fisik'.
Sumber: Ars Technica —
asli
