Gemini Robotics 2, Robotlara Tüm Vücut Zekası Getiriyor
Google/DeepMind
DeepMind
Google DeepMind, uyarlanabilir robotlar için tüm vücut kontrolü, el becerisi ve çoklu robot iş birliğini mümkün kılan bir yapay zeka modelleri paketi olan Gemini Robotics 2'yi tanıttı. Modeller arasında bir görme-dil-eylem modeli (VLA), bir somutlaştırılmış akıl yürütme modeli (ER) ve bir cihaz üstü VLA yer alıyor; insansı yürüyüşten hassas manipülasyona kadar çeşitli görevleri destekliyor.
Google DeepMind, robotlar için tüm vücut kontrolü, hassas el becerisi ve çoklu robot iş birliğini mümkün kılan yeni bir zeka katmanı olan Gemini Robotics 2'yi duyurdu. Sistem üç model içeriyor: motor kontrolü için bir görsel-dil-eylem modeli olan Gemini Robotics 2; planlama ve iletişim için somutlaştırılmış akıl yürütme modeli olan Gemini Robotics ER 2; ve yerel yürütme için optimize edilmiş verimli bir görsel-dil-eylem modeli olan Gemini Robotics Cihaz-İçi 2. Bu modeller, Apptronik'in Apollon 2'si gibi insansı robotları ayak parmaklarından parmak uçlarına kadar kontrol edebilir, beş parmaklı bir el ile düğüm atma gibi hassas görevleri gerçekleştirebilir ve çoklu robot ekip çalışmasını mümkün kılar. Somutlaştırılmış akıl yürütme modeli, Google AI Studio'da ve Gemini Enterprise Agent Platform'da özel ön izlemede sunulurken; görsel-dil-eylem modeli ve cihaz-içi model erken erişim ortakları içindir. Güvenlik önlemleri arasında güvenli araç çağrıları ve insan yakınlığı tespiti için ASIMOV-Ajanlık değerlendirme aracı yer alıyor. Bu çalışma, genel amaçlı fiziksel yapay zekaya doğru bir dönüm noktası niteliği taşıyor.
Kaynak: Google DeepMind —
orijinal
