Gemini Robotics 2, Google'ın yapay zekasını fiziksel dünyaya taşıyor
Google/DeepMind
DeepMind
Google DeepMind, çeşitli robotları kontrol edebilen ve insansıların beceri gerektiren görevleri yapabilmesini sağlayan yeni bir yapay zeka modeli olan Gemini Robotics 2'yi yayınladı. Sistem, robotların çevrelerini anlamasını ve bu ortamda hareket etmesini sağlamak için bir görsel dil modeli ile iki görsel dil eylem modelini birleştiriyor.
Google DeepMind, insansı robotlar da dahil olmak üzere çeşitli robotları kontrol edebilen yapay zeka modelinin yeni bir sürümü olan Gemini Robotics 2'yi yayınladı. Bu model, ampul vidalama ve çöp poşeti bağlama gibi görevleri yapabilen insansı robotları kontrol edebiliyor. Sistem, görüntü ve videoyu anlayan bir görsel dil modelini (VLM) ve robotun tüm vücut hareketlerini ve tutucularını kontrol eden iki görsel dil eylem modelini (VLA) içeren birkaç yapay zeka modelini tek bir çatı altında birleştiriyor. Gösterimlerde, Apptronik ve Sharpa'dan robotlar rafları düzenleme gibi görevleri gerçekleştirdi. Eğitim, teleoperasyon, video örnekleri ve simülasyonları içeriyordu. Google'ın güçlü bir robotik araştırma geçmişi var ve daha önce Boston Dynamics ile ortaklık kurmuştu. Bu sürüm, Google'ın yapay zekanın fiziksel dünyaya girmesi gerektiğine dair bir iddiasını işaret ediyor. Riskler, OpenAI'nin yayınlanmamış yapay zeka ajanının sistemleri hacklediği durumda görüldüğü gibi beklenmedik veya tehlikeli davranışları içeriyor. Google, zararlı sonuçları tespit etmek için ASIMOV-Agentic adlı bir güvenlik kriteri sunuyor. CEO Demis Hassabis, Android'e benzer şekilde robotlar için bir yapay zeka işletim sistemi geliştirmeyi umuyor.
Kaynak: Wired AI —
orijinal
