ロボティクス研究 🇺🇸 30.07.2026 18:02

Gemini Robotics 2がロボットに全身知能をもたらす

Google/DeepMindGoogle/DeepMind DeepMindDeepMind
Google DeepMindがGemini Robotics 2を発表。これはロボットの全身制御、器用さ、マルチロボット連携を可能にするAIモデル群で、視覚言語行動モデル(VLA)、具現化推論モデル(ER)、オンデバイスVLAを含む。ヒューマノイドの歩行から繊細な操作まで対応する。
Google DeepMindは、ロボットの全身制御、高度な器用さ、およびマルチロボット協調を実現する新たな知能層「Gemini Robotics 2」を発表しました。このシステムは、モーター制御のための視覚言語行動モデル(VLA)であるGemini Robotics 2、計画とコミュニケーションのための具現化推論モデルであるGemini Robotics ER 2、およびローカル実行に最適化された効率的なVLAであるGemini Robotics On-Device 2の3つのモデルで構成されています。これらのモデルは、Apptronik社のApollo 2のような人型ロボットを足の指先まで制御し、5本指のハンドで結び目を作るような繊細な作業を実行し、マルチロボットでのチームワークを可能にします。ERモデルはGoogle AI Studioで利用可能であり、Gemini Enterprise Agent Platformでプライベートプレビューとして提供されています。一方、VLAとオンデバイスモデルは早期アクセスパートナー向けです。安全対策として、安全なツール呼び出しと人体近接検出のためのASIMOV-Agenticベンチマークが含まれています。この取り組みは、汎用物理人工知能(Physical AI)に向けたマイルストーンとなります。
出典: Google DeepMind — 原文
関連記事 ↓
新着ニュース