モデルロボティクス 🇺🇸 30.07.2026 18:01

Gemini Robotics ER 2:動画理解、タスクオーケストレーション、複数ロボット連携でロボティクスを強化

Google/DeepMindGoogle/DeepMind Boston DynamicsBoston Dynamics
Google DeepMindは、ロボティクス向けの新しい具現化推論モデル「Gemini Robotics ER 2」を発表しました。このモデルは、リアルタイムの動画理解、複数ステップのタスク計画、複数ロボットの協調作業を実現し、Gemini APIおよびGoogle AI Studioを通じて利用可能です。
Google DeepMindが、ロボット工学向けの具現化推論モデル「Gemini Robotics ER 2」を発表しました。これはロボットの高層脳として機能し、人間との会話、物理世界の理解、マルチステップタスクの計画、そして低レベルの視覚言語行動(VLA)モデルへのモーター実行の引き渡しを行います。このモデルは、Google検索やユーザー定義関数などのツールをネイティブに呼び出せます。ER 1.6から改善され、連続ビデオフィードを処理して進捗を追跡し、失敗に適応し、タスク完了を判断できます。また、マルチロボットコラボレーションが導入され、多様なロボットが協力して作業できるようになりました。Gemini Robotics ER 2は、進捗分類で57.4%の精度、瞬間検出タスクで91.3%の精度を達成し、サブ秒レイテンシを実現しています。また、安全性ベンチマークで従来モデルを上回り、例えば、人が近くにいるときに人型ロボットを停止させることができます。このモデルは、Gemini API、Google AI Studio、およびGemini Enterprise Agent Platformのプライベートプレビューで公開されています。
出典: Google DeepMind — 原文
関連記事 ↓
新着ニュース