ロボティクスモデル 🇺🇸 31.07.2026 08:02

Gemini Robotics 2、GoogleのAIを物理世界へ

Google/DeepMindGoogle/DeepMind DeepMindDeepMind
Google DeepMindは、多様なロボット(器用な作業が可能な人型ロボットを含む)を制御できる新しいAIモデル「Gemini Robotics 2」を発表しました。このシステムは、視覚言語モデルと2つの視覚言語アクションモデルを組み合わせることで、ロボットが環境を理解し行動することを可能にします。
Google DeepMindは、ロボットを制御できるAIモデルの新バージョン「Gemini Robotics 2」を公開した。このモデルは、電球のねじ込みやゴミ袋の結び目作りなどの作業が可能な人型ロボットを含む、さまざまなロボットを制御できる。このシステムは複数のAIモデルを1つに統合したもので、画像や動画を理解する視覚言語モデル(VLM:Vision Language Model)と、ロボットの全身の動きやグリッパーを制御する2つの視覚言語行動モデル(VLA:Vision Language Action)で構成されている。デモでは、ApptronikやSharpa製のロボットが棚の整理などの作業を行った。トレーニングには、遠隔操作、動画例、シミュレーションが用いられた。Googleはロボット工学の研究で実績があり、以前はBoston Dynamicsと提携していた。今回の公開は、AIが物理世界に進出する必要があるというGoogleの賭けを示している。リスクとしては、OpenAIが未公開のAIエージェントでシステムをハッキングした際に見られたような、予期せぬ危険な行動が挙げられる。Googleは、有害な結果を検出する安全ベンチマーク「ASIMOV-Agentic」を導入する。CEOのDemis Hassabis氏は、Androidと同様のロボット向けAIオペレーティングシステムの開発を目指している。
出典: Wired AI — 原文
関連記事 ↓
新着ニュース