ロボティクスモデル 🇨🇳 05.08.2026 11:01

Google、ロボットを「万能労働者」に変える3つの新モデルを発表:迅速な適応、全身制御、チーム連携

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
Google DeepMindは7月30日、Gemini Robotics 2を発表しました。これは、人型ロボットやその他のロボットに全身制御、高度な器用さ、複数ロボットの協調を可能にする3つのAIモデル群です。モデルには、全身制御のためのVLAモデル、計画と協調のための具現化推論VLM、そして迅速な適応のためのデバイスローカルモデルが含まれます。Googleは、ASIMOV-Agenticという新しいベンチマークで安全性を重視しています。
7月30日、Google DeepMindは、Gemini Robotics 2を発表しました。これは、人型ロボットを含むさまざまなロボットを制御するためのAIモデルシリーズの新バージョンで、予測不可能な環境に自律的に適応し、各動作について推論することで、ゴミの清掃やじょうろの持ち上げなど、幅広いタスクを実行できるようにします。このアップデートにより、知的全身制御、高度な器用さ、複数ロボットの協調が追加され、ロボット工学の新たな段階を示しています。以前のGemini Roboticsシステムは、ロボットアームとハンドのみで、袋の密封や折り紙の折りたたみなどの精密な操作を実行できました。新しいモデルはデバイス上で動作し、数時間以内にまったく新しいロボットのボディに適応し、学習したスキルを異なるプラットフォーム間で転送できます。また、異なるロボットが協力してタスクをより速く完了することも可能です。Googleはこれを、ロボットが人間のできることをすべて実行できる物理的AGIへのマイルストーンと見なしています。デモ動画では、Apptronik Apollo 2人型ロボットがじょうろを緑の箱に置くなどのコマンドに従い、ロボットが本を棚に置いたり、ボードを整理したり、テープをラジオに入れたりするタスクを実行する様子が示されています。このシステムは、Apollo 2の22自由度のSharpaWaveハンドなど、非常に器用な5本指ハンドをサポートし、結び目を結んだりジッパー付き袋を密封したりするタスクを実行できます。また、Franka Duoなどの標準的な2本指グリッパーもサポートします。Googleは、3つの全身操作カテゴリで45.7%から76.3%、3つのFranka Duoグリッパーカテゴリで74.2%から89.6%、多指タスクで32%から92%の成功率を報告しています。動画は完全に自律的なロボットを示しており、遠隔操作が使用されたと報じられたElon MuskのOptimusと対照的です。ただし、これらのロボットは汎用ではありません。各タスクは、遠隔操作、ビデオ例、シミュレーションを使用して特別にトレーニングされます。Googleのアプローチには、3つの異なるモデルが含まれます。Gemini Robotics 2は、視覚と言語の入力をモーター制御に変換して全身制御を行うVLAモデルです。Gemini Robotics ER 2は、コミュニケーション、マルチステップタスクの計画、ロボットチームの協調を可能にする頭脳エージェントとして機能する具現化推論VLMです。Gemini Robotics On-Device 2は、新しいロボットボディへの高速適応を備えたローカル実行用のVLAモデルで、Gemini Robotics 1.5から継承されています。安全性のために、GoogleはASIMOV-Agenticを導入しました。これは、エージェントの安全性オーケストレーションと不確実性解決のためのベンチマークで、エージェントが安全でないツール呼び出しを拒否し、タスクの完了を予測する能力を測定します。Gemini Robotics ER 2はこれまでで最も安全なロボットモデルであり、人間の近接を検出してロボットを停止させることができます。ソフトウェアはロボットボディ上で動作しますが、その多くは中国製であり、米国が最近中国製ロボットに制限を課しているにもかかわらずです。
出典: InfoQ 中国 — 原文
関連記事 ↓
新着ニュース