Gemini Robotics 2: Googleの新しいAIモデルが、あらゆる形状・サイズのロボットを制御
Google/DeepMind
Google DeepMind
Google DeepMindは、あらゆる種類のロボットを制御できるビジョン・ランゲージ・アクション(Vision-Language-Action)モデルであるGemini Robotics 2を発表しました。このモデルは、インテリジェントな全身制御、巧みな運動能力、マルチロボット協調をサポートします。また、「身体的推論(Embodied Reasoning)」のためのGemini Robotics ER 2も発表され、これはすでにGoogle AI Studioで利用可能です。
Google DeepMindは、同社がこれまでに開発した中で最も先進的なVision-Language-Actionモデル(VLA)であるGemini Robotics 2を発表しました。これは、画像認識、言語理解、行動制御を組み合わせ、ロボットが物理的な世界をナビゲートできるようにするものです。このモデルは、適応型ロボットのためのインテリジェンス層として機能し、知的な全身制御、高度な微細運動スキル、複数ロボットの協調を可能にします。関心のあるユーザーは、早期アクセスのためのウェイトリストに登録できます。さらに、ロボットの上位脳として機能する「具現化推論」モデルであるGemini Robotics ER 2も導入されました。これは4月に発表された従来のモデル1.6を置き換えるものです。Gemini Robotics ER 2は、Google AI Studioですでに利用可能です。
出典: The Decoder (DE) —
原文
