RobóticaModelos 🇺🇸 31.07.2026 18:03

Google apresenta Gemini Robotics 2.0, prometendo maior destreza e segurança

Google/DeepMindGoogle/DeepMind
O Google DeepMind apresentou o Gemini Robotics 2.0, um conjunto de novos modelos para controlar robôs, que permite que eles executem tarefas mais complexas, analisem ambientes em mudança e interajam com outros robôs. O componente-chave, o Gemini Robotics ER 2, está disponível para desenvolvedores por meio do Gemini Live API e demonstra uma melhoria significativa na compreensão de vídeo em comparação com a versão anterior.
O Google apresentou o Gemini Robotics 2.0, um conjunto de modelos que permite aos robôs executar tarefas mais complexas, analisar ambientes em mudança e colaborar com outros robôs. Na base está um modelo de raciocínio incorporado chamado Gemini Robotics ER 2, que representa uma melhoria significativa em relação à versão anterior 1.6. Este modelo está integrado à API Gemini Live, permitindo que desenvolvedores utilizem seus recursos. O ER 2 é um modelo de linguagem visual (VLM, na sigla em inglês), capaz de processar fluxos de vídeo ao vivo das câmeras do robô para acompanhar o progresso. O Google afirma que o ER 2 pode classificar a completude de segmentos de vídeo com precisão de quase 60%, superando modelos de IA concorrentes. O objetivo do projeto é criar um robô universal capaz de realizar qualquer ação humana, o que às vezes é chamado de 'AGI físico'.
Fonte: Ars Technica — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas