Gemini Robotics 2: 구글의 새로운 AI 모델, 모든 형태와 크기의 로봇을 제어하다
Google/DeepMind
Google DeepMind
Google DeepMind가 Gemini Robotics 2를 공개했습니다. 이는 다양한 형태의 로봇을 제어할 수 있는 비전-언어-행동 모델입니다. 이 모델은 지능형 전신 제어, 정밀한 조작, 다중 로봇 협업을 지원합니다. 또한 '구체화된 추론(Embodied Reasoning)'을 위한 Gemini Robotics ER 2도 발표되었으며, 이는 이미 Google AI Studio에서 사용할 수 있습니다.
Google DeepMind이 Gemini Robotics 2를 공개했는데, 이는 이미지 인식, 언어 이해, 행동 제어를 결합하여 로봇이 물리적 세계를 탐색할 수 있게 하는 가장 진보된 비전-언어-행동 모델(VLA)입니다. 이 모델은 적응형 로봇을 위한 지능 계층 역할을 하도록 설계되었으며, 지능적인 전신 제어, 고급 미세 운동 기술, 다중 로봇 협업을 가능하게 합니다. 관심 있는 사용자는 대기자 명단을 통해 조기 액세스에 등록할 수 있습니다. 또한, 로봇의 상위 두뇌 역할을 하는 '체화 추론' 모델인 Gemini Robotics ER 2도 도입되었으며, 이는 4월의 이전 모델 1.6을 대체합니다. Gemini Robotics ER 2는 이미 Google AI Studio에서 사용할 수 있습니다.
출처: The Decoder (DE) —
원문
