Gemini Robotics 2, 로봇에 전신 지능 부여하다
Google/DeepMind
DeepMind
Google DeepMind가 Gemini Robotics 2를 발표했습니다. 이는 로봇의 전신 제어, 손재주, 다중 로봇 협업을 가능하게 하는 AI 모델 제품군입니다. 이 모델들은 시각-언어-행동 모델(VLA), 구현 추론 모델(ER), 온디바이스 VLA를 포함하며, 휴머노이드 보행부터 정밀 조작까지 다양한 작업을 지원합니다.
Google DeepMind이 새로운 지능 계층인 Gemini Robotics 2를 발표했습니다. 이 시스템은 로봇의 전신 제어, 정밀한 손재주, 다중 로봇 협업을 가능하게 합니다. 이 시스템은 세 가지 모델로 구성됩니다: Gemini Robotics 2(모터 제어를 위한 비전-언어-행동 모델, VLA), Gemini Robotics ER 2(계획 및 통신을 위한 구현 추론 모델), Gemini Robotics On-Device 2(로컬 실행에 최적화된 효율적인 VLA). 이 모델들은 Apptronik의 Apollo 2와 같은 휴머노이드 로봇을 발끝부터 손가락 끝까지 제어하고, 다섯 손가락 손으로 매듭을 묶는 등의 섬세한 작업을 수행하며, 다중 로봇 팀워크를 가능하게 합니다. ER 모델은 Google AI Studio와 Gemini Enterprise Agent Platform에서 비공개 프리뷰로 제공되며, VLA 및 온디바이스 모델은 얼리 액세스 파트너를 대상으로 합니다. 안전 조치로는 안전한 도구 호출 및 인간 근접 감지를 위한 ASIMOV-Agentic 벤치마크가 포함됩니다. 이 연구는 범용 물리적 AI를 향한 이정표입니다.
출처: Google DeepMind —
원문
