Gemini Robotics 2: Mô hình AI mới của Google điều khiển robot mọi hình dạng và kích thước
Google/DeepMind
Google DeepMind
Google DeepMind đã giới thiệu Gemini Robotics 2, một mô hình hành động-thị giác-ngôn ngữ (Vision-Language-Action) có thể điều khiển robot ở mọi loại thiết kế. Mô hình này hỗ trợ điều khiển toàn thân thông minh, vận động tinh vi và cộng tác đa robot. Ngoài ra, Gemini Robotics ER 2 dành cho 'lập luận nhúng' (Embodied Reasoning) cũng đã được công bố, hiện đã có sẵn trên Google AI Studio.
Google DeepMind đã giới thiệu Gemini Robotics 2, mô hình Vision-Language-Action (VLA) tiên tiến nhất của họ, kết hợp nhận dạng hình ảnh, hiểu ngôn ngữ và điều khiển hành động để giúp robot điều hướng thế giới vật lý. Mô hình này được thiết kế như một lớp trí thông minh cho các robot có khả năng thích ứng, cho phép điều khiển toàn thân thông minh, kỹ năng vận động tinh tiên tiến cũng như sự hợp tác giữa nhiều robot. Những người quan tâm có thể đăng ký danh sách chờ để được truy cập sớm. Ngoài ra, Gemini Robotics ER 2 cũng được giới thiệu, một mô hình 'Suy luận Nhập thể' (Embodied Reasoning) đóng vai trò như bộ não điều phối cho robot, thay thế mô hình 1.6 trước đó từ tháng Tư. Gemini Robotics ER 2 hiện đã có sẵn trên Google AI Studio.
Nguồn: The Decoder (DE) —
bản gốc
