Gemini Robotics 2 mang trí thông minh toàn thân đến với robot
Google/DeepMind
DeepMind
Google DeepMind giới thiệu Gemini Robotics 2, bộ mô hình AI cho phép điều khiển toàn thân, khéo léo và hợp tác đa robot, giúp robot linh hoạt. Bộ mô hình bao gồm mô hình vision-language-action (VLA), mô hình suy luận thể chất (embodied reasoning/ER), và VLA trên thiết bị, hỗ trợ các nhiệm vụ từ đi bộ hình người đến thao tác tinh tế.
Google DeepMind công bố Gemini Robotics 2, một lớp trí thông minh mới dành cho robot cho phép điều khiển toàn thân, thao tác tinh vi và cộng tác đa robot. Hệ thống bao gồm ba mô hình: Gemini Robotics 2, mô hình thị giác-ngôn ngữ-hành động (VLA) dành cho điều khiển vận động; Gemini Robotics ER 2, mô hình suy luận nhúng dành cho lập kế hoạch và giao tiếp; và Gemini Robotics On-Device 2, một VLA hiệu quả được tối ưu hóa cho thực thi cục bộ. Các mô hình này có thể điều khiển robot hình người như Apollo 2 của Apptronik từ chân đến đầu ngón tay, thực hiện các tác vụ tinh tế như thắt nút bằng bàn tay năm ngón và cho phép làm việc nhóm đa robot. Mô hình ER có sẵn trên Google AI Studio và dưới dạng xem trước riêng tư trên Nền tảng Đại lý Doanh nghiệp Gemini, trong khi mô hình VLA và mô hình trên thiết bị dành cho các đối tác truy cập sớm. Các biện pháp an toàn bao gồm chuẩn đánh giá ASIMOV-Agentic dành cho các lời gọi công cụ an toàn và phát hiện khoảng cách với con người. Công trình này đánh dấu một cột mốc hướng tới AI vật lý đa dụng.
Nguồn: Google DeepMind —
bản gốc
