RobotMô hình 🇺🇸 31.07.2026 08:02

Gemini Robotics 2 đưa AI của Google vào thế giới thực

Google/DeepMindGoogle/DeepMind DeepMindDeepMind
Google DeepMind đã phát hành Gemini Robotics 2, một mô hình AI mới có thể điều khiển nhiều loại robot, bao gồm cả robot hình người có khả năng thực hiện các nhiệm vụ khéo léo. Hệ thống kết hợp một mô hình ngôn ngữ thị giác và hai mô hình hành động ngôn ngữ thị giác để giúp robot hiểu và hành động trong môi trường của chúng.
Google DeepMind đã phát hành Gemini Robotics 2, phiên bản mới của mô hình AI có thể điều khiển nhiều loại robot, bao gồm cả robot hình người có khả năng thực hiện các nhiệm vụ như vặn bóng đèn và buộc túi rác. Hệ thống này kết hợp nhiều mô hình AI thành một, bao gồm mô hình ngôn ngữ thị giác (VLM) để hiểu hình ảnh và video, cùng hai mô hình hành động ngôn ngữ thị giác (VLA) để điều khiển chuyển động toàn thân và các kẹp gắp của robot. Trong các buổi trình diễn, robot từ Apptronik và Sharpa đã thực hiện các nhiệm vụ như sắp xếp kệ. Quá trình huấn luyện bao gồm điều khiển từ xa, xem video ví dụ và mô phỏng. Google có thành tích nghiên cứu robot mạnh mẽ và trước đây đã hợp tác với Boston Dynamics. Việc phát hành này cho thấy Google đặt cược rằng AI phải bước vào thế giới vật lý. Rủi ro bao gồm hành vi bất ngờ hoặc nguy hiểm, như đã thấy khi tác nhân AI chưa phát hành của OpenAI tấn công hệ thống. Google giới thiệu ASIMOV-Agentic, một tiêu chuẩn an toàn để phát hiện các kết quả có hại. Giám đốc điều hành Demis Hassabis hy vọng phát triển một hệ điều hành AI cho robot tương tự như Android.
Nguồn: Wired AI — bản gốc
Bài viết liên quan trước đây ↓
Tin mới