Nghiên cứuRobot 🇷🇺 24.07.2026 05:03

Tại sao robot hình người gặp khó khi nắm bắt vật thể chuyển động: phát triển VLA cho môi trường động

Unitree RoboticsUnitree Robotics
Các mô hình VLA hiện đại hoạt động tốt trong môi trường tĩnh nhưng thất bại khi vật thể chuyển động, chẳng hạn như trên băng chuyền. Các vấn đề chính bao gồm độ trễ, khối hành động lỗi thời và thiếu ngữ cảnh thời gian. Các nhà nghiên cứu hiện đang phát triển VLA toàn thân động để xử lý vật thể chuyển động và duy trì thăng bằng.
Hầu hết các trình diễn robot ngày nay diễn ra trong môi trường tĩnh với ánh sáng ổn định và camera cố định, nơi các mô hình VLA (Vision-Language-Action) hoạt động tốt. Tuy nhiên, các nhiệm vụ trong thế giới thực thường liên quan đến các vật thể chuyển động, chẳng hạn như các mặt hàng trên băng chuyền. Khi một robot hình người kích thước đầy đủ tương tác với các vật thể chuyển động, nó cũng phải di chuyển và giữ thăng bằng, làm phức tạp các tính toán chuyển động. Những thách thức chính bao gồm độ trễ giữa quan sát và hành động, các khối hành động lỗi thời và không thể xác định tốc độ của vật thể từ một hình ảnh đơn lẻ. Các mô hình gần đây như DynamicVLA giải quyết những vấn đề này bằng cách cập nhật hành động thường xuyên hơn và xem xét thời gian. Đối với robot hình người, kiểm soát toàn thân là cần thiết vì chuyển động của cánh tay ảnh hưởng đến thăng bằng của thân. Kiến trúc RLDX-1 xử lý nhiều luồng thông tin (chuyển động, bộ nhớ, vật lý, hành động) để cải thiện thao tác động. Tại MTS Web Services, tác giả đang điều chỉnh RLDX-1 để điều khiển robot hình người Unitree G1 nhằm thực hiện thao tác nắm bắt động toàn thân các mặt hàng trên băng chuyền, coi nhiệm vụ như một vòng lặp khép kín: quan sát, dự đoán, chặn, thực thi, xác minh, điều chỉnh.
Nguồn: Habr — хаб ИИ — bản gốc
Bài viết liên quan trước đây ↓
Tin mới