Почему гуманоиду сложно хватать движущиеся предметы: разработка VLA для динамической среды

Unitree RoboticsUnitree Robotics
ML-инженер MTC Web Services Дания рассказывает о проблемах, с которыми сталкиваются VLA-модели при работе с движущимися объектами, и о том, как в RnD-подразделении компании адаптируют архитектуру RLDX-1 для гуманоида Unitree G1, чтобы он мог брать детали с конвейера, сохраняя баланс.
ML-инженер MTC Web Services Дания объясняет, почему гуманоидным роботам сложно работать в динамической среде, например, когда объекты движутся по конвейеру. В статических условиях современные VLA (Vision-Language-Action) модели показывают высокое качество управления, но в динамике возникают три основные проблемы: задержка между наблюдением и действием (изображение с камеры, обработка, отправка
Показать ещё ↓
Сокращения
VLA = Vision-Language-Action — модель, объединяющая зрение, язык и управление
Источник: Habr — хаб ИИ — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости