Magic-VLA K02 достиг более 90% успеха в длительной задаче складывания коробок и склеивания
Компания Magic Atom (魔法原子) представила на WAIC 2026 свою универсальную модель Magic-VLA K02, которая успешно справляется со сложными длительными задачами, включая складывание коробок и склеивание, с成功率 более 90%. Модель использует двухуровневую архитектуру для планирования и выполнения задач, демонстрируя устойчивость к возмущениям и способность к обобщению навыков.
Компания Magic Atom (魔法原子) на конференции WAIC 2026 продемонстрировала свою универсальную модель Magic-VLA K02, которая выполняет сложные длительные задачи, такие как складывание коробок и склеивание, упаковка гибкой одежды и укладка чемоданов. В задаче складывания коробок и склеивания успешность превысила 90%, что, по заявлению компании, является первым случаем, когда универсальная модель справилась с такой комбинированной задачей. Робот с Magic-VLA K02 может автономно понимать задачу, планировать шаги, распознавать объекты и выполнять непрерывные действия, а также корректировать стратегию при изменении среды или сбоях. Модель использует двухуровневую архитектуру: верхний уровень отвечает за глобальное планирование и разбиение задачи на атомарные действия, а нижний — за генерацию непрерывных движений с помощью VLM магистрали, динамического эксперта и эксперта по действиям. Тесты показали точность 92% и снижение числа прерываний до 5%. Модель также демонстрирует способность к обобщению навыков, адаптацию к различным роботам (100% совместимость) и снижение потребности в обучающих данных на 60%.
- Сокращения
- VLA = Vision-Language-Action — модель, объединяющая зрение, язык и действия
- WAIC = World Artificial Intelligence Conference — Всемирная конференция по искусственному интеллекту
- VLM = Vision-Language Model — модель, объединяющая зрение и язык
Источник: QbitAI 量子位 —
оригинал
