RobotNghiên cứu 🇺🇸 13.08.2026 11:01

Dyna Robotics ra mắt Dyna-2, mô hình hành động thế giới được huấn luyện trước trên 1 triệu giờ video người

Dyna Robotics đã phát hành Dyna-2, một mô hình hành động thế giới cho thao tác robot, được huấn luyện trước trên hơn một triệu giờ video người theo góc nhìn thứ nhất. Mô hình này cho thấy quy luật mở rộng trên dữ liệu người, chuyển giao zero-shot sang dữ liệu robot chưa từng thấy, và chứng minh rằng dự đoán video thúc đẩy khả năng tổng quát hóa cross-embodiment. Dyna-2 chỉ có sẵn như một phần của hệ thống robot Dyna do nhà cung cấp vận hành, không có checkpoint, API, hoặc giấy phép công khai.
Dyna Robotics đã giới thiệu Dyna-2, một mô hình hành động thế giới (world-action model) được thiết kế cho thao tác robot, được tiền huấn luyện trên hơn một triệu giờ video người thứ nhất (egocentric human video), tương đương khoảng 170 năm trải nghiệm thức liên tục. Mô hình sử dụng hỗn hợp transformer với token hóa và xử lý riêng biệt cho video và hành động, sử dụng kiến trúc video-diffusion với flow matching. Công ty báo cáo ba kết quả mở rộng quy mô chính: quy luật mở rộng (scaling law) áp dụng cho dữ liệu người lên đến một triệu giờ, quy luật này chuyển giao zero-shot sang dữ liệu robot chưa thấy trên 39 nhiệm vụ, và dự đoán video, thay vì dữ liệu hành động, thúc đẩy khả năng khái quát hóa đa dạng cơ thể (cross-embodiment generalization). Sau khi huấn luyện thêm trên robot với 14 nhiệm vụ trên ba dạng cơ thể, điểm số trung bình chuẩn hóa tăng từ 20% lên 53% theo thang dữ liệu, với cải thiện cụ thể như Lockbox Key Turning đạt tỷ lệ thành công 90%. Dyna-2 không có sẵn dưới dạng trọng số tải về; việc triển khai yêu cầu mua robot cell Dyna. Mô hình vượt trội so với Dyna-1, VLA sản xuất của công ty, trong các bài kiểm tra trên robot và tại các địa điểm khách hàng chưa thấy, nơi nó vượt qua tiêu chí sản xuất 87% thời gian so với 46% của Dyna-1. Báo cáo kỹ thuật có sẵn để đọc thêm.
Nguồn: MarkTechPost — bản gốc
Bài viết liên quan trước đây ↓
Tin mới