الروبوتاتالأبحاث 🇨🇳 26.07.2026 14:02

30,000 ساعة من البيانات اللمسية تمنح الذكاء الاصطناعي المتجسد حاسة اللمس

أطلقت NeoteAI وجامعة فودان سلسلة من ثلاثة تقارير ونماذج تحت سلسلة N0، بهدف دمج التغذية الراجعة اللمسية كمكون أساسي للذكاء الاصطناعي المتجسد. يشمل المشروع مجموعة بيانات تفاعل لمسي مدتها 30,000 ساعة، ونموذج الرؤية-اللغة-الفعل N0-VTLA، ونموذج العالم N0-TWAM، وجميعها مفتوحة المصدر.
أعلنت شركة نيوت إيه آي (NeoteAI) (شنغهاي نيو إنتهيليجنت إمبوديد إيه آي تكنولوجي المحدودة) بالتعاون مع معهد فيودان للأبحاث الموثوقة للذكاء الاصطناعي المتجسد عن نشر ثلاثة تقارير فنية لسلسلة النماذج N0. تحتوي مجموعة بيانات نيوداتا (Neodata) على أكثر من 30,000 ساعة من بيانات التفاعل البصري-اللمسي، و1.4 مليون شريحة حركة، و33 مليار خطوة زمنية، و8 مليارات إطار RGB، و10 مليارات صورة لمسية، تم جمعها من 6 منصات روبوتية (فرانكا Franka، بايبر Piper، ويو آر5إي UR5e، وغيرها) تغطي 450 مهمة طويلة الأمد بواسطة 90 مشغلًا. إن إن0-في تي إل إيه (N0-VTLA) هو نموذج رؤية وحركة ولمس (VLA) معزز باللمس يتنبأ بالحالات اللمسية المستقبلية لـ50 خطوة للأمام، محققًا نجاحًا بنسبة 85% في إدخال القابس (مقابل 60% للرؤية فقط) و99% في استخراج المفتاح (مقابل 35%). أما إن0-تي دبليو إيه إم (N0-TWAM) فهو نموذج عالمي يضم 7.2 مليار معلمة باستخدام بنية خليط الخبراء، يتنبأ بتسلسلات الفيديو واللمس والحركة في وقت واحد؛ متوسط نسبة النجاح في المحاكاة 84.5% (الخط الأساسي 36%)، وفي العالم الحقيقي 46.3% (لينج بوت-في إيه LingBot-VA 21.9%). تم فتح المصدر للمشروع على research.neoteai.com.
المصدر: QbitAI 量子位 — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة