डायना रोबोटिक्स ने डायना-2 वर्ल्ड-एक्शन मॉडल का अनावरण किया, जो 10 लाख घंटे के मानव वीडियो पर प्री-ट्रेन्ड है
डायना रोबोटिक्स ने डायना-2 जारी किया है, जो रोबोट हेरफेर के लिए एक वर्ल्ड-एक्शन मॉडल है, जो 10 लाख घंटे से अधिक के एगोसेंट्रिक मानव वीडियो पर प्री-ट्रेन्ड है। यह मॉडल मानव डेटा पर स्केलिंग कानून दिखाता है, अनदेखे रोबोट डेटा पर जीरो-शॉट ट्रांसफर करता है, और दर्शाता है कि वीडियो भविष्यवाणी क्रॉस-एम्बॉडिमेंट सामान्यीकरण को संचालित करती है। डायना-2 केवल विक्रेता-संचालित डायना रोबोट सेल के हिस्से के रूप में उपलब्ध है, जिसमें कोई सार्वजनिक चेकपॉइंट, एपीआई या लाइसेंस नहीं है।
डायना रोबोटिक्स ने डायना-2 पेश किया, जो रोबोट हेरफेर के लिए डिज़ाइन किया गया एक विश्व-क्रिया मॉडल है, जिसे दस लाख घंटे से अधिक के अहंकारी मानव वीडियो पर पूर्व-प्रशिक्षित किया गया है, जो लगभग 170 वर्षों के निरंतर जागने के अनुभव के बराबर है। यह मॉडल वीडियो और क्रिया के अलग-अलग टोकनाइजेशन और प्रसंस्करण के साथ ट्रांसफॉर्मरों के मिश्रण का उपयोग करता है, जिसमें फ्लो मैचिंग के साथ वीडियो-डिफ्यूजन बैकबोन का उपयोग किया जाता है। कंपनी तीन प्रमुख स्केलिंग परिणामों की रिपोर्ट करती है: एक स्केलिंग कानून दस लाख घंटे तक मानव डेटा पर लागू होता है, यह कानून 39 कार्यों में अनदेखे रोबोट डेटा पर जीरो-शॉट स्थानांतरित होता है, और वीडियो भविष्यवाणी, क्रिया डेटा के बजाय, क्रॉस-एम्बॉडिमेंट सामान्यीकरण को चलाती है। तीन एम्बॉडिमेंट्स में 14 कार्यों पर ऑन-रोबोट पोस्ट-ट्रेनिंग ने डेटा सीढ़ी में माध्य सामान्यीकृत स्कोर 20% से बढ़कर 53% होते दिखाए, जिसमें लॉकबॉक्स की टर्निंग जैसे विशिष्ट सुधार 90% सफलता तक पहुंचे। डायना-2 डाउनलोड करने योग्य वेट के रूप में उपलब्ध नहीं है; तैनाती के लिए डायना रोबोट सेल खरीदना आवश्यक है। मॉडल ने ऑन-रोबोट परीक्षणों और अनदेखे ग्राहक स्थलों पर कंपनी के प्रोडक्शन वीएलए (विज़न-लैंग्वेज-एक्शन मॉडल), डायना-1 से बेहतर प्रदर्शन किया, जहां यह 87% समय उत्पादन मानदंडों को पार कर गया, जबकि डायना-1 के लिए यह 46% था। तकनीकी रिपोर्ट आगे पढ़ने के लिए उपलब्ध है।
स्रोत: MarkTechPost —
मूल
