ByteDance Doubao के Duplex मॉडल Seeduplex पर गहराई से नज़र
ByteDance
ByteDance Doubao ने एक नया मॉडल, Seeduplex जारी किया है, जो सिम्प्लेक्स और डुप्लेक्स वॉइस मोड को सपोर्ट करता है। यह मॉडल वॉइस इनपुट, समानांतर धारणा, रुकावट और मिश्रित चीनी-अंग्रेज़ी सहित कई भाषाओं की पहचान करने में सक्षम है। Seeduplex विभिन्न आवाज़ों और शैलियों की नकल कर सकता है, जिसमें एक हाइब्रिड शैली भी शामिल है जो आदेशात्मक और कोमल स्वरों को जोड़ती है।
बाइटडांस के डौबाओ ने सीडुप्लेक्स नाम का एक मॉडल पेश किया है, जो एक नया डुप्लेक्स वॉइस मॉडल है। समीक्षा में इसकी समानांतर धारणा और व्यवधान की क्षमताओं के साथ-साथ अन्य आवाज़ों को पहचानने पर प्रकाश डाला गया है। यह मॉडल वॉइस इनपुट, सिम्प्लेक्स और डुप्लेक्स मोड को सपोर्ट करता है; यह एक साथ आवाज़ों को पहचान सकता है, जिसमें टेबल पर दस्तक देना भी शामिल है। सीडुप्लेक्स आवाज़ और शैली की नकल कर सकता है (उदाहरण के लिए, 'जोरदार' अंत के साथ एक आदेशात्मक स्वर), साथ ही कोमल आवाज़ की नकल कर सकता है और उसमें मुस्कान का हल्का सा भाव जोड़ सकता है। यह अनुरोध पर पुरुष और महिला आवाज़ों के बीच स्विच कर सकता है और निर्देशों के अनुसार स्वर बदल सकता है। इसके अतिरिक्त, यह मॉडल मिश्रित चीनी-अंग्रेज़ी का समर्थन करता है, अधिकांश चीनी उच्चारणों (जैसे कुछ 'उत्तरी' बोली) को पहचानता है, और विभिन्न फ़ॉन्ट में हस्तलिखित पाठ पढ़ सकता है।
स्रोत: ByteDance Doubao (GNews) —
मूल
