टेनसेंट हुनयुआन Hy ASR 3.0 प्रीव्यू जारी: भाषण पहचान जो संदर्भ समझती है
Tencent
टेनसेंट ने अपने हुनयुआन Hy ASR 3.0 भाषण पहचान मॉडल का प्रीव्यू जारी किया है, जो संदर्भ को समझने में सक्षम है। यह मॉडल चीनी और अंग्रेजी दोनों को संभाल सकता है, और स्वचालित विराम चिह्न, वक्ता पृथक्करण (स्पीकर डायराइज़ेशन), और कस्टम शब्दावली जैसी सुविधाओं का समर्थन करता है। यह ऑन-प्रिमाइसेस (स्वयं के सर्वर पर) तैनाती विकल्प भी प्रदान करता है और लंबे ऑडियो खंडों का समर्थन करता है।
टेनसेंट ने अपने हुनयुआन हाय एएसआर 3.0 स्पीच रिकग्निशन मॉडल का प्रीव्यू जारी किया। नया मॉडल संदर्भ को समझने के लिए डिज़ाइन किया गया है, जो आसपास के शब्दों और वाक्यांशों पर विचार करके पहचान सटीकता में सुधार करता है। यह चीनी और अंग्रेजी दोनों का समर्थन करता है, और स्वचालित रूप से विराम चिह्न जोड़ सकता है और विभिन्न वक्ताओं की पहचान कर सकता है। यह उपयोगकर्ताओं को विशिष्ट डोमेन के लिए शब्दावली को अनुकूलित करने की भी अनुमति देता है। मॉडल को बेहतर डेटा गोपनीयता के लिए ऑन-प्रिमाइसेस तैनात किया जा सकता है, और यह एक घंटे तक के ऑडियो सेगमेंट का समर्थन करता है। टेनसेंट सटीकता सुनिश्चित करने के लिए हर एक से तीन महीने में मॉडल के अपडेट भी प्रदान करता है।
स्रोत: Tencent Hunyuan (GNews) —
मूल
