PolyAI ने पेश किया Dialog-RSN-1: ऑडियो-नेटिव डायलॉग मॉडल, जो टर्न-टेकिंग, स्पीच रिकग्निशन, फंक्शन कॉलिंग और रिस्पॉन्स जनरेशन को जोड़ता है
PolyAI ने Dialog-RSN-1 जारी किया है, एक ऑडियो-नेटिव डायलॉग मॉडल जो सीधे ऑडियो को प्रोसेस करता है, जिसमें टर्न-टेकिंग, स्पीच रिकग्निशन, फंक्शन कॉलिंग और रिस्पॉन्स जनरेशन शामिल हैं। यह मॉडल पहले से ही प्रोडक्शन में उपयोग हो रहा है, जो 300 मिलीसेकंड से कम में प्रतिक्रिया देता है और स्टीयरिंग में 11% तथा लेटेंसी में 37% सुधार दिखाता है। यह केवल PolyAI प्लेटफ़ॉर्म के माध्यम से उपलब्ध है, बिना ओपन वेट या सार्वजनिक API के।
PolyAI
OpenAI
Google/DeepMind
Alibaba/Qwen
Mistral
MarkTechPost31.07 · 09:02
