OpenAI वॉइस इंटरफ़ेस क्रांति के लिए तैयार: नया डिवाइस और ChatGPT में वॉइस मोड
OpenAI
OpenAI, सैम ऑल्टमैन और जोनी आइवे के सहयोग से, एक नया वॉइस-केंद्रित डिवाइस विकसित कर रहा है, जो संभवतः एक स्मार्ट स्पीकर होगा। इस बीच, कंपनी ने ChatGPT में वॉइस मोड जारी किया है, जो न्यूनतम विलंबता के साथ रीयल-टाइम, प्राकृतिक बातचीत को सक्षम बनाता है, जो संभावित रूप से कीबोर्ड और माउस जैसे पारंपरिक इनपुट विधियों की जगह ले सकता है।
हालिया रिपोर्टों से पता चलता है कि सैम ऑल्टमैन और जॉनी आइव एक संयुक्त परियोजना पर काम कर रहे हैं, जिसमें एक नया हार्डवेयर डिवाइस शामिल है, जो अब वॉइस इंटरैक्शन पर केंद्रित एक स्मार्ट स्पीकर के रूप में सामने आया है। हालांकि स्मार्ट स्पीकर का बाजार पहले से ही भीड़भाड़ वाला है, मुख्य अंतर चैटजीपीटी का नया वॉइस मोड है। साधारण डिक्टेशन के विपरीत, वॉइस मोड लगातार सुनता है, लगभग तुरंत प्रतिक्रिया देता है, और उपयोगकर्ता के ऊपर बात भी कर सकता है, जिससे एक प्राकृतिक संवाद प्रवाह बनता है। उपयोगकर्ताओं ने इसे भाषा शिक्षक और अनुवादक के रूप में उपयोगी पाया है। इस डिवाइस और वॉइस मोड के संयोजन से पता चलता है कि ओपनएआई का लक्ष्य वॉइस को कंप्यूटर के लिए प्राथमिक इनपुट विधि बनाना है, जो संभावित रूप से कीबोर्ड और माउस की जगह ले सकता है। इस बदलाव के लिए एआई को मानवीय भाषण के अनुकूल होना होगा, न कि मनुष्यों को इनपुट डिवाइस का उपयोग करना सीखना होगा। अंततः, वॉइस कैमरा, जेस्चर और संदर्भ जागरूकता से जुड़े एक अधिक प्राकृतिक, मल्टीमॉडल मानव-कंप्यूटर इंटरफेस की ओर पहला कदम हो सकता है। सिरी को वॉइस इंटरैक्शन में एक अग्रणी के रूप में श्रेय दिया जाता है, लेकिन आधुनिक एलएलएम (बड़े भाषा मॉडल) ने काफी प्रगति की है। यदि यह प्रवृत्ति जारी रहती है, तो कीबोर्ड पेशेवरों के लिए विशेष उपकरण बन सकते हैं, और वॉइस इंटरफेस स्टार्टअप के लिए अगली बड़ी लहर बन जाएगा।
स्रोत: Habr — хаб ИИ —
मूल
