Microsoft ने इमेज जनरेशन और स्पीच रिकॉग्निशन के लिए MAI-Image-2.5-Pro और MAI-Voice-2-Flash AI मॉडल पेश किए
Microsoft
OpenAI
Anthropic
Microsoft ने दो नए मालिकाना AI मॉडल जारी किए हैं: MAI-Image-2.5-Pro उच्च गुणवत्ता वाली इमेज जनरेशन के लिए और MAI-Voice-2-Flash एंटरप्राइज़ वर्कलोड में कम विलंबता वाली स्पीच रिकॉग्निशन के लिए। कंपनी Bing, PowerPoint और Dynamics 365 जैसे उत्पादों में OpenAI मॉडल को अपने मॉडल से बदलने पर महत्वपूर्ण लागत बचत और प्रदर्शन सुधारों पर प्रकाश डालती है।
माइक्रोसॉफ्ट ने दो नए आंतरिक रूप से विकसित एआई मॉडल के सार्वजनिक प्रीव्यू लॉन्च किए हैं। MAI-Image-2.5-Pro प्रमुख इमेज जनरेटर है, जो उच्च गुणवत्ता वाली पीढ़ी, विस्तृत संपादन और सटीक टेक्स्ट रेंडरिंग प्रदान करता है। MAI-Voice-2-Flash उच्च थ्रूपुट वॉयस एप्लिकेशन जैसे कॉल सेंटर के लिए अनुकूलित है, जो बेस मॉडल की तुलना में दोगुनी तेजी से चलता है और 32% कम लागत देता है। कंपनी रिपोर्ट करती है कि Bing Image Creator अब पूरी तरह से MAI-Image-2.5 पर चलता है, और PowerPoint ने OpenAI के GPT-Image-2 का उपयोग करने की तुलना में GPU संसाधन लागत में 84% की कमी की है। MAI-Voice-2-Flash को Dynamics 365 Contact Center में तैनात करने से GPU लागत में 89% तक की कमी आई है और इसे Azure Voice Live में भी एकीकृत किया गया है। माइक्रोसॉफ्ट के Dragon Copilot, जिसका 170,000 स्वास्थ्य सेवा संगठनों द्वारा उपयोग किया जाता है, को MAI-Transcribe-1.5 में स्थानांतरित कर दिया गया, जो 58 भाषाओं का समर्थन करता है। GitHub Copilot पर हल्का MAI-Code-1-Flash मॉडल GPT-5.4 Mini और Claude Haiku 4.5 की तुलना में 10% बेहतर कोड स्वीकृति दिखाता है, कम टोकन खपत के साथ, और इसे Excel कार्यों के लिए आगे प्रशिक्षित किया गया जहां यह GPT-5.6 स्तर पर प्रदर्शन करता है, जबकि पुराने Nvidia H100 और A100 एक्सेलेरेटर पर चलता है।
स्रोत: 3DNews —
मूल
