Microsoft onthult MAI-Image-2.5-Pro en MAI-Voice-2-Flash AI-modellen voor beeldgeneratie en spraakherkenning
Microsoft
OpenAI
Anthropic
Microsoft heeft twee nieuwe eigen AI-modellen uitgebracht: MAI-Image-2.5-Pro voor hoogwaardige beeldgeneratie en MAI-Voice-2-Flash voor spraakherkenning met lage latentie in zakelijke workloads. Het bedrijf benadrukt aanzienlijke kostenbesparingen en prestatieverbeteringen bij het vervangen van OpenAI-modellen door eigen modellen in producten zoals Bing, PowerPoint en Dynamics 365.
Microsoft heeft openbare previews gelanceerd van twee nieuw intern ontwikkelde AI-modellen. MAI-Image-2.5-Pro is het vlaggenschip voor het genereren van afbeeldingen, met hoogwaardige generatie, gedetailleerde bewerking en nauwkeurige tekstweergave. MAI-Voice-2-Flash is geoptimaliseerd voor spraaktoepassingen met een hoge doorvoer, zoals callcenters, en is twee keer zo snel en 32% goedkoper dan het basismodel. Het bedrijf meldt dat Bing Image Creator nu volledig draait op MAI-Image-2.5 en dat PowerPoint de GPU-bronkosten met 84% heeft verlaagd in vergelijking met het gebruik van OpenAI's GPT-Image-2. MAI-Voice-2-Flash, geïmplementeerd in Dynamics 365 Contact Center, verlaagde de GPU-kosten met tot 89% en is ook geïntegreerd in Azure Voice Live. Microsoft's Dragon Copilot, dat door 170.000 zorgorganisaties wordt gebruikt, is gemigreerd naar MAI-Transcribe-1.5, dat 58 talen ondersteunt. Het lichtgewicht model MAI-Code-1-Flash op GitHub Copilot laat een 10% betere code-acceptatie zien dan GPT-5.4 Mini en Claude Haiku 4.5, met een lager tokenverbruik, en is verder getraind voor Excel-taken, waar het presteert op het niveau van GPT-5.6 terwijl het draait op oudere Nvidia H100- en A100-versnellers.
Bron: 3DNews —
origineel
