Microsoft julkaisee MAI-Image-2.5-Pro- ja MAI-Voice-2-Flash-tekoälymallit kuvantuotantoon ja puheentunnistukseen
Microsoft
OpenAI
Anthropic
Microsoft on julkaissut kaksi uutta omaa tekoälymallia: MAI-Image-2.5-Pro korkealaatuiseen kuvantuotantoon ja MAI-Voice-2-Flash matalan viiveen puheentunnistukseen yrityskuormille. Yhtiö korostaa merkittäviä kustannussäästöjä ja suorituskykyparannuksia, kun OpenAI:n malleja korvataan sen omilla tuotteissa, kuten Bing, PowerPoint ja Dynamics 365.
Microsoft on julkaissut julkiset esiversiot kahdesta uudesta itse kehittämästään tekoälymallista. MAI-Image-2.5-Pro on lippulaivakuvanluontimalli, joka tarjoaa laadukasta generointia, yksityiskohtaisia muokkausominaisuuksia ja tarkkaa tekstin renderöintiä. MAI-Voice-2-Flash on optimoitu suuren suorituskyvyn äänisovelluksiin, kuten puhelinkeskuksiin, ja se on kaksi kertaa nopeampi ja 32 prosenttia edullisempi kuin perusmalli. Yritys kertoo, että Bing Image Creator toimii nyt täysin MAI-Image-2.5-mallin pohjalta, ja PowerPoint on vähentänyt grafiikkaprosessoriyksikön resurssikustannuksia 84 prosenttia verrattuna OpenAI:n GPT-Image-2-mallin käyttöön. Dynamics 365 Contact Centeriin käyttöön otettu MAI-Voice-2-Flash leikkasi GPU-kustannuksia jopa 89 prosenttia, ja se on integroitu myös Azure Voice Live -palveluun. Microsoftin Dragon Copilot, jota käyttää 170 000 terveydenhuollon organisaatiota, siirrettiin MAI-Transcribe-1.5-malliin, joka tukee 58 kieltä. Kevyt MAI-Code-1-Flash-malli GitHub Copilotissa osoittaa 10 prosenttia parempaa koodin hyväksyntää kuin GPT-5.4 Mini ja Claude Haiku 4.5, ja se kuluttaa vähemmän tokeneita. Mallia on lisäksi koulutettu Excel-tehtäviin, joissa se suoriutuu GPT-5.6-tasolla, vaikka se toimii vanhemmilla Nvidia H100- ja A100-kiihdyttimillä.
Lähde: 3DNews —
Alkuperäinen
