ModelGenerasi Media 🇷🇺 26.07.2026 16:03

Microsoft luncurkan model AI MAI-Image-2.5-Pro dan MAI-Voice-2-Flash untuk pembuatan gambar dan pengenalan suara

MicrosoftMicrosoft OpenAIOpenAI AnthropicAnthropic
Microsoft telah merilis dua model AI proprietary baru: MAI-Image-2.5-Pro untuk pembuatan gambar berkualitas tinggi dan MAI-Voice-2-Flash untuk pengenalan suara latensi rendah dalam beban kerja perusahaan. Perusahaan ini menyoroti penghematan biaya yang signifikan dan peningkatan kinerja saat mengganti model OpenAI dengan miliknya sendiri di berbagai produk seperti Bing, PowerPoint, dan Dynamics 365.
Microsoft telah meluncurkan pratinjau publik untuk dua model AI baru yang dikembangkan secara internal. MAI-Image-2.5-Pro adalah generator gambar unggulan yang menawarkan pembuatan berkualitas tinggi, pengeditan terperinci, dan rendering teks yang akurat. MAI-Voice-2-Flash dioptimalkan untuk aplikasi suara dengan throughput tinggi seperti pusat panggilan, berjalan dua kali lebih cepat dengan biaya 32% lebih murah dibandingkan model dasar. Perusahaan melaporkan bahwa Bing Image Creator kini sepenuhnya berjalan pada MAI-Image-2.5, dan PowerPoint telah mengurangi biaya sumber daya unit pemroses grafis (GPU) sebesar 84% dibandingkan menggunakan GPT-Image-2 milik OpenAI. MAI-Voice-2-Flash yang digunakan di Dynamics 365 Contact Center memangkas biaya GPU hingga 89% dan juga terintegrasi ke dalam Azure Voice Live. Dragon Copilot milik Microsoft, yang digunakan oleh 170.000 organisasi layanan kesehatan, telah dipindahkan ke MAI-Transcribe-1.5 yang mendukung 58 bahasa. Model ringan MAI-Code-1-Flash di GitHub Copilot menunjukkan penerimaan kode 10% lebih baik dibandingkan GPT-5.4 Mini dan Claude Haiku 4.5, dengan konsumsi token yang lebih rendah, dan dilatih lebih lanjut untuk tugas Excel di mana kinerjanya setara dengan GPT-5.6 sementara berjalan pada akselerator Nvidia H100 dan A100 yang lebih lama.
Sumber: 3DNews — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru