Microsoft, görüntü oluşturma ve konuşma tanıma için MAI-Image-2.5-Pro ve MAI-Voice-2-Flash yapay zeka modellerini tanıttı
Microsoft
OpenAI
Anthropic
Microsoft, kurumsal iş yükleri için yüksek kaliteli görüntü oluşturma amacıyla MAI-Image-2.5-Pro ve düşük gecikmeli konuşma tanıma için MAI-Voice-2-Flash olmak üzere iki yeni özel yapay zeka modelini yayınladı. Şirket, Bing, PowerPoint ve Dynamics 365 gibi ürünlerde OpenAI modellerini kendi modelleriyle değiştirdiğinde önemli maliyet tasarrufu ve performans iyileştirmeleri elde ettiğini vurguluyor.
Microsoft, yeni geliştirdiği iki yapay zeka modelinin herkese açık ön izlemesini başlattı. MAI-Image-2.5-Pro, yüksek kaliteli görüntü üretimi, detaylı düzenleme ve doğru metin işleme sunan amiral gemisi görüntü oluşturucudur. MAI-Voice-2-Flash, çağrı merkezleri gibi yüksek verimli ses uygulamaları için optimize edilmiştir; temel modele kıyasla iki kat daha hızlı çalışır ve %32 daha düşük maliyet sunar. Şirket, Bing Image Creator'ın artık tamamen MAI-Image-2.5 üzerinde çalıştığını ve PowerPoint'in GPU kaynak maliyetlerini OpenAI'in GPT-Image-2'sini kullanmaya kıyasla %84 oranında azalttığını bildiriyor. Dynamics 365 Contact Center'da kullanılan MAI-Voice-2-Flash, GPU maliyetlerini %89'a varan oranda düşürdü ve ayrıca Azure Voice Live ile entegre edildi. Microsoft'un 170.000 sağlık kuruluşu tarafından kullanılan Dragon Copilot'u, 58 dili destekleyen MAI-Transcribe-1.5'e taşındı. GitHub Copilot üzerindeki hafif model MAI-Code-1-Flash, GPT-5.4 Mini ve Claude Haiku 4.5'ten %10 daha iyi kod kabul oranı ve daha düşük token tüketimi gösteriyor; ayrıca Excel görevleri için daha da eğitildi ve bu görevlerde eski Nvidia H100 ve A100 hızlandırıcılarda çalışırken GPT-5.6 seviyesinde performans sergiliyor.
Kaynak: 3DNews —
orijinal
