مايكروسوفت تطلق نموذجي MAI-Image-2.5-Pro لتوليد الصور وMAI-Voice-2-Flash للتعرف على الكلام
Microsoft
OpenAI
Anthropic
أطلقت مايكروسوفت نموذجين جديدين للذكاء الاصطناعي: MAI-Image-2.5-Pro لتوليد صور عالية الجودة وMAI-Voice-2-Flash للتعرف على الكلام بزمن استجابة منخفض في أعباء العمل المؤسسية. وتؤكد الشركة على توفير كبير في التكاليف وتحسينات في الأداء عند استبدال نماذج OpenAI بنماذجها الخاصة عبر منتجات مثل Bing وPowerPoint وDynamics 365.
أطلقت مايكروسوفت إصدارات تجريبية عامة لنموذجين جديدين من نماذج الذكاء الاصطناعي التي طورتها داخلياً. MAI-Image-2.5-Pro هو النموذج الرئيسي لتوليد الصور، حيث يقدم جودة عالية في التوليد، وتحريراً مفصلاً، وعرضاً دقيقاً للنصوص. أما MAI-Voice-2-Flash فهو محسّن لتطبيقات الصوت عالية الإنتاجية مثل مراكز الاتصال، حيث يعمل بسرعة مضاعفة وبتكلفة أقل بنسبة 32% مقارنة بالنموذج الأساسي. وتذكر الشركة أن Bing Image Creator يعمل الآن بالكامل على MAI-Image-2.5، وأن باوربوينت خفضت تكاليف موارد وحدات معالجة الرسوميات (GPU) بنسبة 84% مقارنة باستخدام GPT-Image-2 من أوبن إيه آي. أما MAI-Voice-2-Flash المنشور في Dynamics 365 Contact Center فقد خفض تكاليف وحدات معالجة الرسوميات بنسبة تصل إلى 89%، وهو أيضاً مدمج في Azure Voice Live. كما تم ترحيل Dragon Copilot من مايكروسوفت، الذي تستخدمه 170 ألف مؤسسة رعاية صحية، إلى MAI-Transcribe-1.5 الذي يدعم 58 لغة. ويظهر النموذج الخفيف MAI-Code-1-Flash على جيت هب كوبايلوت (GitHub Copilot) قبولاً للكود أفضل بنسبة 10% من GPT-5.4 Mini وClaude Haiku 4.5، مع استهلاك أقل للرموز (tokens)، وتم تدريبه بشكل إضافي لمهام إكسل (Excel) حيث يؤدي بمستوى GPT-5.6 بينما يعمل على مسرعات Nvidia H100 وA100 الأقدم.
المصدر: 3DNews —
الأصلي
