ModelosGeneración de Medios 🇷🇺 26.07.2026 16:03

Microsoft presenta los modelos de IA MAI-Image-2.5-Pro y MAI-Voice-2-Flash para generación de imágenes y reconocimiento de voz

MicrosoftMicrosoft OpenAIOpenAI AnthropicAnthropic
Microsoft ha lanzado dos nuevos modelos de IA propietarios: MAI-Image-2.5-Pro para generación de imágenes de alta calidad y MAI-Voice-2-Flash para reconocimiento de voz de baja latencia en cargas de trabajo empresariales. La empresa destaca importantes ahorros de costos y mejoras de rendimiento al reemplazar los modelos de OpenAI con los suyos propios en productos como Bing, PowerPoint y Dynamics 365.
Microsoft ha lanzado las versiones preliminares públicas de dos nuevos modelos de inteligencia artificial desarrollados internamente. MAI-Image-2.5-Pro es el generador de imágenes insignia, que ofrece generación de alta calidad, edición detallada y representación precisa de texto. MAI-Voice-2-Flash está optimizado para aplicaciones de voz de alto rendimiento, como centros de llamadas, funcionando el doble de rápido y con un costo un 32 % inferior al del modelo base. La empresa informa que Bing Image Creator ahora funciona completamente con MAI-Image-2.5, y PowerPoint ha reducido los costos de recursos de GPU en un 84 % en comparación con el uso de GPT-Image-2 de OpenAI. MAI-Voice-2-Flash, implementado en Dynamics 365 Contact Center, redujo los costos de GPU hasta en un 89 % y también está integrado en Azure Voice Live. Dragon Copilot de Microsoft, utilizado por 170 000 organizaciones sanitarias, se migró a MAI-Transcribe-1.5, que admite 58 idiomas. El modelo ligero MAI-Code-1-Flash en GitHub Copilot muestra una aceptación de código un 10 % mejor que GPT-5.4 Mini y Claude Haiku 4.5, con un menor consumo de tokens, y fue entrenado adicionalmente para tareas de Excel, donde funciona al nivel de GPT-5.6 mientras se ejecuta en aceleradores Nvidia H100 y A100 más antiguos.
Fuente: 3DNews — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas