モデルメディア生成 🇷🇺 26.07.2026 16:03

Microsoft、画像生成と音声認識向けAIモデルMAI-Image-2.5-ProとMAI-Voice-2-Flashを発表

MicrosoftMicrosoft OpenAIOpenAI AnthropicAnthropic
マイクロソフトは、高品質な画像生成のためのMAI-Image-2.5-Proと、エンタープライズワークロード向け低遅延音声認識のためのMAI-Voice-2-Flashという2つの新しい独自AIモデルをリリースしました。同社は、Bing、PowerPoint、Dynamics 365などの製品でOpenAIモデルを自社モデルに置き換えることで、大幅なコスト削減とパフォーマンス向上を実現したと強調しています。
マイクロソフトは、自社開発した2つの新しいAIモデルのパブリックプレビューを開始しました。MAI-Image-2.5-Proはフラッグシップ画像生成モデルであり、高品質な生成、詳細な編集、正確なテキストレンダリングを提供します。MAI-Voice-2-Flashはコンタクトセンターのような高スループット音声アプリケーション向けに最適化されており、ベースモデルと比較して2倍の速度で動作し、32%のコスト削減を実現します。同社によると、Bing Image Creatorは現在完全にMAI-Image-2.5上で動作しており、PowerPointではOpenAIのGPT-Image-2を使用した場合と比較してGPUリソースコストが84%削減されました。Dynamics 365 Contact Centerに展開されたMAI-Voice-2-FlashはGPUコストを最大89%削減し、Azure Voice Liveにも統合されています。17万の医療機関が利用するマイクロソフトのDragon Copilotは、58言語に対応するMAI-Transcribe-1.5に移行されました。GitHub Copilot上の軽量モデルMAI-Code-1-Flashは、GPT-5.4 MiniやClaude Haiku 4.5よりもコード受け入れ率が10%向上し、トークン消費量が少なく、Excelタスク向けにさらにトレーニングされてGPT-5.6レベルの性能を発揮しつつ、従来のNvidia H100およびA100アクセラレータ上で動作します。
出典: 3DNews — 原文
関連記事 ↓
新着ニュース