AINEWS

Microsoft、MAI-Image-2.5-ProとMAI-Voice-2-Flashを公開プレビューで発表

💡 Microsoftが新しいAIモデルMAI-Image-2.5-ProとMAI-Voice-2-Flashを発表。画像生成と音声生成の新機能に注目。

Microsoftが新たなAIモデルを発表

2026年7月23日、Microsoftは新しいAIモデルであるMAI-Image-2.5-ProMAI-Voice-2-Flash公開プレビューとして発表しました。これらのモデルは、特に画像生成と音声生成の分野での性能向上を目指しています。

MAI-Image-2.5-Proの特徴

MAI-Image-2.5-Proは、主に高品質な画像生成を目的としたモデルです。Microsoftの公式発表によると、このモデルは以下の機能に対応しています:

  • Hero Imagery: インパクトのあるビジュアルを生成
  • Detailed Editing: 詳細な画像編集が可能
  • Precise In-Image Text Rendering: 画像内のテキストを正確に描画
このモデルは、特にマーケティングや広告業界での利用が期待されており、視覚的なコンテンツの質を向上させることができます。

MAI-Voice-2-Flashの特徴

一方、MAI-Voice-2-Flashは、音声生成に特化したモデルで、既存のMAI-Voice-2を基にしており、以下の特長があります:

  • 2倍速い応答: より迅速な音声生成が可能
  • 32%安い価格: コストパフォーマンスが向上
このモデルは、特にコールセンターやカスタマーサポートの分野での活用が見込まれています。実際、Dynamics 365 Contact Centerのコールセンターエージェント基盤に採用されており、Azure Voice Liveにも統合されています。

価格と利用方法

MAI-Image-2.5-Proの価格は、テキスト入力が100万トークンあたり5米ドル、画像入力が同じく100万トークンあたり8米ドル、画像出力は100万トークンあたり106米ドルと報じられています。

MAI-Voice-2-Flashの価格は、100万文字あたり15米ドルです。これにより、企業はより低コストで高品質な音声生成を実現できるようになります。

利用可能なプラットフォーム

これらのモデルは、Bing Image CreatorPowerPointに実装されており、特にMAI-Image-2.5-ProはBingのデフォルト画像生成モデルとして利用されています。また、MAI-Voice-2-FlashAzure Speechを通じて利用可能です。

まとめ

Microsoftの新しいAIモデル、MAI-Image-2.5-ProMAI-Voice-2-Flashは、画像生成と音声生成の分野での革新をもたらすことが期待されています。特に、コスト削減と性能向上が実現されており、企業やクリエイターにとって非常に魅力的な選択肢となるでしょう。今後の展開に注目です。

📤 この記事をシェア

Microsoft、MAI-Image-2.5-ProとMAI-Voice-2-Flashを公開プレビューで発表 | AI NEWS