Microsoftが新たなAIモデルを発表
2026年7月23日、Microsoftは新しいAIモデルであるMAI-Image-2.5-ProとMAI-Voice-2-Flashを公開プレビューとして発表しました。これらのモデルは、特に画像生成と音声生成の分野での性能向上を目指しています。
MAI-Image-2.5-Proの特徴
MAI-Image-2.5-Proは、主に高品質な画像生成を目的としたモデルです。Microsoftの公式発表によると、このモデルは以下の機能に対応しています:
- Hero Imagery: インパクトのあるビジュアルを生成
- Detailed Editing: 詳細な画像編集が可能
- Precise In-Image Text Rendering: 画像内のテキストを正確に描画
MAI-Voice-2-Flashの特徴
一方、MAI-Voice-2-Flashは、音声生成に特化したモデルで、既存のMAI-Voice-2を基にしており、以下の特長があります:
- 2倍速い応答: より迅速な音声生成が可能
- 32%安い価格: コストパフォーマンスが向上
価格と利用方法
MAI-Image-2.5-Proの価格は、テキスト入力が100万トークンあたり5米ドル、画像入力が同じく100万トークンあたり8米ドル、画像出力は100万トークンあたり106米ドルと報じられています。
MAI-Voice-2-Flashの価格は、100万文字あたり15米ドルです。これにより、企業はより低コストで高品質な音声生成を実現できるようになります。
利用可能なプラットフォーム
これらのモデルは、Bing Image CreatorやPowerPointに実装されており、特にMAI-Image-2.5-ProはBingのデフォルト画像生成モデルとして利用されています。また、MAI-Voice-2-FlashはAzure Speechを通じて利用可能です。
まとめ
Microsoftの新しいAIモデル、MAI-Image-2.5-ProとMAI-Voice-2-Flashは、画像生成と音声生成の分野での革新をもたらすことが期待されています。特に、コスト削減と性能向上が実現されており、企業やクリエイターにとって非常に魅力的な選択肢となるでしょう。今後の展開に注目です。