詳細・ビジネスへの影響
Microsoft AIのCEOであるMustafa Suleyman氏は、次世代モデルラインナップとして画像生成AI「MAI-Image-2.5-Pro」および超低遅延音声合成AI「MAI-Voice-2-Flash」の2モデルを正式リリースしたと発表しました。
「MAI-Image-2.5-Pro」は、実写と見分けがつかない高度な描写力に加え、プロンプトで指定したテキストを画像内に正確に印字する表現力と、既存画像の構成を維持したまま要素を書き換えるインペインティング機能を備えたフラッグシップ画像生成モデルです。一方の「MAI-Voice-2-Flash」は、リアルタイム対話型AIボイスエージェント向けに最適化された高速・低遅延テキスト読み上げ(TTS)モデルであり、自然な抑揚と即答性を両立しています。
両モデルはOpenRouterやAzure APIプラットフォーム経由で順次利用可能となっており、開発者は既存のインフラから簡単なAPI呼び出しで最新の画像生成および音声対話機能を自社サービスへ組み込むことが可能です(一次ソース:Mustafa Suleyman公式X)。
