2026-07-24 LLM・モデル重要度: ★★★★★

Microsoft、MAIモデル2種を公開

Microsoft、MAIモデル2種を公開

この記事の3行要約(斜め読み)

  • Microsoft AIが画像生成「MAI-Image-2.5-Pro」と音声合成「MAI-Voice-2-Flash」を正式公開。
  • 画像モデルは高精細な描写力と画像内文字印字に対応し、音声モデルは対話AI向けに超低遅延を実現。
  • OpenRouterやAzureプラットフォーム経由で利用可能となり、開発者のAI組み込みを加速。

詳細・ビジネスへの影響

Microsoft AIのCEOであるMustafa Suleyman氏は、次世代モデルラインナップとして画像MAI-Image-2.5-Pro」および超低遅延音声合成AI「MAI-Voice-2-Flash」の2モデルを正式リリースしたと発表しました。

」は、実写と見分けがつかない高度な描写力に加え、で指定したテキストを画像内に正確に印字する表現力と、既存画像の構成を維持したまま要素を書き換えるインペインティング機能を備えたフラッグシップ画像生成モデルです。一方の「」は、リアルタイム対話型AIボイスエージェント向けに最適化された高速・低遅延テキスト読み上げ(TTS)モデルであり、自然な抑揚と即答性を両立しています。

両モデルはOpenRouterやAzure プラットフォーム経由で順次利用可能となっており、開発者は既存のインフラから簡単なAPI呼び出しで最新の画像生成および音声対話機能を自社サービスへ組み込むことが可能です(一次ソース:Mustafa Suleyman公式X)。

毎朝のAIトレンドをメールマガジンで受信

AI Guide-Noteが配信する最新のAIニュースや活用ノウハウ、モデル比較情報を毎朝お届けします。 最新情報のキャッチアップや実務への活用にお役立てください。