米Googleは、動画生成・動画編集に特化したマルチモーダルAIモデル「Gemini Omni 1.1 Flash」の一般提供(GA)を正式に開始しました。
本モデルは直近10秒間の映像コンテキストを詳細に理解し、既存の動画クリップを最大40秒まで破綻なく自然に延長するシーン拡張機能を搭載。
開始フレームや終了フレームのキービジュアル固定、4K解像度への高画質アップスケーリングに対応し、プロ向け映像制作ワークフローへの本格適用が可能となりました。
さらに、構想段階の試作に適した「360pドラフト生成モード」により、生成速度を最大60%高速化しつつAPI利用コストを従来の3分の1に抑制。
Google AI StudioやGemini Enterpriseを通じて即日利用可能となっており、広告・映像業界での動画制作イテレーションを劇的に加速させます(一次ソース:Google DeepMind 公式発表 / Impress Watch報道)。
