Google、動画生成・編集向けモデル「Gemini Omni 1.1 Flash」を発表
テキスト、画像、音声、動画に対応し、開始・終了フレームの制御や既存シーンの拡張が可能に
📅 2026年8月29日 03:19
Googleは2026年8月27日、動画生成(Generative Video)および動画編集向けのマルチモーダルモデル「Gemini Omni 1.1 Flash」を正式発表し、一般提供(GA)を開始した。
特徴的な機能は「Scene Extension(シーン拡張)」で、最大10秒前の動画コンテキストを分析した上で、既存コンテンツに続く映像を生成できる。これにより、直前のシーンの雰囲気や構図を保ちながら映像を自然に拡張可能となった。また、ユーザーは開始フレームと終了フレームを指定して、トランジションの方向性や連続性を制御できる。
本モデルは最大4K解像度に対応する一方、高画質レンダリング前にアイデアを検証できる360pの「Draft(下書き)モード」も備えており、プロンプトの調整やテストにかかるコストを削減できる。入力はテキスト、画像、音声、動画に対応し、複数のメディアを組み合わせて出力を細かく制御可能だ。
Gemini Omni 1.1 Flashは、Google AI Studio、Gemini Enterprise Agent Platform、Google Flow経由で利用できる。今回のリリースは、AI動画ツールが単なるテキストからのクリップ生成にとどまらず、シーケンス制御や既存映像の精密な編集へとシフトしていることを示している。ただし、実際の出力品質は動画の特性やプロンプト、後工程の編集に依存する。
Why it matters
プロトタイプ作成、シーンの拡張、AIを活用した映像構成の選択肢が広がる。360pモードの活用により、リソース消費の大きい4K動画の生成前に低コストで試作が可能になる。
プロトタイプ作成、シーンの拡張、AIを活用した映像構成の選択肢が広がる。360pモードの活用により、リソース消費の大きい4K動画の生成前に低コストで試作が可能になる。
Sources (rewritten & summarized from): Product Hunt · google.dev · blog.google · orcarouter.ai · producthunt.com · deepmind.google