Google 发布 Gemini Omni 1.1 Flash,用于生成和编辑视频
新模型支持文本、图像、音频和视频,并可控制起始与结束画面及扩展原有场景
📅 2026年8月29日 03:19
Google 于 2026 年 8 月 27 日正式发布 Gemini Omni 1.1 Flash,并全面开放使用。该模型定位为 Multimodal(多模态)模型,面向 Generative Video(AI 视频生成)和视频编辑任务。
其亮点是 Scene Extension(场景扩展)功能,可分析最多 10 秒的前序视频内容,再接续生成画面。这有助于延续此前片段的氛围和构图。用户还可控制起始帧和结束帧,以设定转场的方向和连贯性。
该模型最高支持 4K 视频,同时提供 360p 的 Draft(视频草稿)模式,方便用户先验证创意,再生成高质量文件,从而降低修改和测试提示词阶段的成本。它支持文本、图像、音频和视频输入,可结合多种数据来定义输出效果。
Gemini Omni 1.1 Flash 可通过 Google AI Studio、Gemini Enterprise Agent Platform 和 Google Flow 使用。此次发布表明,AI 视频工具正从按文本生成短片,发展到更精细地控制镜头顺序和编辑现有内容。不过,实际效果仍取决于视频类型、提示词以及用户的审核与修改流程。
Why it matters
泰国开发者和内容制作人员在使用 AI 制作原型、扩展场景及设计视频节奏方面有了更多选择;360p 模式可先行试验,再生成资源消耗更高的 4K 文件。
泰国开发者和内容制作人员在使用 AI 制作原型、扩展场景及设计视频节奏方面有了更多选择;360p 模式可先行试验,再生成资源消耗更高的 4K 文件。
Sources (rewritten & summarized from): Product Hunt · google.dev · blog.google · orcarouter.ai · producthunt.com · deepmind.google