Google 在 I/O 2026 上推出了 Gemini Omni,并且 Gemini Omni Flash 是该系列的首款模型。它专为从几乎任意输入创建视频而打造,之后只需对话就能持续编辑。
如果你用过 Nano Banana 生成图像,那这就是它的视频版:速度快、支持多模态,并依托 Gemini 对真实世界的理解,同时 credits 消耗也十分实惠。Google 甚至将它称为“视频版的 Nano Banana”。
下面用通俗易懂的方式介绍 Gemini Omni Flash 是什么、能做什么、在 Google 产品阵容中的定位,以及在哪里试用。
要点总结
- Gemini Omni Flash 是 Google 的首款 Omni 系列模型,一款任意输入转视频的生成器。
- 它接收文本、图像和视频,输出约十秒、带原生音频的片段。
- 它最突出的功能是对话式编辑:只需描述改动即可优化视频。
- 它以 Gemini 的世界知识为根基,因此在物理表现和 prompt 遵循度上都相当出色。
- 你可以在 OpenArt 上使用它,还有 Veo 3.1、Seedance 2.0 和 Kling Omni 供你选择。
什么是 Gemini Omni Flash?
Gemini Omni Flash(技术名称:gemini-omni-flash-preview)是 Google 快速的多模态 AI 视频模型,也是全新 Gemini Omni 系列的首款产品。它能把文字、图片和短视频片段转化为成品画面,并带有同步声音。
它的独特之处在于原生多模态:可同时处理文本、图像、音频和视频,让输出既连贯又可控。你无需从头重新生成,而是通过自然对话一步步打磨片段。
你真正能用它做什么
Gemini Omni Flash 涵盖三大核心 AI 视频生成任务: 文生视频、图生视频与对话式编辑(全部自带原生音频)。这样的适用范围意味着,从最初的灵感到最终的微调,一个模型就能搞定短视频创作流程的绝大部分环节。
看看它如何为真实创作者提供助力:
从 prompt 生成:
描述一个场景,即可获得约十秒带音频的视频片段。
让照片动起来:
用逼真的动态,让静态图片或产品照活灵活现。
对话式编辑:
只需描述,就能替换角色、调整光线或重塑片段风格,其余部分保持不变。
用参考保持一致性:
用图片指定角色、风格或构图。
生成清晰可读的屏幕文字:
把文字写进 prompt,Omni 就能清晰渲染出来。
由于它建立在 Gemini 对物理、历史和文化的认知之上,即使提示词简短朴素,生成结果也往往精准到位。
Gemini Omni Flash 在 Google AI 模型阵容中的定位
Omni Flash 是 Omni 家族中主打速度、成本高效的版本,专为大批量、需要反复迭代的工作打造。在 Gemini 应用中,它取代 Veo 成为视频模型,同时也为 Google Flow 中的视频提供支持。
「Flash」这个名字所传达的含义与它在整个 Gemini 系列中一致:快速且实惠,专为快速出片而调校,而非追求最长或最高分辨率的渲染。对大多数短视频而言,这样的取舍恰到好处。
体验 Gemini Omni Flash 最简单的方式:OpenArt
无需单独订阅 Google AI 套餐,也不用任何技术设置。体验 Omni Flash 最简单的方式就是通过 OpenArt,打开浏览器即可使用。
更大的优势在于,OpenArt 的 AI 视频生成器 不止一个模型。除了 Gemini Omni Flash,你还能在同一套方案下自由切换 Veo 3.1、Seedance 2.0、Kling Omni 等多款模型,再用视频高清放大和视频延长等工具为镜头收尾。
想要快速出片和聊天式编辑时就用 Omni Flash;项目需要不一样的效果时,随时切换到其他模型。
常见问题:Gemini Omni Flash 指南
Gemini Omni Flash 基于什么打造?
它是 Google Gemini Omni 系列(gemini-omni-flash-preview)中的首个模型,是一款原生多模态的视频生成与编辑模型。
视频有多长?
每次生成约十秒,带原生音频。在 OpenArt 上,你可以用视频延长功能增加时长。
它和 Gemini 2.0 Flash 是一回事吗?
不是。那是一个语言模型。Omni Flash 是 Gemini Omni 家族中于 2026 年推出的专属视频模型。
我能在不重新生成的情况下编辑片段吗?
可以。在聊天中描述你想改的地方,Omni Flash 就会应用改动,同时保持场景、动作和构图的其余部分不变。
我可以在哪里使用它?
通过 Google 的 Gemini 应用和 Flow、Gemini API,或在 OpenArt 上与其他顶级视频模型一同使用。