Rekreate
模型指南

Gemini Omni Flash:通过对话编辑和创建视频

Google首个任意到任意模型如何助力短视频制作,Omni 1.1 Flash的改进,以及如何将其用作AI视频编辑器。

更新于 作者 Rekreate Editorial Team, AI视频研究
目录 Gemini Omni的独特之处Gemini Omni版本Gemini Omni 1.1 Flash规格创作者如何使用Gemini Omni在Rekreate中使用Gemini Omni编辑视频AI视频编辑提示词技巧常见问题

Gemini Omni是Google首个任意到任意多模态模型,于2026年5月19日的Google I/O大会上发布。其首个版本Gemini Omni Flash支持在单一提示词中输入文本、图像、音频和视频,并输出视频——更重要的是,它允许通过自然语言对话编辑和优化视频。在2026年8月,Google推出了Gemini Omni 1.1 Flash,新增场景扩展、起始和结束帧、视频输入编辑功能以及生产级API访问。

Rekreate在其AI视频编辑器中使用Gemini Omni,通过简单的英文指令修改现有短视频片段。

关键要点
  • **发布时间:**2026年5月19日(Google I/O);Omni 1.1 Flash于2026年8月推出。
  • **任意到任意:**文本、图像、音频和视频输入 → 视频输出。
  • **对话式编辑:**描述修改内容,获得编辑后的视频;可反复优化。
  • **规格(1.1 Flash):**输出时长3–10秒,分辨率从360p到4K,帧率24fps;视频输入最长10秒,用于编辑或扩展。
  • **在Rekreate中:**AI视频编辑器支持3–10秒的源视频片段,提供历史记录和社区图库。

使用Gemini Omni编辑视频

上传一个3–10秒的视频片段到AI视频编辑器,并描述需要的修改。

打开AI视频编辑器 →

免费试用。

Gemini Omni的独特之处

大多数视频模型是一次性生成器:输入提示词,输出视频片段,如果有问题只能重新开始。而Gemini Omni基于Gemini的多模态推理能力,可以理解现有视频进行针对性修改,同时保持其他元素不变——包括主体、光线、运动和风格。

这使得以下工作流成为可能:

  • “将她的外套改成红色,并添加下雨效果。”
  • “将咖啡杯替换为我们的产品罐。”
  • “将这个镜头改为黄金时刻,并添加慢推镜头。”
  • “将片段延长几秒,直到他走出画面。”

Google强调角色一致性、物理效果准确性以及每个视频片段的SynthID水印。Omni可在Gemini应用、Google Vids、Flow、Google AI Studio、Gemini API和Gemini企业代理平台中使用。

Gemini Omni版本

2026年5月19日

Gemini Omni Flash(预览版)

在Google I/O大会上发布,作为Google首个任意到任意模型。支持文本和图像转视频、对话式优化、角色一致性、视频扩展、分辨率提升和插帧。

2026年中

Gemini Omni Flash在Google Vids和Gemini应用中

整合到Google Workspace的Vids和Gemini应用中;场景扩展功能对Google AI Plus、Pro和Ultra订阅用户开放。

2026年8月

Gemini Omni 1.1 Flash 在 Rekreate 中

生产级API发布,新增场景扩展起始和结束帧视频输入编辑及更多创意控制。稳定模型ID为gemini-omni-1.1-flash

Gemini Omni 1.1 Flash规格

开发者 Google DeepMind
模型ID gemini-omni-1.1-flash(稳定版),gemini-omni-flash-preview
输入 文本、图像、音频、视频(视频最长10秒,用于编辑和扩展)
输出 视频,时长3–10秒,分辨率360p / 720p / 1080p / 4K,帧率24fps
功能 生成、对话式编辑、扩展、起始/结束帧、分辨率提升、插帧
上下文窗口 1,048,576个标记
水印 SynthID
在Rekreate中 AI视频编辑器 · 源视频片段3–10秒

创作者如何使用Gemini Omni

  • **视觉本地化成功广告:**根据不同市场修改已验证片段的场景、季节或道具。
  • **产品替换:**将库存或生成的视频中的通用产品替换为您的产品。
  • **修复细节:**移除对象、更改颜色或调整光线,而无需重新生成。
  • **测试风格变化:**为同一片段制作三种版本——白天、霓虹灯、舒适室内——看看哪种效果更好。
  • **优化其他模型生成的视频:**通过后续指令完善Seedance或Kling生成的视频。

在Rekreate中使用Gemini Omni编辑视频

  1. 打开AI视频编辑器

    进入Rekreate的AI视频编辑器。

  2. 上传一个3–10秒的视频片段

    使用您自己的素材或由Seedance、Kling或Veo生成的片段。

  3. 描述修改内容

    写下需要更改的内容以及必须保持不变的部分。使用优化提示词功能以获得更清晰的指令。

  4. 审查并优化

    在历史记录中比较结果,通过另一条指令进一步优化,并可选择将最佳编辑分享至社区图库。

AI视频编辑提示词技巧

  1. 说明需要保留的内容: “保持人物、构图和运动完全一致。”
  2. 一次只修改一到两项以获得可预测的结果。
  3. 具体描述: *“海军蓝羊毛外套”“更好看的外套”*效果更好。
  4. 物理描述光线和天气: “左侧低暖阳光,长阴影。”
  5. **尊重版权:**不要在未经许可的情况下将真实人物编辑到特定场景或插入您不拥有的商标。

常见问题

什么是Gemini Omni?

Gemini Omni是Google的任意到任意多模态模型,于2026年5月19日发布。Gemini Omni Flash支持文本、图像、音频和视频作为输入,并通过自然语言对话生成或编辑视频。

Gemini Omni 1.1 Flash有哪些新功能?

2026年8月发布的Omni 1.1 Flash新增场景扩展、起始和结束帧、视频输入编辑功能,并在Google AI Studio、Flow和Gemini企业代理平台中提供生产级API。

Gemini Omni视频的时长是多少?

Gemini Omni 1.1 Flash输出时长为3–10秒的视频,并接受最长10秒的视频用于编辑和扩展。

Gemini Omni和Veo是一样的吗?

不是。Veo是Google专门的视频生成系列(最新版本为Veo 3.1)。Gemini Omni是一个独立的任意到任意模型,专注于对话式生成和编辑。

我可以用Gemini Omni编辑我的TikTok视频吗?

可以,适用于短视频。在Rekreate的AI视频编辑器中,您可以上传3–10秒的视频片段并通过文本指令进行编辑。

Gemini Omni会添加水印吗?

每个Gemini Omni视频片段都包含Google的隐形SynthID水印。

用 Rekreate 制作你的下一个爆款视频

找到一个经过验证的短视频,使用你的脚本、虚拟人像和声音复刻它,并在一个工作空间内用 Seedance、Kling 和 Veo 生成场景。

开始免费试用 →

相关指南

来源

  1. Introducing Gemini Omni, Google blog
  2. Gemini Omni 1.1 Flash, Google blog
  3. Gemini Omni Flash model docs, Google AI for Developers
  4. Gemini Omni Flash in Google Vids, Google Workspace blog