Gemini Omni 1.1 Flash 模型:ComfyUI 现已支持可控视频生成

ComfyUI Wikinews

ComfyUI 新增五个 Gemini Omni 1.1 Flash API 节点,涵盖文生视频、图生视频、参考生视频、场景扩展和视频编辑,支持 4K 输出。

Gemini Omni 1.1 Flash,Google DeepMind 面向生产的 Gemini Omni Flash 视频模型系列更新版,现已通过五个 API 节点在 ComfyUI 上线(Google 公告模型卡片)。

于 2026 年 8 月 27 日作为通用可用模型在 Gemini API 中发布,Omni 1.1 Flash 侧重于开发者控制:可扩展场景,指定起始和结束帧以实现平滑过渡,并以高分辨率生成输出。

Gemini Omni 1.1 Flash 公告图

来自 Google 博客的 Gemini Omni 1.1 Flash 公告视觉图

五个 ComfyUI 节点

  • 文生视频:通过已更新模型进行提示驱动的生成。
  • 图生视频:为静态图像制作动画。
  • 参考生视频:从参考资产生成。
  • 场景扩展:继续现有片段,将生成的镜头链接成序列,最长可达 40 秒。
  • 视频编辑:对话式编辑,改变内容的同时保持其余画面稳定。

该已更新模型增加了首尾帧指定功能以控制镜头间的过渡,并支持最高4K 分辨率输出。

如何使用

更新 ComfyUI 至最新版本,然后在节点库的 Google 合作伙伴部分查找 Gemini 节点,或加载官方模板。所有五种工作流均提供模板,包括 t2vi2vr2vextendedit 变体。

生成通过 API 节点系统在 Google 服务器上运行:不涉及本地权重,计费遵循 Gemini API 价格。

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
Gemini Omni 1.1 Flash 模型:ComfyUI 现已支持可控视频生成 | ComfyUI Wiki