Gemini Omni 1.1 Flash 模型:ComfyUI 现已支持可控视频生成
ComfyUI Wikinews
ComfyUI 新增五个 Gemini Omni 1.1 Flash API 节点,涵盖文生视频、图生视频、参考生视频、场景扩展和视频编辑,支持 4K 输出。
Gemini Omni 1.1 Flash,Google DeepMind 面向生产的 Gemini Omni Flash 视频模型系列更新版,现已通过五个 API 节点在 ComfyUI 上线(Google 公告,模型卡片)。
于 2026 年 8 月 27 日作为通用可用模型在 Gemini API 中发布,Omni 1.1 Flash 侧重于开发者控制:可扩展场景,指定起始和结束帧以实现平滑过渡,并以高分辨率生成输出。
来自 Google 博客的 Gemini Omni 1.1 Flash 公告视觉图
五个 ComfyUI 节点
- 文生视频:通过已更新模型进行提示驱动的生成。
- 图生视频:为静态图像制作动画。
- 参考生视频:从参考资产生成。
- 场景扩展:继续现有片段,将生成的镜头链接成序列,最长可达 40 秒。
- 视频编辑:对话式编辑,改变内容的同时保持其余画面稳定。
该已更新模型增加了首尾帧指定功能以控制镜头间的过渡,并支持最高4K 分辨率输出。
如何使用
更新 ComfyUI 至最新版本,然后在节点库的 Google 合作伙伴部分查找 Gemini 节点,或加载官方模板。所有五种工作流均提供模板,包括 t2v、i2v、r2v、extend 和 edit 变体。
生成通过 API 节点系统在 Google 服务器上运行:不涉及本地权重,计费遵循 Gemini API 价格。
评论
使用 GitHub 登录后即可参与讨论。