Gemini Omni 1.1 Flash: 制御可能な動画生成が ComfyUI に登場

ComfyUI Wikinews

ComfyUI に、テキストから動画、画像から動画、参照から動画、シーン拡張、および 4K 出力対応のビデオ編集をカバーする 5 つの Gemini Omni 1.1 Flash API ノードが追加されました。

Gemini Omni 1.1 Flash は、Google DeepMind の Gemini Omni Flash 動画モデルファミリー向けの生産準備完了版アップデートであり、5 つの API ノードを通じて ComfyUI で利用可能になりました(Google 発表モデルカード)。

2026 年 8 月 27 日に Gemini API の一般提供モデルとしてリリースされた Omni 1.1 Flash は、開発者の制御性を重視しており、シーンを拡張でき、スムーズなトランジションのために開始フレームと終了フレームを指定でき、高解像度で出力を生成できます。

Gemini Omni 1.1 Flash

Google ブログからの Gemini Omni 1.1 Flash 発表ビジュアル

5 つの ComfyUI ノード

  • テキストから動画: 更新済みのモデルを通じたプロンプト駆動型生成。
  • 画像から動画へ: 静止画をアニメートします。
  • 参照から動画: 参照アセットから生成します。
  • シーン拡張: 既存のクリップを続け、生成されたショットを最大 40 秒のシーケンスにチェーンします。
  • ビデオ編集: コンテンツを変更しつつ、映像の残りを安定して保つ対話形式の編集。

更新済みのモデルは、ショット間の制御されたトランジションのための最初のフレームと最後のフレームの指定を追加し、最高 4K 解像度までの出力をサポートします。

使用方法

ComfyUI を最新ビルドにアップデートし、その後、Google パートナーセクション内のノードライブラリで Gemini ノードを見つけるか、公式テンプレートをロードします。テンプレートは、t2vi2vr2vextendedit の各バリアントを含むすべての 5 つのワークフロー用に用意されています。

生成は API ノードシステムを通じて Google のサーバー上で実行されます:ローカルウェイトは関与せず、課金は Gemini API 料金に従います。

コメント

GitHubでサインインしてディスカッションに参加しましょう。

コメントを読み込み中…
Gemini Omni 1.1 Flash: 制御可能な動画生成が ComfyUI に登場 | ComfyUI Wiki