Gemini Omni 1.1 Flash: Управление видеогенерацией теперь в ComfyUI

ComfyUI Wikinews

ComfyUI добавляет пять API-узлов Gemini Omni 1.1 Flash для генерации текста в видео, изображения в видео, референса в видео, расширения сцены и редактирования видео с выходом 4K.

Gemini Omni 1.1 Flash, готовое к использованию обновление от Google DeepMind семейства видео моделей Gemini Omni Flash, доступно в ComfyUI через пять API-узлов (Google announcement, model card).

Опубликованная 27 августа 2026 года как общедоступная модель в Gemini API, Omni 1.1 Flash фокусируется на контроле разработчика: сцены можно расширять, указывать начальные и конечные кадры для плавных переходов, а вывод генерируется в высоком разрешении.

Gemini Omni 1.1 Flash

Визуализация объявления Gemini Omni 1.1 Flash из блога Google

Пять узлов ComfyUI

  • Текст в Видео: генерация по промпту через обновлённую модель.
  • Изображение в Видео: анимирование статичного изображения.
  • Референс в Видео: генерация из референсных ассетов.
  • Расширение Сцены: продолжение существующего клипа, объединение сгенерированных кадров в последовательности до 40 секунд.
  • Редактирование Видео: диалоговое редактирование, меняющее содержимое при сохранении стабильности остальной части видеоряда.

Обновлённая модель добавляет указание первого и последнего кадра для контролируемых переходов между кадрами и поддерживает вывод до разрешения 4K.

Как использовать

Обновите ComfyUI до последней сборки, затем найдите узлы Gemini в Библиотеке нод в разделе партнёра Google или загрузите официальные шаблоны. Шаблоны поставляются для всех пяти рабочих процессов, включая варианты t2v, i2v, r2v, extend и edit.

Генерация выполняется на серверах Google через систему API-узлов: локальные веса не используются, а оплата следует тарифам Gemini API.

Комментарии

Войдите через GitHub, чтобы участвовать в обсуждении.

Загрузка комментариев…
Gemini Omni 1.1 Flash: Управление видеогенерацией теперь в ComfyUI | ComfyUI Wiki