Gemini Omni 1.1 Flash: Управление видеогенерацией теперь в ComfyUI
ComfyUI добавляет пять API-узлов Gemini Omni 1.1 Flash для генерации текста в видео, изображения в видео, референса в видео, расширения сцены и редактирования видео с выходом 4K.
Gemini Omni 1.1 Flash, готовое к использованию обновление от Google DeepMind семейства видео моделей Gemini Omni Flash, доступно в ComfyUI через пять API-узлов (Google announcement, model card).
Опубликованная 27 августа 2026 года как общедоступная модель в Gemini API, Omni 1.1 Flash фокусируется на контроле разработчика: сцены можно расширять, указывать начальные и конечные кадры для плавных переходов, а вывод генерируется в высоком разрешении.
Визуализация объявления Gemini Omni 1.1 Flash из блога Google
Пять узлов ComfyUI
- Текст в Видео: генерация по промпту через обновлённую модель.
- Изображение в Видео: анимирование статичного изображения.
- Референс в Видео: генерация из референсных ассетов.
- Расширение Сцены: продолжение существующего клипа, объединение сгенерированных кадров в последовательности до 40 секунд.
- Редактирование Видео: диалоговое редактирование, меняющее содержимое при сохранении стабильности остальной части видеоряда.
Обновлённая модель добавляет указание первого и последнего кадра для контролируемых переходов между кадрами и поддерживает вывод до разрешения 4K.
Как использовать
Обновите ComfyUI до последней сборки, затем найдите узлы Gemini в Библиотеке нод в разделе партнёра Google или загрузите официальные шаблоны. Шаблоны поставляются для всех пяти рабочих процессов, включая варианты t2v, i2v, r2v, extend и edit.
Генерация выполняется на серверах Google через систему API-узлов: локальные веса не используются, а оплата следует тарифам Gemini API.
Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.