Gemini Omni 1.1 Flash : la vidéo contrôlée dans ComfyUI
ComfyUI ajoute cinq nœuds API Gemini Omni 1.1 Flash couvrant texte-vers-vidéo, image-vers-vidéo, référence-vers-vidéo, extension de scène et édition vidéo avec sortie 4K.
Gemini Omni 1.1 Flash, mise à jour prête pour la production de la famille de modèles vidéo Gemini Omni Flash de Google DeepMind, est disponible dans ComfyUI via cinq nœuds API (annonce Google, carte du modèle).
Sorti le 27 août 2026 en tant que modèle généralement disponible dans l'API Gemini, Omni 1.1 Flash se concentre sur le contrôle des développeurs : les scènes peuvent être étendues, les images de début et de fin spécifiées pour des transitions lisses, et la sortie générée à haute résolution.
Visuel d'annonce Gemini Omni 1.1 Flash depuis le blog Google
Les cinq nœuds ComfyUI
- Texte vers Vidéo : génération pilotée par prompt via le modèle mis à jour.
- Image vers Vidéo : animer une image fixe.
- Référence vers Vidéo : générer à partir de ressources de référence.
- Extension de Scène : continuer un clip existant, enchaîner les plans générés en séquences jusqu'à 40 secondes.
- Édition Vidéo : édition conversationnelle qui modifie le contenu tout en gardant le reste de la vidéo stable.
Le modèle mis à jour ajoute la spécification de la première et dernière image pour des transitions contrôlées entre les plans, et prend en charge une sortie jusqu'à une résolution 4K.
Comment l'utiliser
Mettez à jour ComfyUI vers la dernière version, puis trouvez les nœuds Gemini dans la Bibliothèque de nœuds sous la section Partenaire Google, ou chargez les modèles officiels. Les modèles sont livrés pour tous les cinq flux de travail, y compris les variantes t2v, i2v, r2v, extend et edit.
La génération s'exécute sur les serveurs de Google via le système de nœuds API : aucun poids local n'est impliqué, et la facturation suit la tarification de l'API Gemini.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.