Bernini v2 : Modèle vidéo de planification sémantique de ByteDance
ComfyUI Wiki
Bernini-Diffusers-v2 est le modèle vidéo de planification sémantique de ByteDance avec un rendu DiT dual Wan2.2, packagé pour ComfyUI avec des poids FP8 et NVFP4.
B
Bernini v2
Génération vidéoDiTByteDanceComfyUILe Bernini-Diffusers-v2 de ByteDance : la deuxième version de la bibliothèque diffusers du framework Bernini. Un planificateur sémantique Qwen2.5-VL génère des jetons de plan qu'un rendu DiT dual Wan2.2 convertit en vidéo, supportant la génération texte vers vidéo, référence vers vidéo, l'édition vidéo et le transfert esthétique dans un seul flux de travail.
| Développeur | ByteDance |
| Date de sortie | 2026-08-13 |
| Architecture | Planificateur sémantique Qwen2.5-VL + rendu DiT dual Wan2.2 (bruit élevé/faible, bascule à 0.875) |
| Licence | Apache-2.0 |
| Variantes | FP8 pondéré · NVFP4 (les deux DiTs) via le pack ComfyUI |
| Capacités | T2V · R2V · Édition V2V · édition guidée par référence · transfert esthétique |
Guides and workflows related to this model series.
No articles found.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.