Bernini v2 : Modèle vidéo de planification sémantique de ByteDance

ComfyUI Wiki

Bernini-Diffusers-v2 est le modèle vidéo de planification sémantique de ByteDance avec un rendu DiT dual Wan2.2, packagé pour ComfyUI avec des poids FP8 et NVFP4.

B

Bernini v2

Génération vidéoDiTByteDanceComfyUI

Le Bernini-Diffusers-v2 de ByteDance : la deuxième version de la bibliothèque diffusers du framework Bernini. Un planificateur sémantique Qwen2.5-VL génère des jetons de plan qu'un rendu DiT dual Wan2.2 convertit en vidéo, supportant la génération texte vers vidéo, référence vers vidéo, l'édition vidéo et le transfert esthétique dans un seul flux de travail.

DéveloppeurByteDance
Date de sortie2026-08-13
ArchitecturePlanificateur sémantique Qwen2.5-VL + rendu DiT dual Wan2.2 (bruit élevé/faible, bascule à 0.875)
LicenceApache-2.0
VariantesFP8 pondéré · NVFP4 (les deux DiTs) via le pack ComfyUI
CapacitésT2V · R2V · Édition V2V · édition guidée par référence · transfert esthétique

Guides and workflows related to this model series.

No articles found.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…