Bernini v2: Modelo de vídeo de planificación semántica de ByteDance

ComfyUI Wiki

Bernini-Diffusers-v2 es el modelo de vídeo de planificación semántica de ByteDance con un renderizador Wan2.2 dual DiT, empaquetado para ComfyUI con pesos FP8 y NVFP4.

B

Bernini v2

Generación de vídeoDiTByteDanceComfyUI

El Bernini-Diffusers-v2 de ByteDance: la segunda versión de diffusers del marco Bernini. Un planificador semántico Qwen2.5-VL produce tokens de plan que un renderizador Wan2.2 dual DiT convierte en vídeo, soportando texto a vídeo, referencia a vídeo, edición de vídeo y transferencia estética en un solo flujo de trabajo.

DesarrolladorByteDance
Fecha2026-08-13
ArquitecturaPlanificador semántico Qwen2.5-VL + renderizador Wan2.2 dual DiT (ruido alto/bajo, cambiar en 0.875)
LicenciaApache-2.0
VariantesFP8 escalado · NVFP4 (ambos DiTs) mediante el paquete ComfyUI
CapacidadesT2V · R2V · Edición V2V · edición guiada por referencia · transferencia estética

Guides and workflows related to this model series.

No articles found.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…