Bernini v2: Modelo de vídeo de planificación semántica de ByteDance
ComfyUI Wiki
Bernini-Diffusers-v2 es el modelo de vídeo de planificación semántica de ByteDance con un renderizador Wan2.2 dual DiT, empaquetado para ComfyUI con pesos FP8 y NVFP4.
B
Bernini v2
Generación de vídeoDiTByteDanceComfyUIEl Bernini-Diffusers-v2 de ByteDance: la segunda versión de diffusers del marco Bernini. Un planificador semántico Qwen2.5-VL produce tokens de plan que un renderizador Wan2.2 dual DiT convierte en vídeo, soportando texto a vídeo, referencia a vídeo, edición de vídeo y transferencia estética en un solo flujo de trabajo.
| Desarrollador | ByteDance |
| Fecha | 2026-08-13 |
| Arquitectura | Planificador semántico Qwen2.5-VL + renderizador Wan2.2 dual DiT (ruido alto/bajo, cambiar en 0.875) |
| Licencia | Apache-2.0 |
| Variantes | FP8 escalado · NVFP4 (ambos DiTs) mediante el paquete ComfyUI |
| Capacidades | T2V · R2V · Edición V2V · edición guiada por referencia · transferencia estética |
Guides and workflows related to this model series.
No articles found.
Comentarios
Inicia sesión con GitHub para unirte a la conversación.