Bernini v2: Видео модель семантического планирования от ByteDance

ComfyUI Wiki

Bernini-Diffusers-v2: видео модель семантического планирования от ByteDance с рендерером Wan2.2 dual DiT, упакованная для ComfyUI с весами FP8 и NVFP4.

B

Bernini v2

Генерация ВидеоDiTByteDanceComfyUI

Bernini-Diffusers-v2 от ByteDance: второй релиз diffusers фреймворка Bernini. Семантический планировщик Qwen2.5-VL генерирует плановые токены, которые рендерер Wan2.2 dual DiT преобразует в видео, поддерживая генерацию текст-в-видео, референс-в-видео, редактирование видео и передачу стиля в едином рабочем процессе.

РазработчикByteDance
Дата2026-08-13
АрхитектураСемантический планировщик Qwen2.5-VL + рендерер Wan2.2 dual DiT (высокий/низкий шум, переключить на 0.875)
ЛицензияApache-2.0
ВариантыFP8 масштабированный · NVFP4 (оба DiTs) через пакет ComfyUI
ВозможностиT2V · R2V · Редактирование V2V · редактирование по референсу · передача стиля

Guides and workflows related to this model series.

No articles found.

Комментарии

Войдите через GitHub, чтобы участвовать в обсуждении.

Загрузка комментариев…