LoRA MiniMax H3 RAVEN: потоковое видео в реальном времени в ComfyUI
RAVEN (Имперский колледж Лондона) превращает MiniMax H3 в генератор потокового видео через адаптер LoRA 4-NFE с официальными узлами ComfyUI.
RAVEN (Real-time Autoregressive Video Extrapolation with Consistency-model GRPO), исследовательский проект Имперского колледжа Лондона, выпускает адаптер LoRA, который превращает MiniMax H3 в каузальный потоковый генератор: вместо шумоподавления одного двунаправленного клипа модель генерирует видео блок за блоком, экстраполируя каждый новый блок из ранее сгенерированного содержимого. Выпущенный адаптер ПРЕДПРОСМОТРА генерирует 192 кадров при 1376×768 / 24 fps всего за 4 шага выборки (NFE), а проект поставляется с официальными узлами ComfyUI (ComfyUI-MiniMax-H3-RAVEN-Streaming) плюс готовым примером рабочего процесса от начала до конца.
Как это работает
RAVEN сохраняет архитектуру MiniMax-H3 и добавляет потоковый модуль, обученный с помощью модели согласованности GRPO: каждый блок генерируется из предыдущего контекста с небольшим фиксированным количеством вычислений функции. Это делает генерацию прогрессивной — контент появляется блок за блоком, а не все сразу, что является ключевым строительным блоком для взаимодействия в реальном времени. Адаптер ПРЕДПРОСМОТРА с 4 NFE нацелен на сетки видео и аудио совместно, поэтому потоки текст-в-видео-и-аудио (T2VA) выходят из того же каузального прохода.
Выпущенный вес — это адаптер LoRA (r=128, lora_alpha=128), загружаемый поверх MiniMax-H3; это первоначальный релиз ПРЕДПРОСМОТРА, и авторы отмечают, что детализация текстур всё ещё улучшается.
RAVEN превращает двунаправленное шумоподавление в каузальную потоковую экстраполяцию блок за блоком (рисунок со страницы проекта)
Демо
Нарезка потоковой генерации со страницы проекта RAVEN (видео с yanzuo.lu)
Сравнение предпочтений людей из статьи RAVEN
Детали модели
| Пункт | Значение |
|---|---|
| Базовая модель | MiniMaxAI/MiniMax-H3 |
| Адаптер | LoRA, r=128, lora_alpha=128 |
| Выборка | 4 NFE (сетки видео и аудио) |
| Кадров | 192 |
| Разрешение | 768 × 1376 |
| Частота кадров | 24 fps |
| Каузальная сегментация | sink=2, window=2 |
| Файл весов | minimax_h3_raven_streaming_lora_4nfe_preview.safetensors (~5 GB) |
Использование в ComfyUI
Официальные узлы были выпущены 20 августа 2026 года и опубликованы в Comfy Registry как comfyui-minimax-h3-raven-streaming. Установите, поискав MiniMax H3 RAVEN Streaming в ComfyUI-Manager, или выполните comfy node install comfyui-minimax-h3-raven-streaming, затем перезапустите ComfyUI.
- Установите Пользовательские ноды (ComfyUI-Manager или git clone в
custom_nodes/). - Скачайте
minimax_h3_raven_streaming_lora_4nfe_preview.safetensorsвComfyUI/models/loras/и стандартные файлы модели MiniMax H3 в их обычные папки. - Загрузите прилагаемый пример рабочего процесса (Рабочий процесс → Просмотреть шаблоны → Расширения, или перетащите JSON ниже на Холст) и запустите.
Пакет Узлов реализует потоковый СЭМПЛЕР с приоритетом блоков, виджет ПРЕДПРОСМОТРА потока и обязательное подключение LoRA RAVEN поверх встроенной реализации MiniMax H3 в ComfyUI. Авторы проверили генерацию 1376×768 / 192 кадров внутри смоделированного ограничения 24 GiB VRAM.
Это не нативная поддержка ComfyUI: потоковые узлы зависят от стороннего пакета пользовательских нод
ComfyUI-MiniMax-H3-RAVEN-Streaming.
Доступность
- Веса: mvp-lab/MiniMax-H3-RAVEN-Streaming-LoRA (лицензией сообщества MiniMax H3)
- Страница проекта: yanzuo.lu/raven
- Статья: arXiv:2605.15190
- Код: mvp-ai-lab/RAVEN
- Узлы ComfyUI: YanzuoLu/ComfyUI-MiniMax-H3-RAVEN-Streaming · Comfy Registry
Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.