LoRA MiniMax H3 RAVEN: потоковое видео в реальном времени в ComfyUI

ComfyUI Wikinews

RAVEN (Имперский колледж Лондона) превращает MiniMax H3 в генератор потокового видео через адаптер LoRA 4-NFE с официальными узлами ComfyUI.

RAVEN (Real-time Autoregressive Video Extrapolation with Consistency-model GRPO), исследовательский проект Имперского колледжа Лондона, выпускает адаптер LoRA, который превращает MiniMax H3 в каузальный потоковый генератор: вместо шумоподавления одного двунаправленного клипа модель генерирует видео блок за блоком, экстраполируя каждый новый блок из ранее сгенерированного содержимого. Выпущенный адаптер ПРЕДПРОСМОТРА генерирует 192 кадров при 1376×768 / 24 fps всего за 4 шага выборки (NFE), а проект поставляется с официальными узлами ComfyUI (ComfyUI-MiniMax-H3-RAVEN-Streaming) плюс готовым примером рабочего процесса от начала до конца.

Как это работает

RAVEN сохраняет архитектуру MiniMax-H3 и добавляет потоковый модуль, обученный с помощью модели согласованности GRPO: каждый блок генерируется из предыдущего контекста с небольшим фиксированным количеством вычислений функции. Это делает генерацию прогрессивной — контент появляется блок за блоком, а не все сразу, что является ключевым строительным блоком для взаимодействия в реальном времени. Адаптер ПРЕДПРОСМОТРА с 4 NFE нацелен на сетки видео и аудио совместно, поэтому потоки текст-в-видео-и-аудио (T2VA) выходят из того же каузального прохода.

Выпущенный вес — это адаптер LoRA (r=128, lora_alpha=128), загружаемый поверх MiniMax-H3; это первоначальный релиз ПРЕДПРОСМОТРА, и авторы отмечают, что детализация текстур всё ещё улучшается.

RAVEN architecture

RAVEN превращает двунаправленное шумоподавление в каузальную потоковую экстраполяцию блок за блоком (рисунок со страницы проекта)

Демо

Нарезка потоковой генерации со страницы проекта RAVEN (видео с yanzuo.lu)

Preference comparison

Сравнение предпочтений людей из статьи RAVEN

Детали модели

ПунктЗначение
Базовая модельMiniMaxAI/MiniMax-H3
АдаптерLoRA, r=128, lora_alpha=128
Выборка4 NFE (сетки видео и аудио)
Кадров192
Разрешение768 × 1376
Частота кадров24 fps
Каузальная сегментацияsink=2, window=2
Файл весовminimax_h3_raven_streaming_lora_4nfe_preview.safetensors (~5 GB)

Использование в ComfyUI

Официальные узлы были выпущены 20 августа 2026 года и опубликованы в Comfy Registry как comfyui-minimax-h3-raven-streaming. Установите, поискав MiniMax H3 RAVEN Streaming в ComfyUI-Manager, или выполните comfy node install comfyui-minimax-h3-raven-streaming, затем перезапустите ComfyUI.

  1. Установите Пользовательские ноды (ComfyUI-Manager или git clone в custom_nodes/).
  2. Скачайте minimax_h3_raven_streaming_lora_4nfe_preview.safetensors в ComfyUI/models/loras/ и стандартные файлы модели MiniMax H3 в их обычные папки.
  3. Загрузите прилагаемый пример рабочего процесса (Рабочий процесс → Просмотреть шаблоны → Расширения, или перетащите JSON ниже на Холст) и запустите.

Пакет Узлов реализует потоковый СЭМПЛЕР с приоритетом блоков, виджет ПРЕДПРОСМОТРА потока и обязательное подключение LoRA RAVEN поверх встроенной реализации MiniMax H3 в ComfyUI. Авторы проверили генерацию 1376×768 / 192 кадров внутри смоделированного ограничения 24 GiB VRAM.

Это не нативная поддержка ComfyUI: потоковые узлы зависят от стороннего пакета пользовательских нод ComfyUI-MiniMax-H3-RAVEN-Streaming.

Доступность

Комментарии

Войдите через GitHub, чтобы участвовать в обсуждении.

Загрузка комментариев…
LoRA MiniMax H3 RAVEN: потоковое видео в реальном времени в ComfyUI | ComfyUI Wiki