LoRA MiniMax H3 VFX Edit: редактирование видео по промпту
Набор LoRA MiniMax H3 от Alissonerdx добавляет VFX Edit с управлением по промпту, а также Style Transfer и Head Swap, с рабочими процессами ComfyUI и примерами клипов.
Это тот же репозиторий, в котором появился LoRA резкости H3, о котором мы писали ранее в сентябре, и один из наиболее активно используемых наборов LoRA для H3: примерно 239 лайков и 26 600 загрузок на момент написания. Все модели обучены на весах ref2va для H3 и используют один и тот же приём с условием: исходный клип подаётся как выровненный гид через базовую ноду MiniMaxH3AddGuide при frame_idx = 0, поэтому модель видит оригинальный дубль с выравниванием по кадрам, а не как свободную видео-ссылку.
Что входит в пакет
| Модель | Что делает | Триггер | Рабочий процесс |
|---|---|---|---|
minimax_h3_vfx_edit_v1.0_r128 | VFX-редактирование по промпту на выровненном исходном клипе | vfx_edit: | minimax_h3_vfxedit_wokflow.json |
minimax_h3_vfx_edit_v1.0_r128_ffp | VFX Edit с более высоким разрешением и экспериментальным распространением первого кадра | vfx_edit: | тот же рабочий процесс |
minimax_h3_style_transfer_v1.0_r64 | Полная смена стиля клипа по изображению или текстовому описанию | style_transfer: | minimax_h3_style_transfer_workflow.json |
minimax_h3_head_swap_v1.0_r32 | Экспериментальная замена головы на выровненном клипе | head_swap: | minimax_h3_head_swap_workflow.json |
minimax_h3_lms_v1.0_r64 | Восстановление резкости и деталей (исходный адаптер) | фиксированная подпись | minimax_h3_lms_workflow.json |
Отдельный эксперимент с латентным апскейлером поставляется вместе с LoRA, а веса VFX Edit были загружены 21 сентября 2026 года.
VFX Edit
VFX Edit это главное дополнение: подайте на вход клип и инструкцию в одно предложение, и он вернёт тот же дубль с применённым только этим изменением.
vfx_edit: Add fire effects to the man's hands while preserving his identity, pose, motion, clothing, framing, lighting and background.Документация рекомендует сначала указать изменение, затем перечислить то, что должно сохраниться, и никогда не просить модель сохранить именно ту область, которую она должна заменить. Опубликованы две версии:
- Standard (
r128) обучалась в группировке по разрешению 384 на клипах из 73 кадров и не требует изображения-референса. - FFP (
r128_ffp, first-frame propagate) продолжает это обучение в группировке 512 на клипах из 124 кадров и добавляет экспериментальную поддержку передачи отредактированного первого кадра через нативный канал изображения-референса H3. Если изображение передано, промпт должен явно называть<Picture 1>и объяснять его роль; если нет, промпт вообще не должен упоминать<Picture 1>или<Subject 1>.
Для запуска поместите весь исходный клип в MiniMaxH3AddGuide, а не в слот видео-ссылки, приведите соотношение сторон источника и количество кадров к поддерживаемым значениям и начните с силы LoRA 1.0. Опубликованные ограничения честно описывают, чем это не является: дрейф личности, переписанные текст и логотипы, слабая мелкая детализация и худшие результаты на длинных клипах. Это не композитор, и он не гарантирует попиксельного сохранения.
![]() | ![]() |
|---|---|
| Примеры клипов VFX Edit из репозитория | Второй пример VFX Edit |
Style Transfer и Head Swap
Style Transfer полностью меняет стиль клипа, стараясь сохранить движение, кадрирование и тайминг. Исходное видео подаётся в MiniMaxH3AddGuide, а изображение стиля в нативный канал ссылки как <Picture 1>, при силе 1.0, снижая примерно до 0.7, если стиль начинает подавлять исходное движение. Текстовые промпты стиля без изображения работают для стилей, которые базовая модель уже знает. Документация предостерегает от указания имени художника вместе с изображением-референсом, поскольку текст может пересилить изображение.
Head Swap помечен как экспериментальный и использует оба пути условия с разными ролями: заменяющее лицо проходит через нативный канал ссылки как <Picture 1> / <Subject 1>, а полное базовое видео через MiniMaxH3AddGuide при frame_idx = 0 как <Video 1>. Базовое видео не должно подаваться через нативный канал видео-ссылки. Документация также содержит явное предупреждение об ответственном использовании: только для исследований и творчества, без выдачи себя за других, мошенничества или обмана.
Пример Style Transfer из репозитория
Эксперимент с латентным апскейлером
Пакет также документирует экспериментальный чекпоинт латентного апскейлера h3_upscaler_lms_v0.1, который был основан на латентном апскейлере LBH-123-AI и дообучен на 2 000 шагов на том же датасете резкости, что использовался для LoRA LMS. Одни и те же веса опубликованы дважды, в папках latent_upscaler/ и experiments/, и руководство прямо указывает, что отдельное примерное видео или рабочий процесс для него пока не загружены.
Доступность
Скачайте LoRA из репозитория, поместите их в ComfyUI/models/loras/ и загрузите соответствующий рабочий процесс из папки workflows/: в каждом перечислены необходимые ему модели. Сам путь условия LoRA работает на базовых узлах MiniMax H3 (включая MiniMaxH3AddGuide), но приложенные примеры рабочих процессов также загружают видео, изменяют размер кадров и запускают latent-апскейлер через сторонние пакеты узлов, поэтому установите всё, что указано в заметках к каждому процессу.


Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.