fal MiniMax H3 Realism People LoRA:为 ComfyUI 带来照片级真实人物

ComfyUI Wikinews

fal 发布 MiniMax H3 Realism People LoRA:一款触发词适配器,让已生成的人物在 T2V、I2V 和 R2V 中呈现照片级真实效果,附带开放权重与 fal LoRA 端点。

fal 于 8 月 10 日发布了 MiniMax H3 Realism People LoRA,这是一款专注于照片级真实人物的开放权重适配器。它是 fal 早期 MiniMax-H3-Realism-LoRA 的后续版本,在更大的、以人物为重点的数据集上重新训练,并以单个 125 MB safetensors 文件形式发布,覆盖文生视频、图生视频和参考生视频生成,使用触发词 r34l1sm

一个提示词、一个种子,构建此适配器时训练的十六种 LoRA 配置

一个提示词、一个种子,构建此适配器时训练的十六种 LoRA 配置(图片来自官方模型卡片)

它的作用

MiniMax H3 已经是一个强大的常规视频模型。此适配器进一步强化了以人物为中心的镜头表现:经得起特写考验的面部、自然而非平滑处理的皮肤质感、连贯的眼神与微表情、电影级打光,以及微妙的手持相机质感,同时保留 H3 原生的同步音频。

模型卡片用 19 组之前/之后对比 来佐证这些说法,每组使用相同的提示词和相同的种子,唯一的变量是 LoRA。下方的对比视频先播放每对中的基础模型版本,旁边再展示适配后的版本:

来自官方模型卡片的 197 秒之前/之后对比:特写镜头下的说话面孔、争吵、饱经风霜的皮肤、儿童、仪式和旅行场景

如何在 ComfyUI 中使用

权重是标准 safetensors LoRA,因此无需自定义节点:

  1. 模型仓库下载 h3-realism-people-t2v-i2v-r2v.safetensorsComfyUI/models/loras/
  2. 在 MiniMax H3 工作流(T2V、I2V 或 Ref2V)中添加 LoRA 加载器,并将其指向该文件。
  3. 以触发词 r34l1sm 开头编写提示词,然后描述场景。缩放 1.0 是预期强度;如需更轻微的效果,可降低到 0.6–0.8。

可用性

该 LoRA 在 Hugging Face 上免费且开源(fal/MiniMax-H3-Realism-People-LoRA,125 MB,T2V/I2V/R2V 集于一个文件)。对于 API 用户,它还可以通过 fal 的 LoRA 端点提供:fal.ai/models/minimax/h3/text-to-video/lora

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
fal MiniMax H3 Realism People LoRA:为 ComfyUI 带来照片级真实人物 | ComfyUI Wiki