Pixal3D 多视角支持登陆 ComfyUI:四角度生成更优 3D

ComfyUI Wikinews

ComfyUI 核心新增原生 Pixal3D 多视角支持,附带官方 bf16 和 INT8 权重,将四个轨道视角或 MV-diffusion 输出转化为更清晰的网格。

Pixal3D (GitHub, 项目页面) 于 2026 年 9 月 1 日发布了其多视角推理代码,ComfyUI 核心于 9 月 8 日在 PR #16048 中上线了对多视角权重的原生支持。不再局限于单张图像,现在您可以输入同一物体的最多四个轨道视角,新的 Pixal3DMultiViewConditioning 节点将它们合并为单个、更精确的网格。新的官方 Comfy-Org/Pixal3D 权重提供 bf16 和 INT8 ConvRot 版本。
Pixal3D 多视角示例:四个轨道视角融合为一个纹理网格

来自多视角支持 PR 的示例:同一物体的多个视角共同控制一次生成过程。

为何多视角输入很重要

单张照片会将物体背面留给模型的想象,这也是图像转 3D 结果最容易出错的地方:幻觉几何体、模糊文字,或沿轮廓弯曲的纹理。Pixal3D 的多视角路径同时对同一物体的多个视角进行形状和纹理级联的条件控制,因此任何输入图像中出现的表面都是基于观察重建的,而非猜测。

这些视角的典型来源:

  • 围绕物理物体拍摄的几张照片
  • 从您想要重制的现有 3D 资产渲染的帧
  • 来自多视角扩散模型的输出,这正是模型期望的轨道格式

ComfyUI 集成增加了什么

集成 PR 在现有的 TRELLIS.2/Pixal3D 节点集基础上增加了一个新节点和两个新官方权重:

  • Pixal3DMultiViewConditioning:接收一个 CLIP 视觉模型以及最多四张视角图像(前、左、后、右)。第一张视图定义物体的正面;如果姿态不一致,节点会发出警告。单个 fov 参数(默认 20.0)描述所有视图的相机,这与多视角扩散模型生成的合成轨道装置相匹配。
  • Comfy-Org/Pixal3D 中的新权重pixal3d_multiview_bf16.safetensorspixal3d_multiview_int8_convrot.safetensors 与单图像模型位于同一个 diffusion_models 文件夹中。形状 VAE、纹理 VAE 和 DINOv3 CLIP 视觉编码器与单图像 pipeline 共享,因此现有的 Pixal3D 安装只需要新的 diffusion 模型文件。
ComfyUI 中 Pixal3D 多视角工作流的节点图

官方多视角测试工作流:四张视角图像在进入共享的形状和纹理阶段前进入 Pixal3DMultiViewConditioning(来源:Comfy-Org/ComfyUI PR #16048)。

如何在 ComfyUI 中使用

  1. 更新 ComfyUI 至包含 PR #16048 的构建版本(2026 年 9 月 8 日或之后)。
  2. Comfy-Org/Pixal3D 下载 pixal3d_multiview_bf16.safetensors(或 INT8 ConvRot 版本以降低显存占用)到 ComfyUI/models/diffusion_models/
  3. 加载下方的工作流并连接您的视角:先前,然后左、后、右。没有透明度通道的视角会自动遮罩,但请保持每个视角未裁剪,因为构图编码了相机信息。

如果您只有一个物体的视角,请继续使用 我们之前的报道 中的原始单图像工作流:多视角权重是单独的文件,并非替代品。

Pixal3D 多视角第二示例

PR 中的第二个示例:轨道视角及生成的纹理网格。

可用性

  • 权重Comfy-Org/Pixal3D(为 ComfyUI 重新打包,MIT 许可证)以及原始的 TencentARC/Pixal3D 仓库,其 ckpts/*_mv 模型对应 ComfyUI 文件。
  • 参考实现TencentARC/Pixal3D 仓库中的 inference_mv.py,发布于 2026 年 9 月 1 日,带有用于自定义视角装置的 Blender/NeRF 风格 transforms.json 相机格式。
  • 演示TencentARC/Pixal3D Space 目前涵盖单图像路径。

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
Pixal3D 多视角支持登陆 ComfyUI:四角度生成更优 3D | ComfyUI Wiki