Pixal3D マルチビューが ComfyUI に登場:4 つの視点からより良い 3D を作成
ComfyUI Wikinews
ComfyUI コアにネイティブな Pixal3D マルチビューサポートが追加され、新しい公式の bf16 および INT8 ウェイトにより、4 つの軌道ショットまたは MV-diffusion 出力をよりクリーンなメッシュに変換します。
Pixal3D (GitHub, プロジェクトページ) は 2026 年 9 月 1 日にマルチビュー推論コードをリリースし、ComfyUI コアは 9 月 8 日に PR #16048 でマルチビューウェイトのネイティブサポートを実装しました。1 つの画像ではなく、同じオブジェクトの最大 4 つの軌道ショットを入力できるようになり、新しい
Pixal3DMultiViewConditioning ノードがそれらを単一のより正確なメッシュに結合します。新しい公式 Comfy-Org/Pixal3D ウェイトは bf16 および INT8 ConvRot で提供されます。
マルチビューサポート PR の例:同じオブジェクトの複数のビューが 1 つの生成パスを条件付けます。
なぜマルチビュー入力が必要なのか
1 枚の写真では、オブジェクトの背面はモデルの想像力に委ねられることになります。これが画像から 3D への変換結果が最も崩壊する箇所です:幻覚的なジオメトリ、滲んだテキスト、シルエットに沿って曲がるテクスチャなど。Pixal3D のマルチビューパスは、同じオブジェクトの複数のビューに対して形状とテクスチャのカスケードを同時に条件付けするため、どの入力画像にも現れる表面は推測ではなく観察に基づいて再構築されます。
これらのビューの一般的なソース:
- 物理的な物体の周りに撮影した数枚の写真
- リスタイリングしたい既存の 3D アセットからレンダリングされたフレーム
- マルチビュー diffusion モデルからの出力(これはモデルが期待する軌道フォーマットそのものです)
ComfyUI 統合で追加される機能
統合 PR は、既存の TRELLIS.2/Pixal3D ノードセットに 1 つの新しいノードと 2 つの新しい公式ウェイトを追加します:
Pixal3DMultiViewConditioning:CLIP ビジョンモデルと最大 4 つのビュー画像(前、左、後、右)を受け取ります。最初のビューがオブジェクトの前面を定義し、ポーズが一致しない場合ノードが警告します。単一のfovパラメータ(デフォルト20.0)がすべてのビューのカメラを記述しており、これはマルチビュー diffusion モデルが生成する合成軌道リグと一致します。- [Comfy-Org/Pixal3D] の新しいウェイト:
pixal3d_multiview_bf16.safetensorsとpixal3d_multiview_int8_convrot.safetensorsは、同じdiffusion_modelsフォルダー内のシングルイメージ checkpoint と共に配置されます。Shape VAE、texture VAE、および DINOv3 CLIP ビジョンエンコーダーはシングルイメージパイプラインと共有されているため、既存の Pixal3D インストールでは新しい diffusion モデルファイルのみが必要です。
公式のマルチビューテストワークフロー:4 つのビュー画像が共有の形状およびテクスチャステージの前に Pixal3DMultiViewConditioning に入力されます(ソース:Comfy-Org/ComfyUI PR #16048)。
ComfyUI での使用方法
- ComfyUI を PR #16048 を含むビルドに更新してください(2026 年 9 月 8 日以後)。
- Comfy-Org/Pixal3D から
pixal3d_multiview_bf16.safetensors(または VRAM が少ない場合は INT8 ConvRot バージョン)をComfyUI/models/diffusion_models/にダウンロードしてください。 - 以下のワークフローを読み込み、ビューを接続してください:最初は前、次に左、後ろ、右。アルファチャンネルがないビューは自動的にマット処理されますが、各ビューは切り抜かずに保持してください。枠組みがカメラ情報をエンコードしているためです。
オブジェクトのビューが 1 つしかない場合は、以前の解説 の元のシングルイメージ ワークフローを使い続けてください。マルチビューウェイトは別ファイルであり、置き換えではありません。
PR からの 2 つ目の例:軌道ビューと結果としてのテクスチャ付きメッシュ。
入手方法
- ウェイト:Comfy-Org/Pixal3D(ComfyUI 用に再パッケージ化、MIT ライセンス)およびオリジナルの TencentARC/Pixal3D リポジトリ。ComfyUI ファイルは
ckpts/*_mvcheckpoint に対応しています。 - 参考実装:TencentARC/Pixal3D リポジトリ内の
inference_mv.py。2026 年 9 月 1 日にリリースされ、カスタムビューリグ用の Blender/NeRF スタイルのtransforms.jsonカメラ形式が含まれています。 - デモ:TencentARC/Pixal3D Space は現在、シングルイメージパスのみ対応しています。
コメント
GitHubでサインインしてディスカッションに参加しましょう。