Pixal3D Multi-View dans ComfyUI : un meilleur 3D avec 4 vues

ComfyUI Wikinews

ComfyUI ajoute le support natif Pixal3D multi-vues avec des poids officiels bf16 et INT8 : quatre vues en orbite donnent un maillage 3D plus propre.

Pixal3D (GitHub, page du projet) a publié son code d'inférence multi-vues le 1er septembre 2026, et le cœur de ComfyUI a intégré un support natif pour les poids multi-vues le 8 septembre dans PR #16048. Au lieu d'une seule image, vous pouvez désormais alimenter jusqu'à quatre vues en orbite du même objet, et le nouveau nœud Pixal3DMultiViewConditioning les combine en un seul maillage plus précis. De nouveaux poids officiels Comfy-Org/Pixal3D sont livrés en bf16 et INT8 ConvRot.
Exemple Pixal3D multi-vues : quatre vues en orbite fusionnées en un seul maillage texturé

Exemple issu du PR de support multi-vues : plusieurs vues du même objet conditionnent une passe de génération.

Pourquoi l'entrée multi-vue compte

Une seule photo laisse le dos d'un objet à l'imagination du modèle, c'est là où les résultats image-vers-3D échouent le plus souvent : géométrie hallucinée, texte brouillé, ou textures qui se courbent autour de la silhouette. Le chemin multi-vue de Pixal3D conditionne la cascade de forme et de texture sur plusieurs vues du même objet simultanément, afin que les surfaces apparaissant dans n'importe quelle image d'entrée soient reconstruites par observation plutôt que devinées.

Sources typiques pour ces vues :

  • Quelques photos prises autour d'un objet physique
  • Des images rendues à partir d'un actif 3D existant que vous souhaitez re-styliser
  • Sortie d'un modèle de diffusion multi-vues, ce qui correspond exactement au format d'orbite attendu par le modèle

Ce que l'intégration ComfyUI ajoute

Le PR d'intégration étend l'ensemble de nœuds TRELLIS.2/Pixal3D existant avec un nouveau nœud et deux nouveaux poids officiels :

  • Pixal3DMultiViewConditioning : prend un modèle de vision CLIP ainsi que jusqu'à quatre images de vue (devant, gauche, arrière, droite). La première vue définit le devant de l'objet ; le nœud émet une alerte si votre pose ne correspond pas. Un seul paramètre fov (par défaut 20.0) décrit la caméra pour toutes les vues, ce qui correspond aux supports d'orbite synthétiques produits par les modèles de diffusion multi-vues.
  • Nouveaux poids dans Comfy-Org/Pixal3D : pixal3d_multiview_bf16.safetensors et pixal3d_multiview_int8_convrot.safetensors se trouvent aux côtés des single-image checkpoints dans le même dossier diffusion_models. Le VAE de forme, le VAE de texture et l'encodeur de vision CLIP DINOv3 sont partagés avec le pipeline image unique, donc une installation Pixal3D existante n'a besoin que du nouveau fichier de modèle de diffusion.
Graphe de nœuds du flux de travail Pixal3D multi-vues dans ComfyUI

Le flux de travail de test officiel multi-vues : quatre images de vue entrent dans Pixal3DMultiViewConditioning avant les étapes de forme et de texture partagées (source : PR #16048 de Comfy-Org/ComfyUI).

Comment l'utiliser dans ComfyUI

  1. Mettre à jour ComfyUI vers une version incluant le PR #16048 (8 septembre 2026 ou ultérieur).
  2. Télécharger pixal3d_multiview_bf16.safetensors (ou la version INT8 ConvRot pour moins de VRAM) depuis Comfy-Org/Pixal3D vers ComfyUI/models/diffusion_models/.
  3. Chargez le flux de travail ci-dessous et connectez vos vues : devant d'abord, puis gauche, arrière et droite. Les vues sans canal alpha sont masquées automatiquement, mais gardez chaque vue non recadrée, car le cadrage encode la caméra.

Si vous n'avez qu'une seule vue de l'objet, continuez à utiliser le flux de travail image unique original de notre article précédent : les poids multi-vues sont un fichier séparé, pas un remplacement.

Deuxième exemple Pixal3D multi-vues

Deuxième exemple issu du PR : vues en orbite et le maillage texturé résultant.

Disponibilité

  • Poids : Comfy-Org/Pixal3D (repackagé pour ComfyUI, licence MIT) et le référentiel original TencentARC/Pixal3D, dont les checkpoints ckpts/*_mv correspondent aux fichiers ComfyUI.
  • Implémentation de référence : inference_mv.py dans le référentiel TencentARC/Pixal3D, publié le 1er septembre 2026 avec un format de caméra transforms.json style Blender/NeRF pour des supports de vue personnalisés.
  • Démo : l'Espace TencentARC/Pixal3D couvre actuellement le chemin image unique.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…
Pixal3D Multi-View dans ComfyUI : un meilleur 3D avec 4 vues | ComfyUI Wiki