Pixal3D Multi-View dans ComfyUI : un meilleur 3D avec 4 vues
ComfyUI ajoute le support natif Pixal3D multi-vues avec des poids officiels bf16 et INT8 : quatre vues en orbite donnent un maillage 3D plus propre.
Pixal3DMultiViewConditioning les combine en un seul maillage plus précis. De nouveaux poids officiels Comfy-Org/Pixal3D sont livrés en bf16 et INT8 ConvRot.
Exemple issu du PR de support multi-vues : plusieurs vues du même objet conditionnent une passe de génération.
Pourquoi l'entrée multi-vue compte
Une seule photo laisse le dos d'un objet à l'imagination du modèle, c'est là où les résultats image-vers-3D échouent le plus souvent : géométrie hallucinée, texte brouillé, ou textures qui se courbent autour de la silhouette. Le chemin multi-vue de Pixal3D conditionne la cascade de forme et de texture sur plusieurs vues du même objet simultanément, afin que les surfaces apparaissant dans n'importe quelle image d'entrée soient reconstruites par observation plutôt que devinées.
Sources typiques pour ces vues :
- Quelques photos prises autour d'un objet physique
- Des images rendues à partir d'un actif 3D existant que vous souhaitez re-styliser
- Sortie d'un modèle de diffusion multi-vues, ce qui correspond exactement au format d'orbite attendu par le modèle
Ce que l'intégration ComfyUI ajoute
Le PR d'intégration étend l'ensemble de nœuds TRELLIS.2/Pixal3D existant avec un nouveau nœud et deux nouveaux poids officiels :
Pixal3DMultiViewConditioning: prend un modèle de vision CLIP ainsi que jusqu'à quatre images de vue (devant, gauche, arrière, droite). La première vue définit le devant de l'objet ; le nœud émet une alerte si votre pose ne correspond pas. Un seul paramètrefov(par défaut20.0) décrit la caméra pour toutes les vues, ce qui correspond aux supports d'orbite synthétiques produits par les modèles de diffusion multi-vues.- Nouveaux poids dans Comfy-Org/Pixal3D :
pixal3d_multiview_bf16.safetensorsetpixal3d_multiview_int8_convrot.safetensorsse trouvent aux côtés des single-image checkpoints dans le même dossierdiffusion_models. Le VAE de forme, le VAE de texture et l'encodeur de vision CLIP DINOv3 sont partagés avec le pipeline image unique, donc une installation Pixal3D existante n'a besoin que du nouveau fichier de modèle de diffusion.
Le flux de travail de test officiel multi-vues : quatre images de vue entrent dans Pixal3DMultiViewConditioning avant les étapes de forme et de texture partagées (source : PR #16048 de Comfy-Org/ComfyUI).
Comment l'utiliser dans ComfyUI
- Mettre à jour ComfyUI vers une version incluant le PR #16048 (8 septembre 2026 ou ultérieur).
- Télécharger
pixal3d_multiview_bf16.safetensors(ou la version INT8 ConvRot pour moins de VRAM) depuis Comfy-Org/Pixal3D versComfyUI/models/diffusion_models/. - Chargez le flux de travail ci-dessous et connectez vos vues : devant d'abord, puis gauche, arrière et droite. Les vues sans canal alpha sont masquées automatiquement, mais gardez chaque vue non recadrée, car le cadrage encode la caméra.
Si vous n'avez qu'une seule vue de l'objet, continuez à utiliser le flux de travail image unique original de notre article précédent : les poids multi-vues sont un fichier séparé, pas un remplacement.
Deuxième exemple issu du PR : vues en orbite et le maillage texturé résultant.
Disponibilité
- Poids : Comfy-Org/Pixal3D (repackagé pour ComfyUI, licence MIT) et le référentiel original TencentARC/Pixal3D, dont les checkpoints
ckpts/*_mvcorrespondent aux fichiers ComfyUI. - Implémentation de référence :
inference_mv.pydans le référentiel TencentARC/Pixal3D, publié le 1er septembre 2026 avec un format de camératransforms.jsonstyle Blender/NeRF pour des supports de vue personnalisés. - Démo : l'Espace TencentARC/Pixal3D couvre actuellement le chemin image unique.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.