AnyAngle Studio : un atelier de caméra 3D pour Qwen-Image 2.1

ComfyUI Wikinews

AnyAngle Studio est un nœud ComfyUI qui transforme une photo, un GLB ou un mannequin en atelier 3D et exporte des guides de pose, de profondeur et Canny pour Qwen-Image 2.1.

AnyAngle Studio · T8 est un nœud personnalisé ComfyUI qui place une caméra 3D devant Qwen-Image 2.1. Déposez une photo, un GLB texturé ou le mannequin fourni avec le référentiel, déplacez la caméra, et le nœud exporte la nouvelle vue sous forme de guide de pose, de profondeur ou Canny pour le modèle d'édition. Il s'appuie sur le LoRA AnyAngle, qui reste optionnel.
L'atelier multi-personnes d'AnyAngle Studio dans ComfyUI

L'atelier à trois personnes en v1.5.7. Le mannequin fourni est utilisé ici, le LoRA AnyAngle n'est donc pas requis.

Trois façons d'obtenir une scène

Le nœud est enregistré sous qwen-image-21-multiangle-t8 et testé avec ComfyUI 0.36.0. Une scène peut provenir de trois sources :

  • Reconstruction à partir d'une photo. L'intégration TripoSplat fournie reconstruit le sujet à partir d'une seule image de référence, puis la caméra se déplace autour de cette reconstruction pendant que le sujet reste en place. Une option expérimentale conserve l'arrière-plan de la photo dans la reconstruction au lieu de segmenter d'abord le sujet.
  • GLB texturé. Une ressource 3D existante est chargée telle quelle, en partageant la scène du mannequin lorsqu'un accessoire en a besoin.
  • Mannequin fourni. Un mannequin MakeHuman est livré avec le référentiel, le posing manuel fonctionne donc sans installer un autre pack de nœuds.

En mode photo, la référence est envoyée à reference_image et à l'encodeur image_1, tandis que la vue exportée va à guide_image_2 et à l'encodeur image_2. Le nœud produit également prompt, scene_json et anyangle_lora_strength, afin qu'une scène enregistrée puisse être réexécutée sans rouvrir l'éditeur.

Des guides plutôt que des prompts

Au lieu de demander un angle au modèle en texte, l'atelier rend la scène depuis la nouvelle caméra et transmet ce rendu à Qwen-Image 2.1 comme condition :

GuideSource
Rendu 3D grossierReconstruction TripoSplat, un GLB ou le mannequin, rendu depuis la caméra actuelle
POSEPoints clés DWPose issus de la photo, un squelette compatible Fisher, ou le mannequin positionné
ProfondeurL'intégration Depth Anything 3 Small fournie, ou tout nœud de profondeur connecté
CannyContours de la photo, ou contours extraits de la caméra 3D via une passe d'argile à fort contraste

Passer Guide Strategy sur Qwen base écrit anyangle_lora_strength = 0, ce qui transmet le modèle de base sans charger le LoRA AnyAngle, tandis que l'option AnyAngle LoRA écrit 1.

Image de référenceGuide exportéImage Qwen finale
Référence originaleGuide exporté par le nœudRésultat du flux de travail d'exemple

Seed 42, 20 étapes, CFG 3, euler/simple. DWPose n'extrait que les articulations 2D, et le modèle de base traite une carte de structure comme une référence image plutôt qu'une entrée ControlNet : l'adhérence dépend donc du modèle.

Scènes multi-personnes et vues par lot

La version 1.5.7 ajoute un atelier pour plusieurs acteurs à la fois : les acteurs peuvent être ajoutés, copiés, réordonnés, cachés et verrouillés, chacun avec sa propre forme, pose, position, orientation et référence d'identité. Les photos de groupe sont détectées avec DWPose, dédupliquées et copiées sur l'acteur en cours, et une seule image de groupe peut alimenter deux acteurs tandis que le troisième conserve une référence distincte.

Batch views met en file d'attente une plage de caméra au lieu d'une seule prise de vue : 0° → 330° / 30° génère douze vues, 0° → 360° / 1° en génère 360. Les guides peuvent être exportés seuls sous forme d'un ZIP PNG accompagné d'un manifeste, ou mis en file d'attente directement dans le flux de travail, chaque PNG de sortie portant sa propre vue dans ses métadonnées. Les favoris de caméra restaurent l'azimut, l'élévation, le zoom, les décalages et les dimensions, et la focale peut être réglée entre 12 et 200 mm, ou épinglée à 24 / 50 / 85 mm.

L'auteur publie une matrice multi-personnes mesurée accompagnant le nœud : sur 32 tâches de la matrice principale, 7 correspondaient globalement au nombre de personnes, aux poses clés et à l'occlusion, 2 y correspondaient partiellement, et les cas à neuf personnes ajoutaient ou perdaient des personnes. Le verrouillage d'identité et le contrôle de pose au pixel près ne sont explicitement pas revendiqués.

Démarrage rapide

Installez le nœud via le Gestionnaire ComfyUI sous Comfyui-Qwen-Image-2.1-MultiAngle-T8, ou clonez-le :

cd ComfyUI/custom_nodes
git clone https://github.com/T8mars/Comfyui-Qwen-Image-2.1-MultiAngle-T8.git ComfyUI-AnyAngle-Studio-T8
cd ComfyUI-AnyAngle-Studio-T8
python -m pip install -r requirements.txt

Le nœud nécessite les nœuds Qwen Image 2.1, TripoSplat, BiRefNet et DINOv3 de ComfyUI, et le mannequin, les ressources frontend et les flux de travail d'exemple sont livrés avec le référentiel. Le flux de travail de base s'exécute en mode AnyAngle : LoRA 1 · CFG 3 · 20 étapes · euler / simple :

Un flux de travail avancé fonctionne avec LoRA 1 · CFG 1 · 40 étapes et nécessite l'installation de QwenImage21SpectrumT8, QwenImage21SageAttentionT8, QwenImage21BlockCacheT8, KJNodes, Easy Use et Comfyroll. Les modèles multi-personnes et à guide unique se trouvent dans le même dossier workflows/.

Disponibilité

AnyAngle Studio · T8 se trouve sur github.com/T8mars/Comfyui-Qwen-Image-2.1-MultiAngle-T8, et le LoRA AnyAngle qu'il pilote en option est lilylilith/QI_2.1_AnyAngle sur Hugging Face.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…
AnyAngle Studio : un atelier de caméra 3D pour Qwen-Image 2.1 | ComfyUI Wiki