AnyAngle Studio : un atelier de caméra 3D pour Qwen-Image 2.1
AnyAngle Studio est un nœud ComfyUI qui transforme une photo, un GLB ou un mannequin en atelier 3D et exporte des guides de pose, de profondeur et Canny pour Qwen-Image 2.1.
L'atelier à trois personnes en v1.5.7. Le mannequin fourni est utilisé ici, le LoRA AnyAngle n'est donc pas requis.
Trois façons d'obtenir une scène
Le nœud est enregistré sous qwen-image-21-multiangle-t8 et testé avec ComfyUI 0.36.0. Une scène peut provenir de trois sources :
- Reconstruction à partir d'une photo. L'intégration TripoSplat fournie reconstruit le sujet à partir d'une seule image de référence, puis la caméra se déplace autour de cette reconstruction pendant que le sujet reste en place. Une option expérimentale conserve l'arrière-plan de la photo dans la reconstruction au lieu de segmenter d'abord le sujet.
- GLB texturé. Une ressource 3D existante est chargée telle quelle, en partageant la scène du mannequin lorsqu'un accessoire en a besoin.
- Mannequin fourni. Un mannequin MakeHuman est livré avec le référentiel, le posing manuel fonctionne donc sans installer un autre pack de nœuds.
En mode photo, la référence est envoyée à reference_image et à l'encodeur image_1, tandis que la vue exportée va à guide_image_2 et à l'encodeur image_2. Le nœud produit également prompt, scene_json et anyangle_lora_strength, afin qu'une scène enregistrée puisse être réexécutée sans rouvrir l'éditeur.
Des guides plutôt que des prompts
Au lieu de demander un angle au modèle en texte, l'atelier rend la scène depuis la nouvelle caméra et transmet ce rendu à Qwen-Image 2.1 comme condition :
| Guide | Source |
|---|---|
| Rendu 3D grossier | Reconstruction TripoSplat, un GLB ou le mannequin, rendu depuis la caméra actuelle |
| POSE | Points clés DWPose issus de la photo, un squelette compatible Fisher, ou le mannequin positionné |
| Profondeur | L'intégration Depth Anything 3 Small fournie, ou tout nœud de profondeur connecté |
| Canny | Contours de la photo, ou contours extraits de la caméra 3D via une passe d'argile à fort contraste |
Passer Guide Strategy sur Qwen base écrit anyangle_lora_strength = 0, ce qui transmet le modèle de base sans charger le LoRA AnyAngle, tandis que l'option AnyAngle LoRA écrit 1.
![]() | ![]() | ![]() |
|---|---|---|
| Référence originale | Guide exporté par le nœud | Résultat du flux de travail d'exemple |
Seed 42, 20 étapes, CFG 3, euler/simple. DWPose n'extrait que les articulations 2D, et le modèle de base traite une carte de structure comme une référence image plutôt qu'une entrée ControlNet : l'adhérence dépend donc du modèle.
Scènes multi-personnes et vues par lot
La version 1.5.7 ajoute un atelier pour plusieurs acteurs à la fois : les acteurs peuvent être ajoutés, copiés, réordonnés, cachés et verrouillés, chacun avec sa propre forme, pose, position, orientation et référence d'identité. Les photos de groupe sont détectées avec DWPose, dédupliquées et copiées sur l'acteur en cours, et une seule image de groupe peut alimenter deux acteurs tandis que le troisième conserve une référence distincte.
Batch views met en file d'attente une plage de caméra au lieu d'une seule prise de vue : 0° → 330° / 30° génère douze vues, 0° → 360° / 1° en génère 360. Les guides peuvent être exportés seuls sous forme d'un ZIP PNG accompagné d'un manifeste, ou mis en file d'attente directement dans le flux de travail, chaque PNG de sortie portant sa propre vue dans ses métadonnées. Les favoris de caméra restaurent l'azimut, l'élévation, le zoom, les décalages et les dimensions, et la focale peut être réglée entre 12 et 200 mm, ou épinglée à 24 / 50 / 85 mm.
L'auteur publie une matrice multi-personnes mesurée accompagnant le nœud : sur 32 tâches de la matrice principale, 7 correspondaient globalement au nombre de personnes, aux poses clés et à l'occlusion, 2 y correspondaient partiellement, et les cas à neuf personnes ajoutaient ou perdaient des personnes. Le verrouillage d'identité et le contrôle de pose au pixel près ne sont explicitement pas revendiqués.
Démarrage rapide
Installez le nœud via le Gestionnaire ComfyUI sous Comfyui-Qwen-Image-2.1-MultiAngle-T8, ou clonez-le :
cd ComfyUI/custom_nodes
git clone https://github.com/T8mars/Comfyui-Qwen-Image-2.1-MultiAngle-T8.git ComfyUI-AnyAngle-Studio-T8
cd ComfyUI-AnyAngle-Studio-T8
python -m pip install -r requirements.txtLe nœud nécessite les nœuds Qwen Image 2.1, TripoSplat, BiRefNet et DINOv3 de ComfyUI, et le mannequin, les ressources frontend et les flux de travail d'exemple sont livrés avec le référentiel. Le flux de travail de base s'exécute en mode AnyAngle : LoRA 1 · CFG 3 · 20 étapes · euler / simple :
Un flux de travail avancé fonctionne avec LoRA 1 · CFG 1 · 40 étapes et nécessite l'installation de QwenImage21SpectrumT8, QwenImage21SageAttentionT8, QwenImage21BlockCacheT8, KJNodes, Easy Use et Comfyroll. Les modèles multi-personnes et à guide unique se trouvent dans le même dossier workflows/.
Disponibilité
AnyAngle Studio · T8 se trouve sur github.com/T8mars/Comfyui-Qwen-Image-2.1-MultiAngle-T8, et le LoRA AnyAngle qu'il pilote en option est lilylilith/QI_2.1_AnyAngle sur Hugging Face.



Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.