ComfyUI-DLSS5-NR : le rendu neuronal DLSS 5 fonctionne dans ComfyUI
Un nœud ComfyUI expérimental exécute le rendu neuronal NVIDIA DLSS 5 en processus via un pont D3D12, améliorant les images et les frames vidéo sans quitter votre flux de travail.
Paires d'échantillons issues des tests de l'auteur : première image de chaque paire avec le rendu neuronal DLSS 5, seconde sans.
Ce que fait le nœud
ComfyUI-DLSS5-NR de lisitskyaa intègre le rendu neuronal NVIDIA DLSS 5 (fonctionnalité NGX 18) dans ComfyUI sous la forme d'un nœud image-à-image. Plutôt que de lancer un outil externe ou de faire des allers-retours de fichiers par le disque, le nœud appelle le runtime de rendu neuronal DLSS en processus via un petit pont natif D3D12 : le tenseur ComfyUI est transféré sur le CPU en float32, téléversé sous forme de texture D3D12 RGBA16F, traité par nvngx_dlssnr.dll, puis renvoyé au pipeline torch en tant qu'IMAGE ComfyUI.
Le nœud prend en charge aussi bien les images uniques que les séquences temporelles, de sorte que les frames vidéo peuvent être améliorées avec une stabilité temporelle plutôt que frame par frame. La gestion des canaux de sortie est automatique, avec des remplacements manuels RGBA/BGRA, et un panneau de diagnostic du runtime indique le GPU détecté ainsi que le SHA-256 de la DLL du runtime que vous avez fournie.
Modèle d'installation : apportez votre propre DLL
Le projet fait délibérément le choix de ne pas redistribuer le runtime propriétaire de NVIDIA. Les utilisateurs téléchargent un ZIP de version précompilée depuis la page GitHub Releases (la v0.2.0 ne nécessite aucune installation de Visual Studio), le déposent dans custom_nodes/ et fournissent leur propre nvngx_dlssnr.dll obtenue légalement. Le pont localise ensuite _nvngx.dll automatiquement, soit à partir d'une substitution locale, soit via la recherche Windows normale de DLL, soit par découverte dans les paquets actifs du NVIDIA DriverStore. Un garde-fou CI dans le référentiel empêche l'empaquetage du projet d'inclure accidentellement le runtime propriétaire.
Un résultat 0xBAD00001 signifie que le runtime a rejeté la combinaison actuelle de GPU, de pilote ou de runtime, car les builds de préversion standard ne prennent en charge que certaines générations de GPU.
Contexte
L'amélioration d'images par rendu neuronal a récemment émergé dans la communauté de plusieurs côtés, notamment des outils DLSS 5 autonomes évoqués sur r/StableDiffusion plus tôt cette semaine. Ce qui rend ce nœud remarquable, c'est l'approche d'intégration : l'invocation NGX en processus dans ComfyUI n'avait jamais été réalisée publiquement auparavant, et l'auteur a publié le code source complet du pont natif (sous licence MIT) avec des scripts de compilation pour quiconque souhaite compiler le pont lui-même. C'est pour l'instant une voie expérimentale, réservée à Windows et aux GPU RTX, mais elle pointe vers un avenir où le rendu neuronal au niveau du pilote deviendra un autre nœud standard dans les flux de travail d'upscaling et de restauration.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.