Pixal3D Многовидовой в ComfyUI: Улучшенный 3D из 4 ракурсов
Ядро ComfyUI добавляет нативную поддержку Pixal3D многовидовой с новыми официальными весами bf16 и INT8, превращая четыре снимка орбиты или вывод MV-diffusion в более чистую сетку.
Pixal3DMultiViewConditioning объединяет их в единую, более точную сетку. Новые официальные веса Comfy-Org/Pixal3D поставляются в форматах bf16 и INT8 ConvRot.
Пример из PR поддержки multi-view: несколько видов одного объекта задают один проход генерации.
Зачем нужен ввод multi-view
Одно фото оставляет заднюю часть объекта на усмотрение модели, именно здесь результаты image-to-3D чаще всего рушатся: галлюцинирующая геометрия, размытый текст или текстуры, искажающиеся вокруг силуэта. Путь multi-view от Pixal3D задает условия каскаду формы и текстуры для нескольких видов одного объекта одновременно, так что поверхности, появляющиеся в любом входном изображении, восстанавливаются на основе наблюдения, а не угадываются.
Типичные источники для этих видов:
- Несколько фотографий, сделанных вокруг физического объекта
- Кадры, рендеренные из существующего 3D-актива, который вы хотите перестилизовать
- Выход от многовидовой диффузионной модели, что точно соответствует формату орбиты, который ожидает модель
Что добавляет интеграция ComfyUI
PR интеграции расширяет существующий набор нод TRELLIS.2/Pixal3D одной новой нодой и двумя новыми официальными весами:
Pixal3DMultiViewConditioning: принимает модель зрения CLIP плюс до четырех изображений видов (спереди, слева, сзади, справа). Первый вид определяет переднюю часть объекта; нода предупреждает, если ваша ориентация не совпадает. Один параметрfov(значение по умолчанию20.0) описывает камеру для всех видов, что соответствует синтетическим rig'ам орбиты, которые производят многовидовые диффузионные модели.- Новые веса в Comfy-Org/Pixal3D:
pixal3d_multiview_bf16.safetensorsиpixal3d_multiview_int8_convrot.safetensorsнаходятся рядом с чекпойнтами одиночного изображения в той же папкеdiffusion_models. Shape VAE, texture VAE и энкодер зрения DINOv3 CLIP разделяются с пайплайном одиночного изображения, поэтому существующая установка Pixal3D требует только новый файл модели диффузии.
Официальный тестовый рабочий процесс multi-view: четыре изображения видов поступают в Pixal3DMultiViewConditioning перед общими этапами формы и текстуры (источник: Comfy-Org/ComfyUI PR #16048).
Как использовать это в ComfyUI
- Обновите ComfyUI до сборки, включающей PR #16048 (8 сентября 2026 года или позже).
- Скачайте
pixal3d_multiview_bf16.safetensors(или версию INT8 ConvRot для меньшего объема VRAM) из Comfy-Org/Pixal3D вComfyUI/models/diffusion_models/. - Загрузите рабочий процесс ниже и подключите ваши виды: сперва передний, затем левый, задний и правый. Виды без альфа-канала матируются автоматически, но сохраняйте каждый вид без обрезки, так как кадрирование кодирует камеру.
Если у вас только один вид объекта, продолжайте использовать оригинальный рабочий процесс одиночного изображения из нашего предыдущего обзора: веса multi-view — отдельный файл, а не замена.
Второй пример из PR: виды орбиты и результирующая текстурированная сетка.
Доступность
- Веса: Comfy-Org/Pixal3D (переупакованы для ComfyUI, лицензия MIT) и оригинальный репозиторий TencentARC/Pixal3D, чьи чекпойнты
ckpts/*_mvсоответствуют файлам ComfyUI. - Референсная реализация:
inference_mv.pyв репозитории TencentARC/Pixal3D, выпущена 1 сентября 2026 года с форматом камерыtransforms.jsonв стиле Blender/NeRF для пользовательских rig'ов видов. - Демо: пространство TencentARC/Pixal3D в настоящее время охватывает путь одиночного изображения.
Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.