Pixal3D 멀티뷰가 ComfyUI 에 등장: 4 각도에서 더 나은 3D
ComfyUI Wikinews
ComfyUI 코어에 네이티브 Pixal3D 멀티뷰 지원이 추가되어 새로운 공식 bf16 및 INT8 가중치로 네 개의 궤도 샷 또는 MV-diffusion 출력을 더 깔끔한 메시로 변환합니다.
Pixal3D (GitHub, 프로젝트 페이지) 는 2026 년 9 월 1 일 멀티뷰 추론 코드를 공개했고, ComfyUI 코어는 9 월 8 일 PR #16048 에서 멀티뷰 가중치에 대한 네이티브 지원을 도입했습니다. 이제 한 장의 이미지 대신 동일한 객체의 최대 네 개의 궤도 샷을 입력할 수 있으며, 새로운
Pixal3DMultiViewConditioning 노드가 이를 단일이며 더 정확한 메시로 결합합니다. 새로운 공식 Comfy-Org/Pixal3D 가중치는 bf16 및 INT8 ConvRot 로 제공됩니다.
멀티뷰 지원 PR 의 예시: 동일한 객체의 여러 뷰가 한 번의 생성 패스를 conditioning 합니다.
왜 멀티뷰 입력이 중요한가요
단일 사진은 객체의 뒷면을 모델의 상상력에 맡기게 되며, 이것이 이미지-to-3D 결과가 가장 많이 무너지는 지점입니다: 환각적인 기하학, 흐릿한 텍스트, 실루엣 주위로 휘어진 텍스처 등. Pixal3D 의 멀티뷰 경로는 동일한 객체의 여러 뷰를 동시에 conditioning 하여 형태와 텍스처 캐스케이드를 처리하므로, 어떤 입력 이미지에도 나타나는 표면은 추측이 아닌 관찰을 통해 재구성됩니다.
그런 뷰의 일반적인 소스:
- 물리적 객체 주변에서 촬영한 몇 장의 사진
- 리스타일하고 싶은 기존 3D 애셋에서 렌더링된 프레임
- 멀티뷰 diffusion 모델의 출력으로, 이는 모델이 기대하는 정확히 궤도 형식입니다
ComfyUI 통합에서 추가된 기능
통합 PR 은 기존 TRELLIS.2/Pixal3D 노드 세트에 새 노드 하나와 새 공식 가중치 두 개를 추가합니다:
Pixal3DMultiViewConditioning: CLIP 비전 모델과 최대 네 개의 뷰 이미지 (앞, 왼쪽, 뒤, 오른쪽) 를 받습니다. 첫 번째 뷰가 객체의 앞면을 정의하며, 포즈가 일치하지 않으면 노드가 경고합니다. 단일fov파라미터 (기본값20.0) 는 모든 뷰의 카메라를 설명하며, 이는 멀티뷰 diffusion 모델이 생성하는 합성 궤도 리그와 일치합니다.- Comfy-Org/Pixal3D 의 새 가중치:
pixal3d_multiview_bf16.safetensors와pixal3d_multiview_int8_convrot.safetensors는 같은diffusion_models폴더에 있는 단일 이미지 checkpoint 옆에 위치합니다. 형태 VAE, 텍스처 VAE 및 DINOv3 CLIP 비전 인코더는 단일 이미지 pipeline 과 공유되므로, 기존 Pixal3D 설치에는 새 diffusion 모델 파일만 필요합니다.
공식 멀티뷰 테스트 워크플로: 네 개의 뷰 이미지가 공유된 형태 및 텍스처 단계 전에 Pixal3DMultiViewConditioning 로 입력됩니다 (소스: Comfy-Org/ComfyUI PR #16048).
ComfyUI 에서 사용 방법
- PR #16048 이 포함된 빌드로 ComfyUI 를 업데이트하세요 (2026 년 9 월 8 일 이후).
- Comfy-Org/Pixal3D 에서
pixal3d_multiview_bf16.safetensors(또는 낮은 VRAM 을 위한 INT8 ConvRot 버전) 를ComfyUI/models/diffusion_models/로 다운로드하세요. - 아래 워크플로를 로드하고 뷰를 연결하세요: 앞면 먼저, 그다음 왼쪽, 뒤, 오른쪽. 알파 채널이 없는 뷰는 자동으로 매팅되지만, 프레임이 카메라 정보를 인코딩하므로 각 뷰는 잘리지 않은 상태로 유지하세요.
객체의 뷰가 하나만 있다면 이전 보도 의 원본 단일 이미지 워크플로를 계속 사용하세요: 멀티뷰 가중치는 별도의 파일이며 대체재가 아닙니다.
PR 의 두 번째 예시: 궤도 뷰 및 결과 텍스처 메시.
사용 가능 여부
- 가중치: Comfy-Org/Pixal3D (ComfyUI 용으로 재포장됨, MIT 라이선스) 및 원본 TencentARC/Pixal3D 저장소. 여기서
ckpts/*_mvcheckpoint 가 ComfyUI 파일에 해당합니다. - 참고 구현: TencentARC/Pixal3D 저장소의
inference_mv.py, 2026 년 9 월 1 일 공개. 커스텀 뷰 리그용 Blender/NeRF 스타일transforms.json카메라 형식이 포함되어 있습니다. - 데모: TencentARC/Pixal3D Space 는 현재 단일 이미지 경로를 다룹니다.
댓글
GitHub로 로그인하고 토론에 참여하세요.