LLaDA-Image Turbo: InclusionAI의 4스텝 생성 및 편집 가이드

ComfyUI Wiki

LLaDA-Image Turbo는 InclusionAI의 6B 통합 이미지 모델을 Twin-DMD로 2~4 스텝까지 증류한 모델로, ComfyUI에서 텍스트 기반 이미지 생성과 네이티브 명령 편집을 실행합니다.

L

LLaDA-Image Turbo

텍스트 기반 이미지 생성이미지 편집소수 스텝증류

InclusionAI의 6B 통합 이미지 모델을 Twin-DMD로 증류한 배리언트입니다. 네이티브 편집 경로를 유지하면서 생성과 편집을 모두 2~4 샘플링 스텝으로 압축했으며, ComfyUI용 BF16 및 INT8 transformer 가중치로 제공됩니다.

개발사InclusionAI (Ant Group)
출시일2026-09-04
아키텍처통합 diffusion 백본 + DiT
파라미터6B
라이선스Apache-2.0
추론2~4 스텝, CFG 1.0

주요 기능

  • 텍스트 기반 이미지 생성: 베이스 모델에서는 50 스텝, Turbo에서는 2~4 스텝
  • 명령 기반 편집: denoise 강도 기반 img2img 근사가 아니라 참조 보존을 지원하는 모델의 네이티브 편집 경로를 사용합니다. 편집 크기는 32로 나누어떨어져야 합니다
  • 이중 언어 텍스트 렌더링: 생성된 이미지에서 읽을 수 있는 중국어 및 영어 텍스트
  • VQ 조건화 생성: SigVQ 조건화 모듈

ComfyUI 사용법

커뮤니티 RebelAI 노드 팩은 네 개의 노드를 제공합니다: LLaDA Image Loader, LLaDA Image Text to Image, LLaDA Image Edit, LLaDA Image Unload.

최적화된 가중치를 해당 ComfyUI 폴더에 배치하세요:

파일저장 위치
LLaDA-Image-Turbo-transformer-BF16.safetensors 또는 LLaDA-Image-Turbo-INT8.safetensorsComfyUI/models/diffusion_models/
LLaDA-Image-Turbo-text_encoder-Q4_K_M.ggufComfyUI/models/text_encoders/
LLaDa_VAE.safetensorsComfyUI/models/vae/

INT8 transformer는 네이티브 safetensors 양자화이며, GGUF는 양자화된 LLaDA2-MoE 텍스트 인코더에만 사용됩니다. 4 스텝과 CFG 1.0으로 시작하세요.

관련 항목

Guides and workflows related to this model series.

No articles found.

댓글

GitHub로 로그인하고 토론에 참여하세요.

댓글을 불러오는 중…