LTX 2.3 이미지: 이미지 전용 LTX 체크포인트용 ComfyUI 경로 지원
새로운 ComfyUI PR 에서 이미지 전용 LTXV 2.3 모델 경로가 추가되었으며, 13B 개발 전용 및 디스티ルド 체크포인트, CFG 없는 8 스텝 디스티ルド 샘플링, int8 convrot 빌드가 포함됩니다.
LTX 2.3 은 지금까지 비디오 및 오디오 모델이었지만, 동일한 백본이 강력한 정지 이미지 생성기로 작동한다는 것이 밝혀졌습니다. elismasilva 의 새로운 ComfyUI 에 대한 PR 은 LTXV 2.3 체크포인트를 위한 전용 이미지 전용 모델 경로 (ltxv_image) 를 추가하고, 동반 Hugging Face 저장소 는 텍스트 기반 이미지 생성을 위해 가지치기된 네 개의 통합 safetensors 체크포인트를 제공합니다.
LTX 2.3: 이미지 전용 체크포인트가 가지치기된 오디오 - 비디오 파운데이션 모델
PR 이 추가한 기능
PR 은 이미지 전용 LTXV 2.3 체크포인트를 새 LTXVImage / LTXVImageModel 쌍을 통해 라우팅하며, 체크포인트 메타데이터에서 모델을 image_model="ltxv_image" 로 표시할 때만 선택됩니다. 기존 LTX 비디오 경로는 수정되지 않았으며 현재 LTXVModel 을 계속 인스턴스화합니다. 로더 외에도 PR 은 다음을 제공합니다:
- 선택적 게이트드 어텐션 (기본값 꺼짐) 을 LTXV 트랜스포머 블록에 적용합니다.
- LTXV 자기 어텐션을 위한 블록별 STG 교란 라우팅.
LTXVGuidanceRescale, Diffusers 스타일 가이드 크기 조절을 구현하는 새 노드.- 두 개의 블루프린트:
이미지 생성 및 편집/텍스트에서 이미지로아래에 등록된Text to Image (LTX-2.3 Image Dev)및Text to Image (LTX-2.3 Image Distilled).
PR 은 2026 년 8 월 28 일 기준 열려 있으며 아직 병합되지 않았습니다. ltxv_image 경로가 업스트림에 도착하기 전까지, 체크포인트는 작성자의 ComfyUI 브랜치 에서 테스트할 수 있습니다.
체크포인트
elismasilva/ltx2.3-image-comfyui 의 네 파일은 Lightricks 의 LTX 2.3 계열에서 유래했으며, 비디오 및 오디오 실행 경로를 제거하기 위해 가지치기되었습니다. 새로운 학습은 관여하지 않습니다: 가중치는 통합 ComfyUI 체크포인트로 변환되어 models/checkpoints/ 에 배치됩니다.
| 파일 | 버전 |
|---|---|
ltx-2.3-13b-image-dev.safetensors | 개발 전용, bf16 |
ltx-2.3-13b-image-distilled.safetensors | 디스티ルド, bf16 |
ltx-2.3-13b-image-dev-convrot-int8.safetensors | 개발 전용, convrot int8 양자화 |
ltx-2.3-13b-image-distilled-convrot-int8.safetensors | 디스티ルド, convrot int8 양자화 |
13b 이름은 원본 더 큰 LTX 2.3 패키지에서 가지치기 후 유효 크기를 의미합니다. int8 convrot 빌드는 일부 충실도를 낮추어 VRAM 사용을 줄입니다.
권장 설정
모델 카드는 각 변형체에 대한 시작점을 제공합니다:
| 개발 전용 | 디스티ルド | |
|---|---|---|
| 스텝 | 20 ~ 40 | 8 |
| CFG | 3.0 ~ 5.0 | 1.0 (CFG 없음) |
| PAG 크기 조절 | ~0.8 (선택 사항) | ~0.8 (선택 사항) |
| 가이드 크기 조절 | ~0.7 (선택 사항) | ~0.7 (선택 사항) |
PR 의 두 블루프린트는 프롬프트, 해상도, 스텝, 가이드 및 PAG/가이드 크기 조절 컨트롤을 노출하므로 위의 설정은 제공된 워크플로에 직접 매핑됩니다.
ltxv_image 모델 경로 또는 작성자의 ltxv-image-only 브랜치 가 필요합니다. PR 이 병합될 때까지 현재 업스트림 ComfyUI 에서 로드되지 않습니다.
비디오 모델에 이미지 경로가 필요한 이유
Lightricks 의 LTX-2.3 는 결합된 오디오 - 비디오 파운데이션 모델이며, 이미지 전용 가지치기는 다른 비디오 계열이 취한 방향과 동일합니다: 시간 및 오디오 가중치를 제거하고 공간 사전 유지, 베이스 모델의 프롬프트 준수성을 계승하는 빠른 텍스트 기반 이미지 체크포인트를 얻습니다. 이미 비디오용 LTX 2.3 을 실행 중인 ComfyUI 사용자에게 이미지 체크포인트는 동일한 텍스트 인코더 및 로딩 규칙을 재사용하므로 텍스트 기반 이미지를 시도하는 것은 체크포인트 다운로드 외에는 거의 추가 비용이 들지 않습니다. PR 이 병합되면 LTX 2.3 은 추가 노드 팩 없이 코어 ComfyUI 내부에서 정지 이미지와 비디오 모두를 커버하게 됩니다.
댓글
GitHub로 로그인하고 토론에 참여하세요.