MiniMax H3 Turbo LoRA: ComfyUI용 4단계 FL2V 증류

ComfyUI Wikinews

Lightx2v와 ModelTC가 MiniMax H3를 4단계 FL2V Turbo LoRA로 증류해 샘플링 단계를 약 20단계에서 4단계로 줄였습니다. ComfyUI 변환 파일과 데모 Spaces도 함께 제공합니다.

Lightx2v 팀과 ModelTCMiniMax H3용 4단계 Turbo LoRA를 출시했습니다. 이 LoRA는 비디오 모델의 FL2V(첫 프레임-마지막 프레임 기반 비디오 생성) 생성을 약 20단계의 샘플링에서 4단계로 줄인 증류 모델입니다 (Hugging Face, GitHub). 약 1.3GB 크기의 이 LoRA는 초기 미리보기 버전으로, v0.1은 FL2V 품질에 중점을 두고 있으며 Ref2V 증류는 이미 로드맵에 포함되어 있습니다.

MiniMax H3 Turbo LoRA 예제 프레임

작성자의 4단계 예제 출력에서 가져온 프레임

릴리스 내용

  • 가중치: Hugging Face에 업로드된 minimax_h3_fl2v_turbo_4step_v0.1.safetensors, MiniMax-H3 베이스 모델에서 증류
  • 추론 코드: ModelTC 저장소는 배치 MiniMax-H3 추론 및 50 NFE 기준 베이스 모델 대비 NFE/LoRA 비교를 제공합니다
  • 데모 Spaces: akhaliq의 MiniMax-H3-Turbo-Lora Space공식 조직 Space에서 로컬 하드웨어 없이 LoRA를 체험할 수 있습니다
  • 로드맵: FL2V의 시각적 세부 정보와 전반적인 품질을 개선한 후 Ref2V 기반 증류 개발

릴리스 노트는 v0.1을 미리보기 버전으로 명시했습니다. 시각적 세부 정보는 아직 개선이 필요하며, 업데이트된 버전이 개발 중입니다.

ComfyUI 사용법

이 LoRA에는 ComfyUI 커스텀 노드가 필요하지 않습니다. Kijai는 출시 후 1시간 이내에 Kijai/MiniMax-H3_comfy에 ComfyUI 호환 변환 파일(minimax_h3_fl2v_lightx2v_turbo_4step_v0.1_comfy.safetensors 및 리사이즈된 bf16 변형)을 게시했습니다. 파일을 models/loras/에 넣고 베이스 H3 checkpoint를 로드한 다음, Kijai의 테스트 노트에 따라 er_sde 또는 sa_solver 샘플러를 사용해 4단계에서 0.75 강도로 LoRA를 적용하세요.

공식 MiniMax H3 텍스트 기반 비디오 생성 워크플로 템플릿이 좋은 시작점입니다. Turbo LoRA를 모델 로더와 샘플러 사이에 삽입하고 위의 4단계 설정으로 전환하세요.

참고: 작성자들은 Diffusers와 ComfyUI 추론 결과 간에 일부 차이가 있음을 확인했습니다(오디오는 Diffusers에서 더 자연스럽게 들렸습니다). ComfyUI 경로의 오디오 버그는 최신 테스트 버전(nightly) 업데이트에서 수정되었습니다. 논문 결과와 일치하는 재현을 위해서는 ModelTC 추론 스크립트를 따르세요.

작성자들이 릴리스 토론에서 공유한 예제 출력

제공 정보

댓글

GitHub로 로그인하고 토론에 참여하세요.

댓글을 불러오는 중…
MiniMax H3 Turbo LoRA: ComfyUI용 4단계 FL2V 증류 | ComfyUI Wiki