MiniMax H3 FL2V Turbo 4-Step v1.2 LoRA: 더 깨끗한 오디오 생성 (ComfyUI)

ComfyUI Wikinews

minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensors 다운로드: 더 깨끗하고 안정적인 오디오 생성을 제공하는 Lightx2v 의 4-단계 MiniMax H3 Turbo 업데이트.

LightX2V 팀이 Minimax-h3-Turbo 디스틸레이션 라인에서 최신인 FL2V Turbo 4-step v1.2 768p를 출시했습니다. v1.2 는 v1.1 과 동일한 빠른 4-단계 생성 설정을 유지하며, 오직 한 가지 약점인 오디오 품질에 집중합니다. 릴리스 비교는 동일한 설정에서 더 깨끗하고 안정적이며 아티팩트가 적은 생성된 오디오를 보여줍니다 (릴리스 토론).

MiniMax H3 FL2V Turbo v1.2 example frame

v1.2 에서 변경된 사항

v1.2 는 새로운 아키텍처가 아닌 FL2V(첫/마지막 프레임) 4-단계 768p LoRA 의 오디오 품질 새로 고침입니다:

  • 더 깨끗하고 안정적인 오디오, 아티팩트 감소
  • v1.1 과 동일한 4-단계 (NFE 4) 생성 설정
  • DiffusersComfyUI bf16 가중치가 나란히 게시됨
파일형식
minimax_h3_fl2v_turbo_4step_v1.2_768p_bf16.safetensorsDiffusers
minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensorsComfyUI, 변환 불필요

v1.1 대 v1.2 비교 (오디오 활성화)

팀은 동일한 입력, 프롬프트, 시드, 추론 설정을 사용한 백투백 비교를 공유했습니다:

v1.1v1.2

권장 설정

설정
스텝4
비디오 시프트6
오디오 시프트3
샘플러Euler
해상도최대 768p

비디오 및 오디오 시프트는 확산 모델 로더 이후연결된 ModelSamplingMiniMaxH3 노드를 통해 설정됩니다. 참고로 Hugging Face 토론 스레드의 일부 초기 테스터들은 v1.1 에 비해 시각적 품질이 떨어졌다고 느꼈으므로, 파이프라인에서 오디오보다 비디오 품질이 중요하다면 v1.1 을 유지하는 것이 합리적인 선택일 수 있습니다.

ComfyUI 사용법

MiniMax H3 은 네이티브 ComfyUI 지원을 제공하므로 LoRA 에 대한 커스텀 노드필수가 아닙니다:

  1. minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensorsComfyUI/models/loras/다운로드합니다.
  2. 기본 MiniMax H3 checkpoint를 로드하고 모델 로더와 sampler 사이에 LoRA 를 적용합니다.
  3. ModelSamplingMiniMaxH3 를 통해 4 개의 샘플링 스텝, Euler 샘플러, 비디오 시프트 6 및 오디오 시프트 3 를 설정한 후 최대 768p 에서 생성합니다.

프로젝트의 자체 예제 그래프인 ModelTC/Minimax-H3-Turbo 도 최신 상태이며, T2VA/I2VA 그래프가 FL2V 경로와 가장 유사합니다.

사용 가능 여부

댓글

GitHub로 로그인하고 토론에 참여하세요.

댓글을 불러오는 중…
MiniMax H3 FL2V Turbo 4-Step v1.2 LoRA: 더 깨끗한 오디오 생성 (ComfyUI) | ComfyUI Wiki