MiniMax H3 변환 LoRA: 두 이미지 사이를 모핑하는 ComfyUI 가이드

ComfyUI Wikinews

한 이미지를 다른 이미지로 모핑하는 MiniMax H3 LoRA입니다. ComfyUI에서 첫 프레임과 마지막 프레임 전환을 통해 요소, 재질, 피사체가 서로 변환됩니다.

Tr@nsf0rmation_style(Hugging Face)은 한 이미지를 다른 이미지로 모핑하는 MiniMax H3용 커뮤니티 LoRA입니다. 시작 프레임과 대상 프레임이 주어지면 첫 번째 장면을 요소 하나하나씩 분해한 뒤 그 조각들을 두 번째 장면으로 재조립합니다. 그래서 피사체가 서로 녹아들고, 재질이 이동하면서 변화하며, 윤곽선이 그 과정에서 스스로 다시 그려집니다. Ashmotv는 9월 25일 두 개의 체크포인트, 열 개의 샘플 클립, 그리고 이 어댑터가 기대하는 프롬프트 형식과 함께 가중치를 공개했습니다.
MiniMax H3 변환 LoRA로 생성된 다중 요소 장면 변환의 한 프레임

쇼케이스 클립 중 하나의 한 프레임으로, 첫 번째 이미지의 각 피사체에 두 번째 이미지의 대응 요소가 하나씩 지정됩니다.

무엇을 하는가

MiniMax H3의 첫 프레임과 마지막 프레임 경로는 보통 두 이미지를 하나의 연속된 샷의 양 끝으로 해석합니다. 카메라나 피사체가 움직이되 장면은 알아볼 수 있을 만큼 동일하게 유지됩니다. 이 어댑터는 대신 두 프레임을 시작 상태와 종료 상태로 만듭니다. 그 사이의 모든 것이 전환이며, 모델은 전체 이미지를 크로스페이드하는 대신 개별 시각 요소를 전환 너머로 옮기도록 훈련되었습니다.

대응 관계가 프롬프트에 명시되기 때문에 한 번의 작업으로 여러 변환을 동시에 수행할 수 있습니다. 아래 샘플에서는 회색 티셔츠를 입은 사람이 두 번째 이미지의 소녀로, 노란색 셔츠를 입은 사람이 노란색 풀밭으로, 초록색 셔츠를 입은 사람이 빈 배경으로 바뀌며, 이 모든 것이 하나의 클립 안에서 일어납니다.

프롬프트 형식

이 어댑터는 트리거 단어와 액션 커넥터를 사용하며, 각 피사체, 재질 또는 요소가 어떻게 대응 요소로 변환되는지 프롬프트에 명시할 때 가장 잘 작동합니다.

  • 트리거 단어: Tr@nsf0rmation_style
  • 액션 커넥터: Tr@nsf0rmation into

권장 템플릿은 다음과 같습니다.

integrated_multimodal_description: [Shot 1] Tr@nsf0rmation_style, Picture 1 Tr@nsf0rmation into Picture 2 with individual elements and subjects Tr@nsf0rmation into one another.

모델 카드에서 가져온 보다 구체적인 예시입니다.

integrated_multimodal_description: [Shot 1] Tr@nsf0rmation_style, Picture 1 Tr@nsf0rmation into Picture 2 with individual elements and subjects Tr@nsf0rmation into one another. The bald person in grey T-shirt and blue jeans from <Picture 1> Tr@nsf0rmation into the Girl in <Picture 2>. The person in the Yellow shirt from <Picture 1> Tr@nsf0rmation into the yellow grass from <Picture 2>. The person in the green shirt from <Picture 1> Tr@nsf0rmation into the blank background in <Picture 2>.

샘플

다중 요소 장면 재조립: 첫 번째 이미지의 각 인물이 두 번째 이미지의 서로 다른 요소로 변형됩니다.

두 장면 사이의 단순한 시각 변환.

개별 연필 획이 서로 변환되는, 보다 구체적인 프롬프트 변형을 사용한 연필 획의 진화.

유연한 전환, 의미 기반 모핑, 복잡한 피사체 교체, 고충실도 흐름을 다루는 일곱 개의 추가 클립이 모델 카드에 있습니다.

권장 설정

설정값
베이스 가중치MiniMax H3 FL2VA 또는 Ref2V, 예: Comfy-Org/MiniMax-H3의 minimax_h3_fl2va_pruned_int8_convrot.safetensors
체크포인트Transformation_style_c1-st2500은 완전히 수렴된 버전이고, -st1600은 더 부드럽고 가볍습니다
LoRA 강도(st2500)1.0 ~ 1.2
LoRA 강도(st1600)1.0 ~ 1.4
스택 구성st2500을 1.2로, st1600을 1.4로 적용하며, 쇼케이스 클립에 사용되었습니다
샘플러 / 스케줄러res_multistep 또는 simple과 함께 euler; ResMultistep이 가장 안정적인 전환을 제공합니다
스텝DMD turbo 어댑터 사용 시 12, 표준은 25 ~ 30
시그마 시프트shift_video 8.0, shift_audio 3.0
해상도852 × 480 또는 1024 × 576, 1080p까지 업스케일 가능

ComfyUI에서 실행하기

파일은 ComfyUI 명명 규칙(Transformation_style_*_comfyui.safetensors)으로 배포되므로 커스텀 노드가 필요하지 않습니다.

  1. 원하는 체크포인트를 ComfyUI/models/loras/에 다운로드합니다.
  2. MiniMax H3 UNet 로더 뒤에 LoraLoaderModelOnly 노드를 추가하고 strength_model을 1.0에서 1.2 사이로 설정합니다.
  3. 시작 이미지와 대상 이미지를 첫 프레임 및 마지막 프레임 조건화 노드에 입력합니다.
  4. 위에 표시된 대로 Tr@nsf0rmation_style 트리거와 Tr@nsf0rmation into 커넥터를 사용해 프롬프트를 작성합니다.

사용 가능 여부

Transformation_style_c1-st2500_comfyui.safetensors 다운로드 (36 MB)

댓글

GitHub로 로그인하고 토론에 참여하세요.

댓글을 불러오는 중…
MiniMax H3 변환 LoRA: 두 이미지 사이를 모핑하는 ComfyUI 가이드 | ComfyUI Wiki