MiniMax H3 변환 LoRA: 두 이미지 사이를 모핑하는 ComfyUI 가이드
한 이미지를 다른 이미지로 모핑하는 MiniMax H3 LoRA입니다. ComfyUI에서 첫 프레임과 마지막 프레임 전환을 통해 요소, 재질, 피사체가 서로 변환됩니다.
쇼케이스 클립 중 하나의 한 프레임으로, 첫 번째 이미지의 각 피사체에 두 번째 이미지의 대응 요소가 하나씩 지정됩니다.
무엇을 하는가
MiniMax H3의 첫 프레임과 마지막 프레임 경로는 보통 두 이미지를 하나의 연속된 샷의 양 끝으로 해석합니다. 카메라나 피사체가 움직이되 장면은 알아볼 수 있을 만큼 동일하게 유지됩니다. 이 어댑터는 대신 두 프레임을 시작 상태와 종료 상태로 만듭니다. 그 사이의 모든 것이 전환이며, 모델은 전체 이미지를 크로스페이드하는 대신 개별 시각 요소를 전환 너머로 옮기도록 훈련되었습니다.
대응 관계가 프롬프트에 명시되기 때문에 한 번의 작업으로 여러 변환을 동시에 수행할 수 있습니다. 아래 샘플에서는 회색 티셔츠를 입은 사람이 두 번째 이미지의 소녀로, 노란색 셔츠를 입은 사람이 노란색 풀밭으로, 초록색 셔츠를 입은 사람이 빈 배경으로 바뀌며, 이 모든 것이 하나의 클립 안에서 일어납니다.
프롬프트 형식
이 어댑터는 트리거 단어와 액션 커넥터를 사용하며, 각 피사체, 재질 또는 요소가 어떻게 대응 요소로 변환되는지 프롬프트에 명시할 때 가장 잘 작동합니다.
- 트리거 단어:
Tr@nsf0rmation_style - 액션 커넥터:
Tr@nsf0rmation into
권장 템플릿은 다음과 같습니다.
integrated_multimodal_description: [Shot 1] Tr@nsf0rmation_style, Picture 1 Tr@nsf0rmation into Picture 2 with individual elements and subjects Tr@nsf0rmation into one another.모델 카드에서 가져온 보다 구체적인 예시입니다.
integrated_multimodal_description: [Shot 1] Tr@nsf0rmation_style, Picture 1 Tr@nsf0rmation into Picture 2 with individual elements and subjects Tr@nsf0rmation into one another. The bald person in grey T-shirt and blue jeans from <Picture 1> Tr@nsf0rmation into the Girl in <Picture 2>. The person in the Yellow shirt from <Picture 1> Tr@nsf0rmation into the yellow grass from <Picture 2>. The person in the green shirt from <Picture 1> Tr@nsf0rmation into the blank background in <Picture 2>.샘플
다중 요소 장면 재조립: 첫 번째 이미지의 각 인물이 두 번째 이미지의 서로 다른 요소로 변형됩니다.
두 장면 사이의 단순한 시각 변환.
개별 연필 획이 서로 변환되는, 보다 구체적인 프롬프트 변형을 사용한 연필 획의 진화.
유연한 전환, 의미 기반 모핑, 복잡한 피사체 교체, 고충실도 흐름을 다루는 일곱 개의 추가 클립이 모델 카드에 있습니다.
권장 설정
| 설정 | 값 |
|---|---|
| 베이스 가중치 | MiniMax H3 FL2VA 또는 Ref2V, 예: Comfy-Org/MiniMax-H3의 minimax_h3_fl2va_pruned_int8_convrot.safetensors |
| 체크포인트 | Transformation_style_c1-st2500은 완전히 수렴된 버전이고, -st1600은 더 부드럽고 가볍습니다 |
| LoRA 강도(st2500) | 1.0 ~ 1.2 |
| LoRA 강도(st1600) | 1.0 ~ 1.4 |
| 스택 구성 | st2500을 1.2로, st1600을 1.4로 적용하며, 쇼케이스 클립에 사용되었습니다 |
| 샘플러 / 스케줄러 | res_multistep 또는 simple과 함께 euler; ResMultistep이 가장 안정적인 전환을 제공합니다 |
| 스텝 | DMD turbo 어댑터 사용 시 12, 표준은 25 ~ 30 |
| 시그마 시프트 | shift_video 8.0, shift_audio 3.0 |
| 해상도 | 852 × 480 또는 1024 × 576, 1080p까지 업스케일 가능 |
ComfyUI에서 실행하기
파일은 ComfyUI 명명 규칙(Transformation_style_*_comfyui.safetensors)으로 배포되므로 커스텀 노드가 필요하지 않습니다.
- 원하는 체크포인트를
ComfyUI/models/loras/에 다운로드합니다. - MiniMax H3 UNet 로더 뒤에 LoraLoaderModelOnly 노드를 추가하고
strength_model을 1.0에서 1.2 사이로 설정합니다. - 시작 이미지와 대상 이미지를 첫 프레임 및 마지막 프레임 조건화 노드에 입력합니다.
- 위에 표시된 대로
Tr@nsf0rmation_style트리거와Tr@nsf0rmation into커넥터를 사용해 프롬프트를 작성합니다.
사용 가능 여부
- LoRA 가중치: Ashmotv/transformation_lora
- 베이스 모델 재패키징: Comfy-Org/MiniMax-H3
댓글
GitHub로 로그인하고 토론에 참여하세요.