H3 Motion Context v0.2.0: 끊김 없는 MiniMax H3 클립 체이닝
H3 Motion Context v0.2.0은 MiniMax H3 클립을 연결하여 컷을 넘어서도 모션과 오디오가 계속 이어지도록 하고, 레퍼런스 모드 지원을 추가하며, 연결 지점의 보이는 이음새를 제거합니다.
H3 Motion Context가 8월 9일에 v0.2.0을 출시했습니다. 이 커스텀 노드 팩은 ComfyUI에서 MiniMax H3 클립을 연결하여 컷을 넘어서도 모션과 오디오가 진정으로 이어지도록 합니다. 클립 A를 생성하고 그 마지막 프레임과 오디오를 노드에 입력하면, 클립 B가 A가 멈춘 지점에서 이어집니다. 같은 모션, 같은 속도, 같은 방향으로 이어지며 오디오는 재합성되지 않고 계속 이어집니다.
v0.2.0의 새로운 기능
- 더 이상 보이는 이음새가 없습니다.
context_latent가 연결되면 고정된 프레임은 픽셀로 디코딩된 후 다시 인코딩되는 대신 이전 클립의 잠재 데이터에서 직접 잘라내집니다. 연결 지점에서 색상 변화나 대비 단차가 없으며, 디코딩, 크기 조정, VAE 패스를 건너뛰므로 더 빠릅니다. - 레퍼런스 모드가 체이닝과 함께 동작합니다. Ref2VA 그래프는 이제 자체 이미지, 비디오, 오디오 레퍼런스를 유지하면서 연속 오디오가 그 옆에 추가됩니다. 이전에는 노드가 레퍼런스 목록을 덮어써서 체이닝을 활성화하면 모든 레퍼런스가 조용히 제거되었습니다. 이 설계는 seitanism(Banodoco MiniMax H3 끊김 없는 확장 스레드)이 만들었으며, 최초 구현은 @ethanfel의 포크에서 이루어졌습니다. 이번 구현은 독립적으로 작성되었지만 둘 모두에게 크레딧을 표시합니다.
- 56프레임 컨텍스트 창이 기존 5, 22, 39에 더해 추가되었습니다.
- 설정이 6개에서 2개로 줄었습니다.
context_length와audio_context_length만 남고, 나머지는 명확한 기본값을 가진 상수입니다. - 고정된 오디오가 오디오 그리드에 정확히 정렬됩니다. 일부 창과 클립 길이 조합에서 스텝의 3분의 1만큼 어긋나던 정렬 문제를 수정했습니다.
- 패치는 가져올 때가 아니라 처음 사용할 때 설치되며, 이 팩 고유의 그래프에만 적용되므로 다른 H3 워크플로는 영향을 받지 않습니다.
context_latent사용 중에는 체인 중간에 해상도를 변경할 수 없습니다. 노드는 조용히 손실 경로로 대체하는 대신 변경을 거부하고 두 해상도를 모두 명시합니다.
작동 방식
MiniMax H3는 시간 좌표에 프레임을 고정하고 모든 샘플링 단계에서 이를 다시 주입할 수 있습니다. 체이닝의 유일한 걸림돌은 첫 번째 또는 마지막 프레임이 아닌 고정 프레임을 거부하는 ComfyUI의 검사였습니다. 이 팩은 런타임 패치로 해당 제한을 해제하며(디스크의 어떤 파일도 수정되지 않습니다). 패치는 매 시작 시 실행 중인 ComfyUI 코드에 대해 자신의 가정을 검증합니다. 조용히 잘못된 렌더링을 만드는 것보다 명확하게 거부하는 것이 낫기 때문입니다.
더 어려운 부분은 오디오입니다. H3는 영상과 사운드를 함께 생성하기 때문입니다. 노드는 이전 클립의 오디오 컨텍스트를 전달하여 다음 세그먼트가 비슷한 소리를 새로 만들어 내는 대신 동일한 오디오를 계속 이어가도록 합니다.
워크플로
v0.2.0 릴리스에는 fl2va와 ref2va 경로를 하나의 그래프에서 모두 실행하는 통합 워크플로가 포함되어 있습니다.
설치 및 주의사항
폴더를 ComfyUI/custom_nodes/에 넣고 ComfyUI를 다시 시작하면 설치됩니다. 0.2.0에서 위젯 값이 변경되었습니다. 0.1로 저장된 워크플로는 숫자를 잘못된 슬롯에 로드하므로 Motion Context 노드를 삭제하고 다시 추가하세요. 또한 한 번에 하나의 H3 체이닝 팩만 실행하세요. 여러 팩이 동일한 첫 번째/마지막 키프레임 제한을 해제하는데, 이 노드는 다른 팩이 이미 해당 제한을 점유한 경우 실행을 거부합니다.
댓글
GitHub로 로그인하고 토론에 참여하세요.