Endless MiniMax H3 v1.0: 無制限長のリップシンク対応 H3 ビデオ
新しいワークフローは、H3 Motion Context と潜在保存ノードを組み合わせ、12GB GPU でリップシンク付きの無制限長 MiniMax H3 クリップをチェーンします。
Endless MiniMax H3 は、潜在保存/読み込みループを通じて H3 Motion Context クリップをチェーンし、ロスレスで結合します。
潜在チェーンによる無制限長
Reddit のユーザー NikoDemon80 が Endless MiniMax H3 (with Endless LipSync) v1.0 をリリースしました。これは、H3 Motion Context 生成をチェーンすることで、無制限の再生時間の MiniMax H3 ビデオを生成するワークフローです。作者によると、RTX 3060 12GB でリップシンク付きの 1 分 30 秒のビデオが、再試行を含めて約 2 時間で生成されました。
不足していたのはロスレスな結合でした。既存のセットアップは単一のビデオで止まり、ビデオエディタでレンダリング済みのクリップを連結すると、デコードと再エンコードによる損失が発生します。新しいワークフローは、すべての生成から潜在を保存し、ステッチャーノードが最後にすべて(または選択済み)のクリップを組み立てます:noembryo の H3 Motion Context Clip Stitcher は、メモリピークを避けるためにクリップを一度に一つデコードし、隣接するクリップ間のオーバーラップを動画と同期された音声で溶解させ、目に見える継ぎ目なしですべてを単一のストリームに連結します。
確定前のクリップごとの制御
各セグメントはステッチを選択するまで個別の潜在として残るため、ワークフローは再試行駆動のループをサポートしています:気に入らないクリップがあれば再生成し、確認してから次に進みます。唯一の制約は時間的なものです:クリップを置き換え済みの後、後のクリップは置き換え済みのものと融合されるため、以前の生成をやり直せますが、その後のクリップも再生成する必要があります。
このワークフローは FL2AV および Ref2AV モードの両方で動作し、チェーンが必要ない場合はスタンダードな単一 H3 ビデオも生成します。ダウンロードには必要なものがすべて含まれており、テストに使用した量子化された H3 チェックポイントも含まれています。
コメント
GitHubでサインインしてディスカッションに参加しましょう。