- ホーム
- Models
- Dreamx Creator
- DreamX-Creator 1.0: ComfyUI セットアップとモデルガイド
DreamX-Creator 1.0: ComfyUI セットアップとモデルガイド
ComfyUI のネイティブノードで DreamX-Creator を実行: 7B の音声・動画同時生成、1ステップの 2K リファイナー、約 54 GB のウェイトバンドル、そして生成ワークフロー。
DreamX-Creator 1.0
動画生成音声・動画同時生成2KComfyUIDreamX-Creator 1.0 は、動画と音声を 1 パスで同期生成する AMap のオープンな 7B ジェネレーターで、さらに結果を 2K に超解像する自己回帰 1 ステップリファイナーを備えています。公開されたジェネレーターとリファイナーは ComfyUI のネイティブ V3 ノードで利用できます。
| 開発元 | AMap ML (Alibaba) |
| リリース日 | 2026-09 |
| アーキテクチャ | 7B 音声・動画同時生成 + 5B SR-DiT リファイナー |
| ベース依存関係 | Wan2.2-TI2V-5B (動画 VAE、UMT5-xxl テキストエンコーダー) |
| 出力 | 同期した動画 + 音声、リファインメント後は最大 2K |
| ライセンス | Apache-2.0 |
最初のフレームとテキストプロンプトを与えると、DreamX-Creator はゲート付きクロスモーダルアテンションを通じて、モダリティごとに特化した動画ストリームと音声ストリームを同時にモデリングします。クロスアテンションの重みによって各モダリティが互いを参照でき、学習済みのゲートが受け渡される情報量を制御します。プログレッシブなジョイントトレーニングにより、口の動き、画面上のアクション、サウンドトラックは事後的に繋ぎ合わされるのではなく、同期した状態に保たれます。その後、自己回帰 1 ステップリファイナー(SR-DiT、5B)がコンテンツ、動き、音声に同期したタイミングを保ちながらクリップを 2K に超解像し、外部の動画をリファインすることもできます。
インストール
DreamX-Creator は DreamX Creator T8 のネイティブ V3 ノードを通じて ComfyUI で動作します。ノードパッケージは ComfyUI Manager からインストールするか("DreamX Creator T8" で検索)、ComfyUI/custom_nodes/ にクローンして、ComfyUI を起動するのと同じ Python で要件をインストールしてください。
ComfyUI でそのまま使えるウェイトバンドルを共有モデルディレクトリにダウンロードします:
hf download t8star/DreamX-Creator-Comfy --local-dir ComfyUI/models/dreamx_creatorローダーの model_root=auto はリポジトリの checkpoints/ と ComfyUI/models/dreamx_creator/ を検索します。バンドルは約 54 GB で、そのルート直下に creator/、audio_vae/、refiner/、wan2.2_ti2v_5b/ フォルダが含まれている必要があります。
ワークフロー
生成グラフは、完全なローダー、2 つのテキストエンコーダー、最初のフレームの音声・動画潜在、AV フローシフト(公開プリセットは 5.0 / 5.0)、マルチモーダルガイダー、そして通常スケジューリング・20 ステップ・euler の FlowMatch サンプラーを実行し、続いて AV 潜在の分割、動画と音声の VAE デコード、動画のエクスポートを行います。別個のリファイナーグラフは、音声と FPS を保ったまま 2× パスを実行します。要求された長さは、Wan 互換の 4N+1 フレーム数に切り捨てられます。
ノードパッケージには、フロントエンドからインポートできるサンプルが同梱されています(examples/dreamx_creator_ui.json は最初のフレームから同期した動画と音声を生成する用、examples/dreamx_refiner_ui.json は 2× リファインメントパス用)。
リソース
Guides and workflows related to this model series.
コメント
GitHubでサインインしてディスカッションに参加しましょう。