Wan2.1: Alibaba Cloudによるテキストから動画および画像から動画生成

ComfyUI Wiki

Wan2.1はAlibaba Cloud初のオープンソースビデオ生成モデルです。14Bと1.3Bのサイズで利用可能で、Apache 2.0ライセンスの下でテキストから動画(T2V)および画像から動画(I2V)タスクをカバーしています。

W

Wan2.1

ビデオテキストから動画画像から動画オープンソース

初代Wanビデオモデル。Alibaba Cloudのオープンソースビデオ生成モデルで、2025年2月にリリースされました。Apache 2.0ライセンス。テキストから動画および画像から動画用に14Bと1.3Bのパラメータバリエーションで利用可能。ComfyUIネイティブサポート。GGUF (city96) および Kijai WanVideoWrapper バージョンも利用可能。

開発者Alibaba Cloud (Wan AI)
リリース日2025-02-28
アーキテクチャDiffusion Transformer (DiT)
ライセンスApache-2.0
モデルサイズ14B (フル) / 1.3B (軽量)
機能テキストから動画(14B/1.3B)、画像から動画(14B)
出力解像度480P (I2V)、720P (T2VおよびI2V)

Guides and workflows related to this model series.

No articles found.

コメント

GitHubでサインインしてディスカッションに参加しましょう。

コメントを読み込み中…