ComfyUI ニュース&オープンソース AI リリース

ComfyUI エコシステムの最新情報:オープンソースモデルのリリース、カスタムノード、ワークフロー、ツールのアップデート。

画像→動画

InfiniteTalk オープンソースリリース - 無制限長対応の音声駆動型ビデオ生成技術

画像→動画
ベースモデル
InfiniteTalk オープンソースリリース - 無制限長対応の音声駆動型ビデオ生成技術

MeiGen-AIチームがInfiniteTalkモデルをオープンソース化し、精密なリップシンクと無制限長ビデオ生成を実現。画像からビデオ、ビデオからビデオへの変換をサポートし、デジタルヒューマン技術に新たな突破口をもたらしました。

MIT

テキスト→画像
ベースモデル
ComfyUIでQwen-Imageがネイティブ対応

Qwen-Imageは200億パラメータのMMDiT画像生成モデルで、複雑な文字レンダリングと精密な編集を得意とします。ComfyUIでネイティブに利用可能になりました。本記事は主な機能、ライセンス、リソースを簡潔にまとめます。

Open-Weights

テキスト→画像
ツール
Tencent Hunyuanチーム、人間の嗜好アライメント訓練効率を向上させるMixGRPOフレームワークをオープンソース化

Tencent Hunyuanチームが、GRPOにスライディングウィンドウ混合ODE-SDEサンプリングを統合した初のフレームワークMixGRPOをオープンソース公開。拡散モデルとフローモデルの人間嗜好アライメントで最大71%の訓練高速化を実現。

Open-Weights

テキスト→画像

Black Forest Labs、FLUX.1 Krea [dev] オープンソース版リリース、ComfyUIネイティブサポート

テキスト→画像
ベースモデル
Black Forest Labs、FLUX.1 Krea [dev] オープンソース版リリース、ComfyUIネイティブサポート

Black Forest LabsとKreaの協力によりFLUX.1 Krea [dev]モデルが正式リリースされました。これはテキスト-画像生成に特化した最高のオープンソースFLUXモデルです。ComfyUIがネイティブサポートを実装し、ユーザーが最新のテキスト-画像生成技術を直接体験できるようになりました。

FLUX-1-dev-non-commercial

テキスト→動画

WAN2.2 オープンソース版リリースとComfyUIによるDay 0ネイティブサポート

テキスト→動画
ベースモデル
WAN2.2 オープンソース版リリースとComfyUIによるDay 0ネイティブサポート

WANチームがWan2.2のオープンソース版を正式リリース。革新的なMoEアーキテクチャを採用し、ビデオ生成の品質が大幅に向上。ComfyUIはネイティブサポートを実現し、ユーザーは最新のビデオ生成技術を直接体験可能。

Open-Weights

テキスト→画像
ベースモデル
XVerse公開: 複数の被写体のアイデンティティと意味的属性を制御できる高一貫性画像生成モデル

ByteDanceがXVerseモデルをオープンソース化。複数の被写体のアイデンティティと意味的属性(ポーズ、スタイル、照明など)を正確に独立制御することを可能にし、AI画像生成のパーソナライゼーションと複雑なシーン生成能力を向上

Open-Weights

テキスト→画像

Flux.1 Kontext Dev オープンソース版がリリース、ComfyUI がネイティブサポートを提供

テキスト→画像
ベースモデル
Flux.1 Kontext Dev オープンソース版がリリース、ComfyUI がネイティブサポートを提供

Black Forest Labs が 120 億パラメータの拡散トランスフォーマーモデル Flux.1 Kontext Dev オープンソース版をリリース、ComfyUI が即時にネイティブサポートを提供

Open-Weights