テキスト→画像Krea 2 Turbo向けの定番OpenPose ControlNet LoRA:DWPoseスケルトンマップを入力すると、モデルはポーズに追従し、プロンプトが外観を定義します。
Apache-2.0
ComfyUI エコシステムの最新情報:オープンソースモデルのリリース、カスタムノード、ワークフロー、ツールのアップデート。
テキスト→画像Krea 2 Turbo向けの定番OpenPose ControlNet LoRA:DWPoseスケルトンマップを入力すると、モデルはポーズに追従し、プロンプトが外観を定義します。
Apache-2.0
動画編集JD Open Source が JoyAI-Video-Edit を公開。ライブビデオストリームを 30 FPS・720p でリアルタイム編集する 16B 自己回帰拡散モデルです。
Apache-2.0
テキスト→動画taeh3.safetensors(MiniMax H3 TAE)をダウンロードして、ComfyUI でビデオを高速プレビュー。ComfyUI-KJNodes の ModelPreviewOverride ノードで使う小型 2D オートエンコーダー。
テキスト→動画xmarre 氏の ComfyUI-Spectrum-MiniMax-H3 ノードを導入: スペクトル特徴予測で transformer 評価をスキップし、ComfyUI での MiniMax H3 生成を約30%高速化します。
テキスト→動画ComfyUI向けMiniMax H3コミュニティ量子化をダウンロード:GGUF Q2-Q5(MiniMax-H3-FL2VA-Q3_K_M/Q4_K_M、テキストエンコーダーGGUF)、プルーニング済みINT4/INT8、NVFP4ファイル、ワークフロー同梱。
minimax-h3-community-license-agreement
テキスト→動画Ostris AI Toolkit で MiniMax H3 の LoRA をトレーニング:T2V と I2V に対応し、NVFP4 量子化と VAE 勾配チェックポイントでコンシューマー GPU でも実行可能。
Open-Weights
テキスト→動画ComfyUI 向け MiniMax H3 オープンウェイトをダウンロード: FL2VA・Ref2VA チェックポイント、bf16・INT8・pruned・NVFP4 ファイル、T2V・I2V・R2V の公式ワークフローテンプレート 6 点付き。
Open-Weights
テキスト→画像SenseTime の SenseNova-U1.5-8B-MoT-Preview は、4K テキストから画像への生成と、より強力な画像編集を単一の統合モデルで実現し、SenseNova_U1 カスタムノードパックによる ComfyUI サポートを提供します。
Apache-2.0
キャラクター画像をクリーンなTripleView・QuadViewリファレンスシートに変換する画像編集LoRA。FLUX.2 Klein 9BとKrea 2向けのComfyUIワークフローを同梱。
Civitai-Model-License
Lodestonesが、Krea 2向けのランク256のComfyUI対応LoRA「Kroma v0.1」をリリースしました。完全なファインチューン済みの正規化およびモジュレーション差分を搭載し、Krea 2ベースとTurboの両方で動作します。
MIT
テキスト→動画MiniMaxがH3を発表。ネイティブステレオオーディオ付きの2K・15秒クリップを生成するオムニモーダルビデオモデルで、マルチモーダルコンテキスト理解と指示ベースの編集に対応。
Open-Weights
1.4Bパラメータ、6レイヤー蒸留版のSeedVR2-7Bが、低VRAMマシンにワンステップの4倍/8倍アップスケーリングを実現。ドロップイン対応のComfyUIカスタムノードと既製ワークフロー付き。
Apache-2.0
PrunaVAEDはLTX-2.3用のドロップイン代替VAEデコーダーで、1.7倍の高速デコードと約50%のピークVRAM削減を実現し、画質はほぼオリジナルを維持します。
ltx-2
動画編集Eyeline-LabsのID-V2Vは、SIGGRAPH Asia 2026で発表されたアイデンティティ保存動画から動画へのモデルで、Kijaiのint8 convrot重みとコアPRを通じてComfyUIをサポートするようになりました。
NVIDIA が Qwen-Image-Flash を公開しました。Qwen-Image の 4 ステップ DMD2 蒸留バージョンで、基本アーキテクチャを維持したまま高速なテキストから画像への生成を実現します。
nvidia-open-model-license
テキスト→動画Black Forest LabsがFLUX 3を発表。統合マルチモーダル基盤モデルで、20秒のビデオとネイティブオーディオ、画像生成、ロボット工学向けアクション予測を実現。
API-Only
テキスト→画像Microsoft Asia releases Mage-Flow -- compact 4B generative stack for text-to-image and image editing, native resolution 512-2048, RL and 4-step Turbo variants, MIT license.
MIT
NVIDIAがCosmos3-Edgeをリリース。テキスト、画像、アクション軌跡から動画、画像、音声を生成する4B Mixture-of-Transformers世界モデルで、ComfyUIコミュニティノードに対応しています。
OpenMDW-1.1
画像→画像Damkohler氏がJLC Flux2 ControlNet v1.0.0をリリースしました。これはComfyUI向けのFLUX.2 ControlNetで、マルチブランチ合成、リファレンス条件付け、インペイント/アウトペイント対応を備えています。
Oasis Suite v1.5 は Image Oasis を3ノードパックに拡張。ノード内プレビュー対応の Video Oasis Viewer と、オールインワンで LTX 2.3 動画生成を実現する LTX2.3 Oasis を追加しました。