テキスト→画像SupraLabsがSupra2-IMGをリリース。1億500万パラメータのDiTテキストから画像へのモデルで、H100 1台で10時間かけてゼロからトレーニングされ、256x256のサンプルを公開しています。
Apache-2.0
ComfyUI エコシステムの最新情報:オープンソースモデルのリリース、カスタムノード、ワークフロー、ツールのアップデート。
テキスト→画像SupraLabsがSupra2-IMGをリリース。1億500万パラメータのDiTテキストから画像へのモデルで、H100 1台で10時間かけてゼロからトレーニングされ、256x256のサンプルを公開しています。
Apache-2.0
エコシステムCsetiがCrossView-WarpをMiniMax H3へ移植。MoGe深度ワープを使い、既存映像を新しいカメラアングルから再レンダリングするRef2VA LoRAとComfyUIノードです。
MiniMax-H3-Community
エコシステムComfyUI v0.37.0では、3つの公式テンプレートを備えたQwen-Image 2.1のネイティブサポート、MoGe 3ジオメトリ推定、高速化されたQwen3.8テキストエンコーダー、そして自動高速ディスク読み込みが追加されました。
テキスト→動画ComfyUI-MiniMax-H3-SPEED V2はEuler、Heun、DPM2、RES Multistepをサポートし、サンプラー対応のSigma Harvestを追加、I2Vキーフレームのリサイズを修正しました。
テキスト→画像Qwen-Image 2.1はAlibabaの7Bオープンウェイト画像モデルで、ネイティブRGBA透過、最大10枚の参照画像からの編集、day-0のComfyUIサポートと公式テンプレートを備えています。
Qwen Research License
テキスト→動画Video RebirthのHyperFlowは、データ不要の自己蒸留LoRAによりMiniMax H3のサンプリングを49回のtransformerフォワードから8回に削減。その後、2つのComfyUI移植版が登場しました。
minimax-h3-community-license-agreement
画像→動画XGEN LabsのJING-Flash-v1は、MiniMax H3上で一人称視点の動画と音声を構築します。キーボードによるカメラ操作、テキスト駆動のインタラクション、対話、そして4ステップ推論を備えています。
minimax-h3-community-license-agreement
画像→動画Fizgig v6.0はMiniMax H3向けのRefModを作成できます。参照写真を1つの小さなファイルにまとめ、モデル自体に対してチューニングし、ComfyUIより前にRefMod Studioでプレビューできます。
エコシステムComfyUI v0.36.0では、Marigold V2による深度・サーフェス法線・アルベド推定のネイティブ対応と3つの公式ワークフロー、さらに動画連結ノード、FastH3、YuE2、新しいパートナーノードが追加されました。
エコシステムComfyUIコアがワークフローをネイティブにループできるようになりました。Start LoopとEnd Loopを組み合わせれば、回数、インデックス範囲、またはリストでグラフを反復でき、値の引き継ぎと出力の蓄積が可能です。
画像→動画MiniMax H3 Ref2VA 向けの UntMods 製 FaceSwap LoRA は、参照動画の人物のアイデンティティを参照画像の顔に置き換えます。すぐに使える ComfyUI ワークフローも付属します。
Apache-2.0
テキスト→動画ComfyUI 0.36.0はcomfy-kitchenカーネルでMiniMax H3動画VAEを高速化し、公式Comfy-Orgリポジトリがコンパクトなint8 convrot VAEをホストするようになりました。
テキスト→動画FastVideo FastH3 8-Step V2 は、公式の t2v および先頭/末尾フレームテンプレート、BlockSparseAttention の VSA 設定、Comfy-Org が repack した checkpoint により、ComfyUI 上でネイティブに動作します。
動画編集Viggle MeridianはジオメトリレンダーからMiniMax H3の動画を再カメラ撮影します。既存のクリップとカメラパスを入力すると、新しい視点が得られます。2つのLoRA、2つのノード、すぐに使えるグラフを用意。
minimax-h3-community-license
テキスト→画像コミュニティ製のDMD2蒸留LoRAを使えば、Krea 2 Turboをcfg 1.0の2ステップで実行でき、高速なプレビューやドラフトが得られます。標準ノードのみで構成したComfyUIワークフローも用意されています。
画像→画像Krea-2-Raw向けのコミュニティ製LoRA 2種が、線画に従いながら完成画像を描画します。ComfyUIのOstris editノードとRealistic Lineartプリプロセッサを使用します。
音声合成コミュニティが開発したYuE2-3B用の不足していた音声エンコーダーが、自分の録音をLoRAトレーニング用のセマンティックトークンに変換。セクションプロンプトに対応したインストゥルメンタルLoRAも登場。
音声合成ComfyUI-YuE2-Trainerは、YuE2-3B音楽モデルのLoRAトレーニングをComfyUIノードとして提供します。mp3やwavファイルを渡してトリガーワードを選ぶだけで、標準のローダーで読み込めるLoRAが得られます。
テキスト→動画カメラの動きを MiniMax H3 のプロンプトに変換する ComfyUI カスタムノード。3D カメラをドラッグし、キーフレームとオービットプリセットを設定すると、コンパイルされた軌道プロンプトが得られます。
動画編集AInVFXのAdrien Toupet氏が、キーフレームに描いた平坦な色の塊を、ComfyUI内でアートディレクション可能な煙・蒸気・炎の映像に変換する、LTX 2.5向けの無料IC-LoRAを公開しました。
LTX-2.x Community License