ComfyUI ニュース&オープンソース AI リリース

ComfyUI エコシステムの最新情報:オープンソースモデルのリリース、カスタムノード、ワークフロー、ツールのアップデート。

動画編集
LoRA
Edit Anything: 実験的LTX-2.3ビデオ編集LoRA for ComfyUI

AlissonerdxがEdit Anythingをリリース。Apache-2.0オープンソースのLTX-2.3用ビデオ編集LoRAで、モーショントランスファー、ノーリファレンスマルチタスク編集、リファレンス動画から動画への編集を特長とし、すべてComfyUIのBFSnodesを通じて動作します。

エコシステム

Comfy MCP: AIエージェントをクリエイティブテクノロジストに変える

エコシステム
ツール
Comfy MCP: AIエージェントをクリエイティブテクノロジストに変える

Comfy OrgがComfy MCPを発表。Model Context Protocolを介してAIエージェントをComfyUIに接続。エージェントは自然言語でモデルを検索し、ワークフローを実行し、画像、ビデオ、3Dコンテンツを生成できるようになります。

マルチモーダル
ベースモデル
NVIDIA、LocateAnything-3Bを公開:並列ボックスデコードを備えたオープンソースの視覚言語グラウンディングモデル

NVIDIAが、並列ボックスデコード(PBD)を搭載した視覚言語グラウンディングモデルLocateAnything-3Bをオープンソース化。高速かつ高精度な物体位置特定を実現し、物体検出、GUI要素グラウンディング、OCR位置特定、ポイントベースのグラウンディングなど、多様なドメインをサポート

Open-Weights

画像→動画
ファインチューン
DomainShuttle:HKUST、Wan2.2ベースの140億パラメータオープンドメイン被写体駆動型テキストから動画へのモデルをオープンソース化

香港科技大学C4G研究室が、Wan2.2-T2V-14BをベースとしたApache 2.0ライセンスのオープンドメイン被写体駆動型動画生成モデル「DomainShuttle」を公開。Domain-MoT、Video-Reference DualRoPE、Cross-Pair Consistent Lossを導入し、ドメイン内の忠実性とクロスドメインのスタイル変換を柔軟に実現。

Apache-2.0

テキスト→動画
ファインチューン
Sulphur 2: LTX 2.3ベースの9Bビデオ生成モデル

Sulphur 2はLTX 2.3のコミュニティファインチューンであり、内蔵のプロンプトエンハンサーと蒸留LoRAを備えたテキストから動画への生成および画像から動画への生成を提供。125K以上の厳選されたクリップでトレーニングされています。

Open-Weights

マルチモーダル

OpenMOSS、MOVA をリリース - オープンソース音声・動画同期生成モデル

マルチモーダル
ベースモデル
OpenMOSS、MOVA をリリース - オープンソース音声・動画同期生成モデル

OpenMOSS チームが MOVA (MOSS Video and Audio) をリリース。単一推論パスで動画と音声を生成するエンドツーエンドの音声・動画同期生成基盤モデルで、正確なリップシンクと環境認識音響効果を実現し、モデルウェイト、トレーニングおよび推論コードを完全オープンソース化

Open-Weights