Comfy Cloud - クラウドで手軽にComfyUIを利用
Comfy Cloudは、強力なGPU、人気モデル、カスタムノードを備えたComfyUIへの簡単なアクセスを提供します。無料のクラウド版ComfyUIを体験できるプライベートベータにご参加ください。
ComfyUI エコシステムの最新情報:オープンソースモデルのリリース、カスタムノード、ワークフロー、ツールのアップデート。
Comfy Cloudは、強力なGPU、人気モデル、カスタムノードを備えたComfyUIへの簡単なアクセスを提供します。無料のクラウド版ComfyUIを体験できるプライベートベータにご参加ください。
画像→3Dテンセント・フンユアンチームがボイジャー技術をリリース、単一画像とユーザー定義のカメラパスからワールド一貫性のある3Dポイントクラウドシーケンスビデオを生成可能に、無限ワールド探索と直接3D再構成をサポート
Open-Weights
テキスト→画像ByteDanceがUSOモデルを発表。任意の主体と任意のスタイルを自由に組み合わせ、主体の一貫性を維持しながら高品質なスタイル転送効果を実現
Open-Weights
Wan2.2-S2Vは、静止画と音声を動画に変換できるAI動画生成モデルで、対話、歌唱、演技などのコンテンツ制作ニーズをサポートします。
Open-Weights
エコシステム最初のComfyUIウィークリーチャレンジに参加して100ドルを獲得しましょう!提供された深度マップを使って、猫男のキャラクターをひっくり返す動画を作成してください。
MeiGen-AIチームがInfiniteTalkモデルをオープンソース化し、精密なリップシンクと無制限長ビデオ生成を実現。画像からビデオ、ビデオからビデオへの変換をサポートし、デジタルヒューマン技術に新たな突破口をもたらしました。
MIT
ComfyUIがサブグラフ機能を正式リリースし、ユーザーが複雑なノードの組み合わせを再利用可能な個別のサブグラフノードにパッケージ化できるようになり、ワークフローのモジュール性と管理が大幅に向上します。
Qwen-Imageは200億パラメータのMMDiT画像生成モデルで、複雑な文字レンダリングと精密な編集を得意とします。ComfyUIでネイティブに利用可能になりました。本記事は主な機能、ライセンス、リソースを簡潔にまとめます。
Open-Weights
テキスト→画像Tencent Hunyuanチームが、GRPOにスライディングウィンドウ混合ODE-SDEサンプリングを統合した初のフレームワークMixGRPOをオープンソース公開。拡散モデルとフローモデルの人間嗜好アライメントで最大71%の訓練高速化を実現。
Open-Weights
Black Forest LabsとKreaの協力によりFLUX.1 Krea [dev]モデルが正式リリースされました。これはテキスト-画像生成に特化した最高のオープンソースFLUXモデルです。ComfyUIがネイティブサポートを実装し、ユーザーが最新のテキスト-画像生成技術を直接体験できるようになりました。
FLUX-1-dev-non-commercial
WANチームがWan2.2のオープンソース版を正式リリース。革新的なMoEアーキテクチャを採用し、ビデオ生成の品質が大幅に向上。ComfyUIはネイティブサポートを実現し、ユーザーは最新のビデオ生成技術を直接体験可能。
Open-Weights
テキスト→画像ByteDanceは翻訳タスク向けに設計されたSeed-X 7Bモデルをオープンソース化しました。28言語間の翻訳をサポートし、AI画像生成など様々なシーンへの統合に適しています。
Open-Weights
テキスト→動画PUSA V1.0は革新的なVTA技術を活用し、最小限のデータとコストで高品質なマルチタスク動画生成を実現。画像から動画、キーフレーム生成、動画拡張、テキストから動画など、多様な機能をサポート。
Open-Weights
テキスト→画像AMAPチームがFLUX-Textを発表。拡散モデルに基づく新しいシーンテキスト編集手法で、多言語・スタイル一貫性・高忠実度テキスト編集をサポート。
Open-Weights
OmniAvatarモデルがオープンソース化され、自然な動きと豊かな表情を持つ音声制御のフルボディ仮想人物動画の生成が可能に。ポッドキャスト、インタラクション、ダイナミックなシーンなど、様々な用途に対応
Open-Weights
音声合成通義研究所が、チェーン推論をサポートする初のAny2Audio統合音声生成・編集フレームワークThinkSoundをオープンソースで公開。動画、テキスト、音声などのマルチモーダル入力に対応し、高い忠実度、強力な同期、インタラクティブな編集機能を実現。
Open-Weights
テキスト→画像ByteDanceがXVerseモデルをオープンソース化。複数の被写体のアイデンティティと意味的属性(ポーズ、スタイル、照明など)を正確に独立制御することを可能にし、AI画像生成のパーソナライゼーションと複雑なシーン生成能力を向上
Open-Weights
Black Forest Labs が 120 億パラメータの拡散トランスフォーマーモデル Flux.1 Kontext Dev オープンソース版をリリース、ComfyUI が即時にネイティブサポートを提供
Open-Weights
マルチモーダルVectorSpaceLabがOmniGen2をリリース。自然言語指示による精密な局所画像編集をサポートする強力なマルチモーダル生成モデルで、オブジェクトの削除・置換、スタイル転換、背景処理などの編集タスクに対応
Open-Weights
NVIDIAの研究チームが、単一の画像や動画から高品質なリライティング効果を実現する拡散モデルベースの汎用リライティング技術 UniRelight を発表
Open-Weights