M87はKrea 2 Turbo用の早期プレビュー美的LoRAで、構図、照明、雰囲気、視覚的テクスチャを向上させ、特定のスタイルに固定せずに映画的でアートディレクションされたような生成を実現します。
ComfyUI ニュース&オープンソース AI リリース
ComfyUI エコシステムの最新情報:オープンソースモデルのリリース、カスタムノード、ワークフロー、ツールのアップデート。
AlissonerdxがLTX-Best-Face-IDをリリース。オーバーラップ条件付け、TASS-RoPEソース位相タグ付け、ArcFace身份損失を用いたLTX-2用参照-to-動画身份保持LoRA。ComfyUIで白背景不要。
画像編集OstrisがAI ToolkitにKrea 2モデルの参照画像トレーニングをサポート。参考画像を使った編集スタイルのLoRAトレーニングが可能になり、「これをサイクロプスにする」といったコンセプトをわずか1,750ステップで習得できます。
MIT
Tanmay Patil氏がKrea 2 Depth ControlNet-LoRAをリリース。Krea 2 RawおよびTurboの両方で動作し、深度一貫性はピアソン相関係数0.99に達します。
Krea-2-Community
テキスト→画像Flux2-Klein-9B-True-V2は、wikeeyangによるFLUX.2-klein-9Bベースの最新フルファインチューンで、フォトリアリズム、プロンプト追従性、LoRA互換性、画像編集品質が大幅に向上しています。
FLUX-1-dev-non-commercial
MeituanがLongCat 2.0を公開。1.6兆パラメータのMoE言語モデルで、100万トークンのコンテキストウィンドウを持ち、完全にAI ASICハードウェア上で学習。モデルウェイトは近日中にMITライセンスで公開予定。
AlissonerdxがEdit Anythingをリリース。Apache-2.0オープンソースのLTX-2.3用ビデオ編集LoRAで、モーショントランスファー、ノーリファレンスマルチタスク編集、リファレンス動画から動画への編集を特長とし、すべてComfyUIのBFSnodesを通じて動作します。
Comfy MCP: AIエージェントをクリエイティブテクノロジストに変える
Comfy OrgがComfy MCPを発表。Model Context Protocolを介してAIエージェントをComfyUIに接続。エージェントは自然言語でモデルを検索し、ワークフローを実行し、画像、ビデオ、3Dコンテンツを生成できるようになります。
Kandinsky Lab(Sber)がKVAE-Audioをリリース。166.9Mパラメータの連続オーディオオートエンコーダで、音声、音楽、一般音声を48kHzフル帯域で最先端の再構築品質を実現します。
ilkerzgi、1,500以上のKrea 2 Style LoRAを公開:巨大なオープンソーススタイルライブラリ
ilkerzgiがHugging Faceで1,500以上のKrea 2 Style LoRAを公開。イラストから写真風まで7カテゴリを網羅。各LoRAはComfyUIですぐに使用可能。
動画編集fal.aiがLTX-2.3 3DREAL IC-LoRAを公開。これはLTX-Video用のインコンテキストLoRAで、ラフな3DブロックアウトやCGレンダリングを、元の構図とカメラモーションを保持しながらフォトリアリスティックでシネマティックな動画に変換します。
Open-Weights
マルチモーダルNVIDIAが、並列ボックスデコード(PBD)を搭載した視覚言語グラウンディングモデルLocateAnything-3Bをオープンソース化。高速かつ高精度な物体位置特定を実現し、物体検出、GUI要素グラウンディング、OCR位置特定、ポイントベースのグラウンディングなど、多様なドメインをサポート
Open-Weights
動画編集WhatDreamsCostがLTX Director 2.0をリリース。無料のオープンソースComfyUIビデオ編集ツールに大規模アップデートを施し、完全なビデオサポート、IC-LoRA統合、オーディオインペイント、選択的再生成のためのリテイクモード、そして全面的なUIの刷新を追加。
FuzzPuppyがLTX-2.3 Foley LoRAを公開。LTX-2.3で生成した動画に、視覚と同期したリアルな効果音を追加するビデオ→オーディオLoRAです。背景音楽の重ね付けは行いません。
画像→動画香港科技大学C4G研究室が、Wan2.2-T2V-14BをベースとしたApache 2.0ライセンスのオープンドメイン被写体駆動型動画生成モデル「DomainShuttle」を公開。Domain-MoT、Video-Reference DualRoPE、Cross-Pair Consistent Lossを導入し、ドメイン内の忠実性とクロスドメインのスタイル変換を柔軟に実現。
Apache-2.0
テキスト→画像Krea.aiは、テキストから画像を生成するためのオープンウェイト12.9BパラメータのDiffusion Transformer「Krea 2 Raw」および「Turbo」をリリースしました。ComfyUIはすぐに使えるワークフローでネイティブサポートしています。
Krea-2-Community
画像編集Boogu-Image-0.1-Edit は、Boogu-Image ファミリーの Apache 2.0 ライセンス画像編集モデルで、統一されたマルチモーダル理解と生成アーキテクチャによる指示ベースの画像編集を提供します。
Apache-2.0
音声合成Higgs TTS 3は、4Bパラメータのテキスト読み上げモデルで、100以上の言語に対応し、ゼロショット音声クローン、表現力豊かな感情制御、インラインプロソディや効果音を備え、音声エージェントアプリケーションに最適です。
Open-Weights
テキスト→動画Sulphur 2はLTX 2.3のコミュニティファインチューンであり、内蔵のプロンプトエンハンサーと蒸留LoRAを備えたテキストから動画への生成および画像から動画への生成を提供。125K以上の厳選されたクリップでトレーニングされています。
Open-Weights
OpenMOSS、MOVA をリリース - オープンソース音声・動画同期生成モデル
OpenMOSS チームが MOVA (MOSS Video and Audio) をリリース。単一推論パスで動画と音声を生成するエンドツーエンドの音声・動画同期生成基盤モデルで、正確なリップシンクと環境認識音響効果を実現し、モデルウェイト、トレーニングおよび推論コードを完全オープンソース化
Open-Weights