テキスト→画像InstantCharacterは、1枚の画像からキャラクターの一貫性を保った生成を実現する革新的なチューニング不要の手法で、さまざまな下流タスクをサポートします
Open-Weights
ComfyUI エコシステムの最新情報:オープンソースモデルのリリース、カスタムノード、ワークフロー、ツールのアップデート。
テキスト→画像InstantCharacterは、1枚の画像からキャラクターの一貫性を保った生成を実現する革新的なチューニング不要の手法で、さまざまな下流タスクをサポートします
Open-Weights
テキスト→動画Lvmin Zhangが開発したFramePackテクノロジーは入力フレームコンテキストを圧縮し、動画生成の作業負荷を動画の長さに関係なく一定に保ち、ノートパソコンのGPUでも多数のフレームを処理可能にします
Open-Weights
Seaweed-7Bは、わずか70億パラメータで140億パラメータモデルを上回る性能を実現し、業界標準の3分の1のトレーニングコストで動画生成分野に新たな可能性をもたらします
Open-Weights
テキスト→動画新しい動画修復フレームワークFloEDがコードと重みを公開し、光学フローガイダンス技術によって高い動画一貫性と計算効率を実現
Open-Weights
PixelFlowは生の画素空間で革新的に動作し、事前訓練された変分オートエンコーダを必要とせずに画像生成プロセスを簡素化し、エンドツーエンドで訓練可能なモデルを実現します
Open-Weights
画像→3DHoloPartは3Dモデルを完全で意味のあるパーツに分解し、3Dコンテンツ制作における編集課題を解決します
Open-Weights
画像→3DUniRigは自己回帰モデルを活用して多様な3Dモデル向けの高品質スケルトン構造とスキニングウェイトを生成し、アニメーション制作ワークフローを大幅に簡素化
Open-Weights
マルチモーダルOmniSVGは、テキスト、画像、キャラクターリファレンスなど様々な入力から高度に複雑で編集可能なベクターグラフィックスを生成できる新しい統合マルチモーダルSVG生成モデルです
Open-Weights
テキスト→動画研究者らがCogVideoX 5Bをベースにしたテスト時学習技術を用いたTTT-Videoモデルを開発し、最大63秒の一貫性のあるビデオ生成を実現
MIT
テキスト→画像ByteDanceのクリエイティブインテリジェンスチームが、コンテキスト生成によってより高い制御性を実現するUNOモデルを発表し、単一から複数の被写体への高品質な画像生成を可能に
Open-Weights
テキスト→画像Tiamat AIチームがEasyControlフレームワークをリリース、DiTモデルに条件付き制御機能を追加、ComfyUI-easycontrolプラグインを通じてComfyUIでのサポートが可能に
Open-Weights
テキスト→画像HiDream.aiが17B パラメータを持つ新しいオープンソーステキスト生成画像モデルHiDream-I1をリリース。複数のベンチマークで既存のオープンソースモデルを上回り、様々なスタイルの高品質画像生成をサポート
Open-Weights
画像→3DStable-Xチームが、法線橋渡し技術により既存手法の幾何学的詳細の欠如を解決する、画像から高忠実度3Dモデルを生成する革新的フレームワークHi3DGenを発表
Open-Weights
画像→3D革新的なSparseFlex表現法に基づくTripoSFは、1024³解像度までの3Dモデル生成をサポートし、開放面や複雑な内部構造の処理が可能で、3Dアセットの品質を大幅に向上させます
Open-Weights
テキスト→動画崑崙万維が世界初の商用グレードの制御可能な動画生成フレームワークSkyReels-A2をリリース。デュアルブランチアーキテクチャにより複数要素の動画生成を実現し、Eコマース、映画制作などの分野に新たな可能性をもたらす
Open-Weights
マルチモーダルアリババグループの通義研究所が、テキストから動画生成、動画編集、複雑なタスク組み合わせまでをカバーする世界初の統合フレームワークVACEを発表
Open-Weights
マルチモーダルStarVectorプロジェクトは、画像やテキストからSVGベクターグラフィックスコードを自動生成する機能を実装し、デザイナーや開発者に新しいクリエイティブツールを提供します。
Open-Weights
テキスト→画像バイトダンスが拡散トランスフォーマーに基づく革新的なフレームワークInfiniteYou(InfU)を発表。このフレームワークは、アイデンティティの類似性、テキスト画像の整合性、生成品質に関する既存手法の限界に対処しながら、ユーザーのアイデンティティを保持する柔軟な写真再構築を可能にします
MIT
Stability AIが新しいAIモデルStable Virtual Cameraを発表。通常の写真をリアルな奥行きと遠近感を持つ3Dビデオに変換し、クリエイターに直感的なカメラコントロールを提供
Open-Weights
画像→3D清華大学とテンセントAI研究所が共同でStdGENを発表、単一画像から体、衣服、髪などのコンポーネントが分離された高品質な意味分解3Dキャラクターを生成する革新的パイプライン
Open-Weights