画像→3Dテンセントは、テキストと画像から高解像度の3D資産を生成するための二段階プロセスを備えたHunyuan3D 2.0システムを発表しました。複数のオープンソースモデルシリーズを特徴としています
Open-Weights
ComfyUI エコシステムの最新情報:オープンソースモデルのリリース、カスタムノード、ワークフロー、ツールのアップデート。
画像→3Dテンセントは、テキストと画像から高解像度の3D資産を生成するための二段階プロセスを備えたHunyuan3D 2.0システムを発表しました。複数のオープンソースモデルシリーズを特徴としています
Open-Weights
快手科技がReCamMasterを発表しました。この技術は、ユーザーが単一のビデオから新しいカメラ視点と動きの軌跡を生成できる生成型ビデオ技術です。
Open-Weights
テキスト→動画hpcaitechがOpen-Sora 2.0オープンソースビデオ生成モデルを発表。20万ドルのトレーニングコストで、トップクラスの商業モデルに近い性能を実現
Open-Weights
アリ通義研究所が多機能ビデオ生成および編集モデルVACEを発表し、さまざまなビデオ処理タスクを単一のフレームワークに統合し、ビデオ制作のハードルを下げました。
Open-Weights
マイクロソフトリサーチがグローバルテキストプロンプトに基づくインテリジェントレイヤー生成ソリューションを開発。50以上の独立レイヤーを含む透明画像の作成を可能に
Open-Weights
画像→動画TencentのHunyuanチームが単一画像から5秒動画を生成可能なオープンソースモデルをリリース。スマートモーション生成とカスタムエフェクト機能を提供
Open-Weights
マルチモーダル
テキスト→画像智譜AIチーム(THUDM)が日中バイリンガル入力と漢字生成可能なオープンソース画像生成モデルCogView4を公開、複数ベンチマークで首位を獲得
Open-Weights
マルチモーダルSesameがデュアルTransformerアーキテクチャの会話型音声モデルCSMを公開、リアルタイム音声インタラクションとオープンソースコアを提供
Open-Weights
アリババが最新のビデオ生成モデルである Wan2.1 を正式にオープンソースにした。このモデルはわずか 8GB のビデオメモリで動作し、高画質ビデオ生成、動的字幕、多言語吹き替えをサポートし、VBench ランキングで Sora などを超える 86.22% の総スコアを記録した
Open-Weights
アリババ国際デジタル商業グループ(AIDC-AI)は ComfyUI Copilot プラグインをリリースしました。これは、自然言語インタラクションと AI によって駆動される機能を通じて ComfyUI の使用体験を簡素化し、中国語インタラクションをサポートし、スマートノードの推奨機能などを提供します。
Open-Weights
アリババは、最新のビデオ生成モデルである万相2.1が2025年第二四半期にオープンソースになることを発表した。このモデルは、HDビデオ生成、動的字幕、多言語音声などをサポートし、VBenchランキングで84.7%の総スコアで首位に立っている
Open-Weights
マルチモーダルGoogleが新しいPaliGemma 2 mixモデルをリリースし、画像の説明、OCR、オブジェクト検出など多くの視覚タスクをサポートし、3B、10B、28Bの3つのスケールバージョンを提供
Open-Weights
Skyworkがオープンソースビデオ生成モデルSkyReels-V1をリリースし、文生ビデオと図生ビデオをサポートし、映画級の光影効果と自然な動作表現を実現し、商用も可能にした
Open-Weights
研究者たちは新しいビデオ再照明手法Light-A-Videoを提案しました。この手法は、一貫した光注意(CLA)と段階的光融合(PLF)を通じて、時間的に滑らかなビデオ再照明効果を実現します。
Open-Weights
StepFunはオープンソースのテキストから動画生成モデルStep-Video-T2Vを発表しました。300億パラメータを持ち、最大204フレームの高品質動画を生成でき、オンライン体験プラットフォームも提供しています。
Open-Weights
画像→3DKuaishouが3D認識技術による高品質な動画コンテンツ制作を実現するCineMasterテキスト→動画生成フレームワークを正式リリース
Open-Weights
アリババの最新オープンソースプロジェクトInspireMusic、FunAudioLLMをベースとした統合オーディオ生成フレームワークで、音楽制作、歌声生成など様々なオーディオ合成タスクをサポート。
Open-Weights
テキスト→画像アリババ研究所が画像生成ツールACE++をオープンソース化。コンテキスト認識コンテンツ充填技術により、単一入力からキャラクター一貫性のある新しい画像を生成し、オンライン体験と3種類の専用モデルを提供。
Open-Weights
ByteDanceの研究チームが人体アニメーション生成フレームワークOmniHuman-1を発表。1枚の画像とモーション信号から高品質な人体ビデオアニメーションを生成可能に。
Open-Weights