音声合成BilibiliのIndexTeamがIndexTTS-2.5をリリース: 中国語、英語、日本語、スペイン語、アラビア語に対応したゼロショット音声クローンと感情制御・話速制御を搭載。
Bilibili Model License
ComfyUI エコシステムの最新情報:オープンソースモデルのリリース、カスタムノード、ワークフロー、ツールのアップデート。
音声合成BilibiliのIndexTeamがIndexTTS-2.5をリリース: 中国語、英語、日本語、スペイン語、アラビア語に対応したゼロショット音声クローンと感情制御・話速制御を搭載。
Bilibili Model License
テキスト→動画UnslothがFL2VAとRef2VA向けにQ2_K (6.3 GB) からQ8_0 (20 GB) までのMiniMax H3 GGUF量子化ファイルを公開。ComfyUIとstablediffusion.cpp向けのQwen3-VLテキストエンコーダーGGUFも含まれます。
テキスト→画像iljung1106氏の新しいComfyUIノードがKrea 2に正規化アテンションガイダンス(NAG)をもたらし、CFG 1.0を必要とするTurboチェックポイントでネガティブプロンプト制御を復活させます。
テキスト→動画h3-realism-people-t2v-i2v-r2v.safetensors(125 MB)をComfyUI/models/lorasに配置するだけで、T2V・I2V・R2Vでフォトリアルな人物を生成できます。トリガーワードはr34l1sm。
GitHubからMiniMax H3公式スキルをインストール: 5つの生成モードすべてをカバーするh3-prompt-writingと、バイリンガルSKILL.mdを備えた8つのスタイル別ビデオ生成スキル。
Redisの作者であるantirezが、Apple Silicon向けのネイティブなMetalベースMiniMax-H3推論エンジンh3.cを開発中。プロンプトからビデオ/オーディオ生成とRef2VA参照がエンドツーエンドで動作します。
MIT
テキスト→動画ComfyUIのカスタムノードがMiniMax H3の15.7 GBのQwen3-VL-32Bテキストエンコーダーを、学習済みプロジェクション付きのQwen3-VL-4Bに置き換え、条件付けのVRAM使用量を4.5 GBに削減します。
MIT
インペイントLanPaint 2.0.0は、ビデオ/オーディオのインペイントパイプラインでMiniMax H3をサポートします。1つのエディターでフレームごとのマスクとオーディオ区間をペイントし、両方を1回のパスでインペイントできます。
LodestonesがKroma v0.2をLoRAではなくKrea 2のフルファインチューン済みcheckpointとしてリリース。ComfyUI向けにbase版とturbo版のファイルに加え、コミュニティのINT8量子化版も提供されます。
MIT
動画編集H3 Motion Context v0.2.0は、MiniMax H3クリップをチェーン接続し、カットをまたいでモーションとオーディオが継続するようにします。リファレンスモードをサポートし、結合部分の目に見える継ぎ目をなくします。
h3_clean_latent_upscaler_v1_mamad8.safetensors(56 MB)をダウンロード:Mamad8がMiniMax H3向けに2つのComfyUIノードとともに公開した2xクリーン潜在アップスケーラー。潜在空間に留まったままVAEデコード前に空間解像度を2倍にします。
テキスト→動画minimax_h3_turbo_v4_step600_ema.safetensors(MiniMax H3 Turbo LoRA v4)をダウンロード:ComfyUI で 2 ステップの音声付き動画生成。pruned checkpoint にも対応。
minimax_h3_t1_image_vae_step1597.safetensors(5.2 GB)をダウンロード:Mamad8が公開した実験的な画像特化型MiniMax H3 VAE。単一のT=1時間潜在を直接画像にデコードします。カスタムノードは不要です。
テキスト→動画Lightx2vのMiniMax-H3-Prompt-Rewriter-LoRAは、短いプロンプトを構造化されたH3 T2VA説明にローカルで変換します。Qwen3.6-27Bアダプタ用のComfyUIノードパックも用意されています。
キャラクターアニメWan-Animate-2 と Wan-Animate-2-Lite が ComfyUI で利用可能に:ドライビングビデオを直接入力とするエンドツーエンドのキャラクターアニメーション、テキスト駆動の視点制御、ネイティブノード、リアルタイム Lite 版。
Apache-2.0
画像→動画Lightx2vとModelTCがMiniMax H3を4ステップのFL2V Turbo LoRAに蒸留。サンプリングを約20ステップから4ステップに削減し、ComfyUI変換版とデモSpacesを提供します。
テキスト→動画MiniMax H3 Turbo LoRA(minimax_h3_turbo_4step_ckpt500.safetensors)をダウンロード: ComfyUI で同期ステレオオーディオ付きビデオを 4 ステップ生成。pruned 変換版と T2V/I2V ワークフロー付き。
Apache-2.0
テキスト→動画tsuremenの新しいComfyUIノードは、MiniMax H3スケジュールの最初のステップを通して複数のシードを探索し、ノード上にライブプレビューを表示して、選択したシードだけを完了します。
テキスト→動画Kijai の実験的 w4a8 量子化 MiniMax H3 重みをダウンロード:minimax_h3_fl2va_pruned_w4a8_mixed.safetensors(12.5 GB FL2VA)、Ref2VA 版、int8 convrot VAE を ComfyUI で使用。
minimax-h3-community-license-agreement
テキスト→動画Sand.aiがMAGI-2 Previewをオープンソース化。テキストまたは画像から同期オーディオ付きの10秒ビデオを生成する114BパラメータのMoEモデルで、トークンあたりわずか6Bパラメータのみをアクティブ化します。
Apache-2.0