Kroma v0.3.1: Krea 2 ファインチューン向けオンポリシー蒸留 (OPD)

ComfyUI Wikinews

Lodestones が Krea 2 向けの Kroma v0.3.1 OPD を公開。ベースモデルの分布内に留まるオンポリシー蒸留ターボチェックポイントで、LoRA トレーニングもそのまま引き継げます。

Lodestones は10月7日、Krea 2 のコミュニティファインチューンの次期バージョンである Kroma v0.3.1 を公開しました。新たに推奨されるチェックポイント kroma-v0.3.1-turbo-opd.safetensors はオンポリシーで蒸留されており、蒸留に通常伴う品質の犠牲なしに Turbo のサンプリング速度を維持します。Kroma リポジトリも同日に整理され、v0.1 と v0.2 のファイルは削除され、v0.3.1 OPD、v0.3 ベース、v0.3 teacher だけが残りました。
Krea 2 向けの Kroma

OPD が変えたもの

以前の Kroma turbo チェックポイントはオフラインで蒸留されていました。生徒モデルは、固定されたサンプリングスケジュール上で教師モデルを模倣するようトレーニングされていました。readme はこのレシピの失敗モードを直接説明しています。教師が選んだ状態で教師を模倣すると、生徒モデルは徐々に元のデータ多様体から外れていき、それがモード崩壊、ディテールの平坦化、突然効かなくなるプロンプトとして現れます。

OPD、すなわちオンポリシー蒸留は、この方向を逆転させます。 生徒モデルが自らトラジェクトリを生成し、教師モデルがまさにその点で修正を行います。トレーニングはモデルが実際に訪れる状態でのみ行われるため、蒸留されたチェックポイントは由来するモデルの分布内に留まります。その結果、通常の蒸留コストなしで Turbo の速度が得られるはずです。

現在のリポジトリの中身

リポジトリは10月7日に再編成され、現在は3つのファイルが含まれています。

ファイルサイズ内容
kroma-v0.3.1-turbo-opd.safetensors約26.3 GB推奨チェックポイント: v0.3 をオンポリシーで蒸留し、Turbo 速度のモデルにしたもの
kroma-v0.3-base.safetensors約51.3 GBKrea 2 raw(非蒸留)ウェイトの完全なファインチューン
kroma-sensei-booru-e6-teacher-velocity-v0.3.safetensors約25.7 GBLoRA トレーニングと OPD 実行に使用された教師モデル

以前の Kroma の記事がリンクしていた kroma-v0.2-turbo、kroma-v0.2-base、kroma-v0.3-turbo、kroma-v0.3-tdm-4steps-artifact の各ファイルは削除済みのため、古いダウンロード手順はもう解決できません。readme の「ダウンロードするファイル」表には依然として kroma-v0.2-turbo.safetensors が記載されていますが、これは古い情報です。取得すべきファイルは v0.3.1 OPD です。

ComfyUI での実行方法

v0.3.1 の実行方法は v0.2 や v0.3 とまったく同じです。スタンダードな Krea 2 スタックを使用するため、ComfyUI ネイティブの Krea 2 サポート以外にカスタムノードは必須ではありません。

  1. kroma-v0.3.1-turbo-opd.safetensors を ComfyUI/models/diffusion_models/ に配置します
  2. Krea 2 のテキストエンコーダー(Qwen3-VL、12レイヤー)を CLIPLoader で読み込み、type を krea2 に設定します
  3. Krea 2 の VAE を読み込みます
  4. チェックポイントが蒸留された Turbo 設定でサンプリングします: 8〜12ステップ、CFG 1.0〜1.5、shift (mu) 1.15

最小構成のチェーンは、Load Diffusion Model を Kサンプラーへ接続し、そこに krea2 CLIP と Krea 2 VAE を入力する形です。出力がおかしい場合、readme が最初に疑うのはテキストエンコーダーです。CLIPLoader の type が krea2 であること、ComfyUI がネイティブ Krea 2 サポートを含む現在のビルドであることを確認してください。

LoRA トレーニングはそのまま活用できる

OPD は生徒モデルをオリジナルの分布内に留めるため、通常の方法でトレーニングした LoRA はそのまま動作します。teacher(kroma-sensei-booru-e6-teacher-velocity-v0.3.safetensors)または base(kroma-v0.3-base.safetensors)のいずれかに対してトレーニングすれば、得られた LoRA は kroma-v0.3.1-turbo-opd.safetensors にそのまま読み込めます。これが、積極的に蒸留された生徒モデルとの主な実用的な違いです。turbo チェックポイントを差し替えても、アダプターを再トレーニングしたり再導出したりする必要はありません。

入手方法

モデル: lodestones/Kroma
チェックポイント: kroma-v0.3.1-turbo-opd.safetensors
ベースモデル: Krea 2

コメント

GitHubでサインインしてディスカッションに参加しましょう。

コメントを読み込み中…
Kroma v0.3.1: Krea 2 ファインチューン向けオンポリシー蒸留 (OPD) | ComfyUI Wiki