Kroma v0.3.1: Krea 2 ファインチューン向けオンポリシー蒸留 (OPD)
Lodestones が Krea 2 向けの Kroma v0.3.1 OPD を公開。ベースモデルの分布内に留まるオンポリシー蒸留ターボチェックポイントで、LoRA トレーニングもそのまま引き継げます。
kroma-v0.3.1-turbo-opd.safetensors はオンポリシーで蒸留されており、蒸留に通常伴う品質の犠牲なしに Turbo のサンプリング速度を維持します。Kroma リポジトリも同日に整理され、v0.1 と v0.2 のファイルは削除され、v0.3.1 OPD、v0.3 ベース、v0.3 teacher だけが残りました。
OPD が変えたもの
以前の Kroma turbo チェックポイントはオフラインで蒸留されていました。生徒モデルは、固定されたサンプリングスケジュール上で教師モデルを模倣するようトレーニングされていました。readme はこのレシピの失敗モードを直接説明しています。教師が選んだ状態で教師を模倣すると、生徒モデルは徐々に元のデータ多様体から外れていき、それがモード崩壊、ディテールの平坦化、突然効かなくなるプロンプトとして現れます。
OPD、すなわちオンポリシー蒸留は、この方向を逆転させます。 生徒モデルが自らトラジェクトリを生成し、教師モデルがまさにその点で修正を行います。トレーニングはモデルが実際に訪れる状態でのみ行われるため、蒸留されたチェックポイントは由来するモデルの分布内に留まります。その結果、通常の蒸留コストなしで Turbo の速度が得られるはずです。
現在のリポジトリの中身
リポジトリは10月7日に再編成され、現在は3つのファイルが含まれています。
| ファイル | サイズ | 内容 |
|---|---|---|
kroma-v0.3.1-turbo-opd.safetensors | 約26.3 GB | 推奨チェックポイント: v0.3 をオンポリシーで蒸留し、Turbo 速度のモデルにしたもの |
kroma-v0.3-base.safetensors | 約51.3 GB | Krea 2 raw(非蒸留)ウェイトの完全なファインチューン |
kroma-sensei-booru-e6-teacher-velocity-v0.3.safetensors | 約25.7 GB | LoRA トレーニングと OPD 実行に使用された教師モデル |
以前の Kroma の記事がリンクしていた kroma-v0.2-turbo、kroma-v0.2-base、kroma-v0.3-turbo、kroma-v0.3-tdm-4steps-artifact の各ファイルは削除済みのため、古いダウンロード手順はもう解決できません。readme の「ダウンロードするファイル」表には依然として kroma-v0.2-turbo.safetensors が記載されていますが、これは古い情報です。取得すべきファイルは v0.3.1 OPD です。
ComfyUI での実行方法
v0.3.1 の実行方法は v0.2 や v0.3 とまったく同じです。スタンダードな Krea 2 スタックを使用するため、ComfyUI ネイティブの Krea 2 サポート以外にカスタムノードは必須ではありません。
kroma-v0.3.1-turbo-opd.safetensorsをComfyUI/models/diffusion_models/に配置します- Krea 2 のテキストエンコーダー(Qwen3-VL、12レイヤー)を CLIPLoader で読み込み、type を
krea2に設定します - Krea 2 の VAE を読み込みます
- チェックポイントが蒸留された Turbo 設定でサンプリングします: 8〜12ステップ、CFG 1.0〜1.5、shift (mu) 1.15
最小構成のチェーンは、Load Diffusion Model を Kサンプラーへ接続し、そこに krea2 CLIP と Krea 2 VAE を入力する形です。出力がおかしい場合、readme が最初に疑うのはテキストエンコーダーです。CLIPLoader の type が krea2 であること、ComfyUI がネイティブ Krea 2 サポートを含む現在のビルドであることを確認してください。
LoRA トレーニングはそのまま活用できる
OPD は生徒モデルをオリジナルの分布内に留めるため、通常の方法でトレーニングした LoRA はそのまま動作します。teacher(kroma-sensei-booru-e6-teacher-velocity-v0.3.safetensors)または base(kroma-v0.3-base.safetensors)のいずれかに対してトレーニングすれば、得られた LoRA は kroma-v0.3.1-turbo-opd.safetensors にそのまま読み込めます。これが、積極的に蒸留された生徒モデルとの主な実用的な違いです。turbo チェックポイントを差し替えても、アダプターを再トレーニングしたり再導出したりする必要はありません。
入手方法
モデル: lodestones/Kroma
チェックポイント: kroma-v0.3.1-turbo-opd.safetensors
ベースモデル: Krea 2
コメント
GitHubでサインインしてディスカッションに参加しましょう。