Kroma v0.3.1: Destilación on-policy para el fine-tune de Krea 2

ComfyUI Wikinews

Lodestones lanza Kroma v0.3.1 OPD para Krea 2: un turbo destilado on-policy que mantiene la distribución del modelo base, con el LoRA intacto.

Lodestones publicó Kroma v0.3.1 el 7 de octubre, la siguiente iteración del fine-tune de la comunidad de Krea 2. El nuevo checkpoint recomendado, kroma-v0.3.1-turbo-opd.safetensors, se destila on-policy, por lo que mantiene la velocidad de muestreo de Turbo sin el coste de calidad que suele acompañar a la destilación. El repositorio de Kroma se recortó el mismo día: los archivos v0.1 y v0.2 han desaparecido, dejando solo v0.3.1 OPD, la base v0.3 y el teacher v0.3.
Kroma for Krea 2

Qué cambia OPD

Los checkpoints turbo anteriores de Kroma se destilaban offline: el estudiante se entrenaba para imitar al teacher en un calendario de muestreo fijo. El readme describe directamente el modo de fallo de esa receta. Imitar al teacher en estados que el teacher eligió arrastra poco a poco al estudiante fuera del manifold de datos original, lo que se manifiesta como colapso de modos, detalles desvaídos y prompts que de repente dejan de funcionar.

OPD, la destilación on-policy, invierte la dirección. El estudiante genera sus propias trayectorias y el teacher lo corrige en esos puntos exactos. El entrenamiento solo ocurre en estados que el modelo visita realmente, así que el checkpoint destilado se mantiene dentro de la distribución del modelo del que proviene. El resultado pretende ser la velocidad de Turbo sin el coste habitual de la destilación.

Qué hay ahora en el repositorio

El repositorio se reorganizó el 7 de octubre y ahora contiene tres archivos:

ArchivoTamañoQué es
kroma-v0.3.1-turbo-opd.safetensors~26.3 GBCheckpoint recomendado: v0.3 destilado on-policy a un modelo de velocidad Turbo
kroma-v0.3-base.safetensors~51.3 GBFine-tune completo de los pesos raw (sin destilar) de Krea 2
kroma-sensei-booru-e6-teacher-velocity-v0.3.safetensors~25.7 GBEl teacher usado para el entrenamiento de LoRA y para la ejecución OPD

Los archivos kroma-v0.2-turbo, kroma-v0.2-base, kroma-v0.3-turbo y kroma-v0.3-tdm-4steps-artifact a los que enlazaban artículos anteriores de Kroma han sido eliminados, por lo que las instrucciones de descarga antiguas ya no resuelven. La tabla "files to download" del readme todavía nombra kroma-v0.2-turbo.safetensors, lo cual está obsoleto: v0.3.1 OPD es el archivo que hay que descargar.

Cómo ejecutarlo en ComfyUI

Ejecutar v0.3.1 es idéntico a v0.2 y v0.3. Usa el stack estándar de Krea 2, así que no se necesita ningún nodo personalizado más allá del soporte nativo de Krea 2 en ComfyUI:

  1. Coloca kroma-v0.3.1-turbo-opd.safetensors en ComfyUI/models/diffusion_models/
  2. Carga el text encoder de Krea 2 (Qwen3-VL, 12 capas) con un CLIPLoader configurado al tipo krea2
  3. Carga el VAE de Krea 2
  4. Muestrea con las configuraciones Turbo para las que se destiló el checkpoint: 8-12 steps, CFG 1.0-1.5, shift (mu) 1.15

La cadena mínima es un Cargar Modelo de Difusión conectado a un KSampler, con el CLIP krea2 y el VAE de Krea 2 alimentándolo. Si la salida no se ve bien, el primer sospechoso del readme es el text encoder: confirma que el tipo del CLIPLoader es krea2 y que ComfyUI está en una build actual con soporte nativo de Krea 2.

El entrenamiento de LoRA sigue funcionando

Como OPD mantiene al estudiante dentro de la distribución original, los LoRA entrenados de la forma habitual siguen funcionando. Entrena con el teacher (kroma-sensei-booru-e6-teacher-velocity-v0.3.safetensors) o con la base (kroma-v0.3-base.safetensors), y el LoRA resultante se carga en kroma-v0.3.1-turbo-opd.safetensors sin cambios. Esa es la principal diferencia práctica frente a un estudiante destilado de forma agresiva: no tienes que reentrenar ni volver a derivar adaptadores cuando se cambia el checkpoint turbo.

Disponibilidad

Modelo: lodestones/Kroma
Checkpoint: kroma-v0.3.1-turbo-opd.safetensors
Modelo base: Krea 2

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…
Kroma v0.3.1: Destilación on-policy para el fine-tune de Krea 2 | ComfyUI Wiki