H3 Singularity: Ajuste Fino de Fusión HDR para Vídeo MiniMax H3
WarmBloodAban publica Minimax-h3_Singularity: un fine-tune fusionado de H3 para ComfyUI con claridad HDR, rostros limpios a distancia y movimiento de acción más fuerte.
ref, fl y b25-49) en un solo archivo listo para ComfyUI, luego realiza un ajuste fino profundo y poda el resultado durante tres días para eliminar los artefactos que introduce el entrenamiento de pasos altos. El equipo detrás de esto gestiona los canales de YouTube y Bilibili de AIGC-Singularity.
Clip de demostración del repositorio de lanzamiento: acción rápida con audio, generado en ComfyUI.
Qué cambia el ajuste fino
El modelo soporta nativamente los cuatro pipelines de H3: texto a vídeo, imagen a vídeo, referencia a vídeo y vídeo a vídeo. El equipo enumera estas correcciones específicas sobre el H3 estándar:
| Área | Cambio |
|---|---|
| Calidad de imagen | Entrenado con HDR para reducir el desenfoque de movimiento durante acción de alta velocidad |
| Rostros | Restaura rostros distantes que se colapsan o desenfocan en planos medios y largos |
| Piel | Elimina el aspecto brillante excesivo "sobre-aceitado" para una iluminación y materiales más naturales |
| Movimiento | Movimiento dinámico más fuerte para peleas con espada y combate cuerpo a cuerpo |
| VFX | Ajustado para lanzamiento de hechizos de fantasía, auras de partículas y efectos de combate mágico |
| Cámara | Mejor respuesta a movimientos de paneo, inclinación, zoom y seguimiento |
Los autores afirman que la fusión preserva la adherencia a prompts y el rango de estilo originales de H3, por lo que los prompts y flujos de trabajo existentes siguen funcionando sin necesidad de reajustes.
Archivos y configuración
Dos checkpoints INT8 se incluyen en el lanzamiento:
| Archivo | Tamaño | Notas |
|---|---|---|
Minimax-h3_Singularity_ref2va_Pruned_v1.3_int8.safetensors | 19.6 GB | Versión podada, RECOMENDADO |
Minimax-h3_Singularity_ref2va_v1.3_int8.safetensors | 31.7 GB | Versión completa |
Ambos se cargan como modelos de difusión de ComfyUI en la misma ranura que los archivos INT8 estándar de H3. Para iteración rápida, el equipo recomienda combinarlo con el LoRA de aceleración minimax_h3_ref2v_turbo_4step_v0.1, que reduce la inferencia a 4 pasos con pérdida mínima de calidad. Si no tienes una GPU local, hay una versión lista para ejecutar disponible en RunningHub.
Disponibilidad
Los pesos están en Hugging Face bajo Apache 2.0, por lo que la fusión en sí no conlleva restricciones de uso más allá de lo que la licencia comunitaria subyacente de H3 ya otorga para el comportamiento del modelo base. Los flujos de trabajo y la demostración en línea están enlazados desde la tarjeta del modelo.
Comentarios
Inicia sesión con GitHub para unirte a la conversación.