Descripción
Un nodo experimental que parchea el mecanismo de auto-atención de WanVideo para usar una implementación personalizada de sageattention, reduciendo el uso máximo de VRAM durante la inferencia. Este nodo anula el modo de atención del modelo.
Requiere la última versión de sageattention – asegúrese de que esté instalado, sea compatible y esté actualizado antes de usar este nodo.
Entradas
| Nombre | Tipo | Descripción |
|---|---|---|
model | MODEL | El modelo WanVideo al cual se aplica el parche de sageattention de memoria eficiente. |
Salidas
| Tipo | Descripción |
|---|---|
MODEL | La misma instancia del modelo con su mecanismo de auto-atención parcheado para usar sageattention. |
Notas de uso
- Este nodo es experimental – el comportamiento puede cambiar en versiones futuras.
- Solo afecta las capas de auto-atención de WanVideo; la atención cruzada u otros componentes permanecen sin cambios.
- El parche se aplica como un envoltorio del modelo; la
MODELde salida se puede usar directamente en nodos de muestreo posteriores. - Si
sageattentionno está instalado o está desactualizado, se generará un error en tiempo de ejecución. - Ejecutar este parche puede alterar la calidad o el comportamiento de la salida – pruebe cuidadosamente con su flujo de trabajo específico.
Comentarios
Inicia sesión con GitHub para unirte a la conversación.