Stable Audio Open 1.0: Generación de texto a audio de código abierto

ComfyUI Wiki

Stable Audio Open 1.0 es el modelo de texto a audio de código abierto de Stability AI, capaz de generar música ambiental, foley y efectos de sonido de hasta 47 segundos.

S

Stable Audio Open 1.0

Texto a AudioEfectos de SonidoFoleyCódigo Abierto

Modelo de texto a audio de código abierto de Stability AI. Genera música ambiental, foley y efectos de sonido de hasta 47 segundos a partir de descripciones en lenguaje natural. Construido sobre una arquitectura de difusión latente con un U-Net de 1.2B parámetros y un módulo de condicionamiento de texto.

DesarrolladorStability AI
Fecha de lanzamiento2024-08
Arquitectura1.2B Latent Diffusion U-Net
LicenciaStability AI Community License
Duración máxima47 segundos
Frecuencia de muestreo44.1 kHz
CapacidadesMúsica ambiental, foley, efectos de sonido

Guides and workflows related to this model series.

No articles found.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…