Stable Audio Open 1.0: 오픈소스 텍스트 기반 오디오 생성

ComfyUI Wiki

Stable Audio Open 1.0은 Stability AI의 오픈소스 텍스트 기반 오디오 생성 모델로, 최대 47초까지 앰비언트 음악, 폴리, 사운드 효과를 생성할 수 있습니다.

S

Stable Audio Open 1.0

텍스트 기반 오디오 생성사운드 효과폴리오픈소스

Stability AI의 오픈소스 텍스트 기반 오디오 생성 모델입니다. 자연어 프롬프트로부터 최대 47초까지 앰비언트 음악, 폴리, 사운드 효과를 생성합니다. 1.2B 파라미터 U-Net과 텍스트 조건화 모듈을 갖춘 잠재 확산 아키텍처로 구축되었습니다.

개발자Stability AI
출시일2024-08
아키텍처1.2B 잠재 확산 U-Net
라이선스Stability AI 커뮤니티 라이선스
최대 길이47초
샘플 레이트44.1 kHz
기능앰비언트 음악, 폴리, 사운드 효과

Guides and workflows related to this model series.

No articles found.

댓글

GitHub로 로그인하고 토론에 참여하세요.

댓글을 불러오는 중…