Stability AI, 오디오 생성·편집용 빠른 잠재 확산 모델 패밀리 ‘Stable Audio 3’ 공개
Stability AI Releases Stable Audio 3: A Family of Fast Latent Diffusion Models for Audio Generation and Editing

TL;DR AI
1분핵심 요약
Stability AI가 Stable Audio 3의 오픈 웨이트와 논문을 공개했다. 이 모델군은 latent diffusion 기반 오디오 생성 모델이다.
44.1kHz 스테레오 오디오를 가변 길이로 생성하며, 텍스트 조건부 생성과 인페인팅 기반 편집을 지원한다.
소형·중형 가중치는 Hugging Face에서 공개됐고, 대형 모델은 엔터프라이즈 전용이다.
이번 공개로 고품질 오디오 생성·편집 기능이 더 넓게 열렸으며, 작은 버전은 소비자용 하드웨어에서도 활용할 수 있다.
