스테이블 오디오 3
Stable Audio 3
TL;DR AI
1분핵심 요약
Stable Audio 3는 다양한 길이의 오디오를 생성하고 편집하는 잠재 확산 모델 계열을 소개한다.
시맨틱-어쿠스틱 오토인코더와 적대적 사후 학습을 활용해 속도, 음질, 프롬프트 준수성을 높였다.
인페인팅 등 편집 기능도 포함해 더 유연한 오디오 워크플로를 지원한다.
Stability AI는 소형·중형 모델 가중치와 파이프라인을 공개해 소비자용 하드웨어에서도 활용할 수 있게 했다.
