언어 바꾸기English
이전 목록

스테이블 오디오 3

Stable Audio 3

TL;DR AI

핵심 요약

1분
  1. Stable Audio 3는 다양한 길이의 오디오를 생성하고 편집하는 잠재 확산 모델 계열을 소개한다.

  2. 시맨틱-어쿠스틱 오토인코더와 적대적 사후 학습을 활용해 속도, 음질, 프롬프트 준수성을 높였다.

  3. 인페인팅 등 편집 기능도 포함해 더 유연한 오디오 워크플로를 지원한다.

  4. Stability AI는 소형·중형 모델 가중치와 파이프라인을 공개해 소비자용 하드웨어에서도 활용할 수 있게 했다.

원문 보기