Stability AI와 Arm, 스마트폰에 온디바이스 생성형 오디오 도입
Stability AI and Arm Bring On-Device Generative Audio to Smartphones
TL;DR AI
1분핵심 요약
Stability AI와 Arm이 협력해 Stable Audio Open을 스마트폰 CPU에서 직접 실행하도록 최적화했습니다. 이를 통해 오프라인 텍스트-투-오디오 생성이 가능해졌습니다.
최적화된 모델은 약 30배 빨라져, 11초 길이의 오디오를 생성하는 시간이 240초에서 8초 미만으로 줄었습니다.
이 시스템은 KleidiAI, ExecuTorch, XNNPack 등 Arm 소프트웨어 도구를 활용하며, MWC 바르셀로나에서 시연될 예정입니다.
이번 사례는 클라우드 없이도 소비자용 폰에서 생성형 AI를 효율적으로 돌릴 수 있음을 보여주며, 지연 시간을 낮추고 창작 도구의 접근성을 넓힙니다.


