API에 차세대 오디오 모델 도입
Introducing next-generation audio models in the API

TL;DR AI
1분핵심 요약
OpenAI가 API용 차세대 음성 모델을 공개했다.
새 모델 gpt-4o-transcribe와 gpt-4o-mini-transcribe는 음성 인식 정확도와 언어 판별 성능을 높였다.
텍스트 음성 변환에서도 더 자연스럽고, 말투를 조정할 수 있는 기능을 제공한다.
OpenAI는 이 모델들이 Whisper보다 벤치마크 성능이 뛰어나며 더 신뢰할 수 있는 음성 애플리케이션에 적합하다고 밝혔다.



