언어 바꾸기English
이전 목록

API에 차세대 오디오 모델 도입

Introducing next-generation audio models in the API

TL;DR AI

핵심 요약

1분
  1. OpenAI가 API용 차세대 음성 모델을 공개했다.

  2. 새 모델 gpt-4o-transcribe와 gpt-4o-mini-transcribe는 음성 인식 정확도와 언어 판별 성능을 높였다.

  3. 텍스트 음성 변환에서도 더 자연스럽고, 말투를 조정할 수 있는 기능을 제공한다.

  4. OpenAI는 이 모델들이 Whisper보다 벤치마크 성능이 뛰어나며 더 신뢰할 수 있는 음성 애플리케이션에 적합하다고 밝혔다.

원문 보기