언어 바꾸기English
이전 목록

OpenAI, Realtime API에 3가지 실시간 오디오 모델 공개: GPT-Realtime-2, GPT-Realtime-Translate, GPT-Realtime-Whisper

OpenAI Releases Three Realtime Audio Models: GPT-Realtime-2, GPT-Realtime-Translate, and GPT-Realtime-Whisper in the Realtime API

TL;DR AI

핵심 요약

1분
  1. OpenAI가 추론 중심 음성 에이전트용 GPT-Realtime-2, 실시간 음성 번역용 GPT-Realtime-Translate, 스트리밍 전사용 GPT-Realtime-Whisper 등 3종의 Realtime API 오디오 모델을 공개했다.

  2. 또한 Realtime API를 베타에서 정식 출시(General Availability)로 전환해, 프로덕션 환경에서 쓸 수 있는 단계로 끌어올렸다.

  3. 이번 업데이트로 개발자들은 더 낮은 진입 장벽으로 실시간 음성 제품을 만들 수 있으며, 지연 시간 제어와 추론·번역·전사 기능을 함께 활용할 수 있다.

원문 보기