PolyAI, 대화형 음성 모델 ‘Dialog-RSN-1’ 공개… 턴테이킹·음성 인식·함수 호출·응답을 통합
PolyAI Releases Dialog-RSN-1: An Audio-Native Dialog Model That Fuses Turn-Taking, Speech Recognition, Function Calling, and Response

TL;DR AI
1분핵심 요약
PolyAI가 실시간 음성 에이전트를 위한 오디오 네이티브 엔터프라이즈 대화 모델 Dialog-RSN-1을 공개했다.
이 모델은 원시 오디오를 직접 입력받아 턴테이킹, 음성 인식(ASR), 함수 호출, 응답 생성을 하나의 파이프라인에서 처리한다.
PolyAI는 실제 고객 배포에서 300ms 미만의 응답 속도와 더 나은 문의 해결률, 낮은 지연시간을 달성했다고 밝혔다.
출시 시점에는 영어만 지원하며, 오픈 웨이트나 공개 API 없이 PolyAI 플랫폼을 통해서만 제공된다.
