ChildVox: 아동기의 소리를 이해하고 특성화하기 위한 음성, 오디오, 대규모 오디오-언어 모델 벤치마크
ChildVox: A Speech, Audio, and Large Audio-Language Model Benchmark in Understanding and Characterizing Sound across Childhood
TL;DR AI
1분핵심 요약
연구진이 출생부터 학령기까지의 아동 음성·오디오 이해를 평가하는 벤치마크 ChildVox를 공개했다.
ChildVox는 17개 아동 중심 데이터셋의 20개 이상 과제를 통합해 자기지도 학습, ASR, 대규모 오디오-언어 모델을 평가한다.
이 벤치마크는 아동 발성, 음성 인식, 관련 음향 신호를 모델이 얼마나 잘 다루는지 측정한다.
ChildVox는 발달 단계 전반의 아동 특화 오디오에 대해 모델 성능을 표준화해 비교할 수 있게 한다.
