Did Codex Reset
GitHub

110만 시간 음성 데이터셋 YODAS v3, Hugging Face에 공개

William Chen

William Chen은 음성 학습 데이터셋 YODAS v3가 CC-BY-3.0 라이선스로 Hugging Face에 공개됐다고 밝혔다. 오디오는 110만 시간이며 100개 이상의 언어를 다룬다.

Chen은 이를 역대 최대 오디오 데이터셋이자, 이 규모에서 48 kHz 스테레오 오디오와 타임스탬프가 있는 전사 및 번역을 함께 포함한 첫 사례라고 설명했다. 자세한 내용은 YODAS v3에 관한 ESPnet 블로그 글에 있다.