110万時間の音声データセット YODAS v3 が Hugging Face で公開
William Chen は、音声学習用データセット YODAS v3 が CC-BY-3.0 ライセンスのもとで Hugging Face に公開されたと述べている。音声は110万時間で、100以上の言語を対象としている。
Chen は、これを史上最大の音声データセットであり、この規模で初めて 48 kHz のステレオ音声とタイムスタンプ付きの書き起こしおよび翻訳を含むものだと説明している。詳細は YODAS v3 に関する ESPnet のブログ記事 にある。