资源库
Audio & Speech Datasets
面向语音识别、语音合成与音频理解的公开数据集。
AudioSet
Google 发布的大规模声音事件标注数据集。
audio-classificationsound-events
Audio & Speech
Common Voice
Mozilla
Mozilla 发起的多语言众包语音数据集,用于语音识别研究。
speech-recognitionmultilingual
Audio & SpeechCC0
ESC-50
Karol J. Piczak
包含 50 类环境声音的音频分类基准数据集。
audio-classificationbenchmark
Audio & Speech
GigaSpeech
SpeechColab
面向大规模英语语音识别训练的多领域语音语料。
speech-recognitionasr
Audio & Speech
Libri-Light
Meta AI
面向半监督与无监督语音表示学习的大规模英语语音语料。
speech-recognitionself-supervised
Audio & Speech
LibriSpeech
OpenSLR
基于公开有声读物构建的英语语音识别数据集。
speech-recognitionasr
Audio & Speech
Multilingual LibriSpeech
OpenSLR / Facebook AI
基于有声读物构建的多语言语音识别数据集。
speech-recognitionmultilingual
Audio & Speech
Speech Commands
面向关键词识别的短语音指令数据集。
keyword-spottingclassification
Audio & Speech
VoxCeleb
University of Oxford
面向说话人识别与验证的大规模名人语音数据集。
speaker-recognitionverification
Audio & Speech