我的资源
共 246 个数据集
TIMIT:英语语音识别数据集
Speech Recognition
TIMIT:英语语音识别数据集

是由德州仪器、麻省理工学院和坦福研究院SRI International合作构建的声学-音素连续语音语料库

1 下载 · 0 赞获取 →
人类语音的大规模视听数据集 (VoxCeleb)
声纹识别语音识别
人类语音的大规模视听数据集 (VoxCeleb)

它包含来自 YouTube 视频的 1251 位名人的约 10 万段语音

1 下载 · 0 赞获取 →
2000 HUB5 English
自然语言处理文本
2000 HUB5 English

该数据集由NIST(国家标准与技术研究院)2000年发起的HUB5评估中使用的40个英语电话对话的成绩单组成,其仅包含英语的语音数据集。

0 下载 · 0 赞获取 →
LibriSpeech
LibriSpeech
LibriSpeech

LibriSpeech该数据集为包含文本和语音的有声读物数据集,由Vassil Panayotov编写的大约1000小时的16kHz读取英语演讲的语料库。

0 下载 · 0 赞获取 →
VOiCES Dataset
语音识别说话人识别
VOiCES Dataset

这个数据集是在复杂的环境设置(声音)语料库掩盖的声音呈现在声学挑战性条件下的音频记录。

0 下载 · 0 赞获取 →
Mozilla Common Voice
语音识别说话人识别
Mozilla Common Voice

拥有可供使用的最大的人类语音数据集,当前数据集有包括 29 种不同的语言,其中包括汉语,从 4万多名贡献者那里收集了近 2454 小时(其中1965小时已验证)的录音语音数据。

0 下载 · 0 赞获取 →