我的资源
共 246 个数据集
Multilingual LibriSpeech (MLS)
语音识别多语言
Multilingual LibriSpeech (MLS)

MLS provides more than 50,000 hours of audio across eight languages

0 下载 · 0 赞获取 →
TensorFlow Lite (TFLite)的TTS模型
Speech Synthesis
TensorFlow Lite (TFLite)的TTS模型

TTS_TFLite - This repository is a collection of TTS Models in TFLite' by Tulasi Ram GitHub

0 下载 · 0 赞获取 →
OpenSLR-93: AISHELL-3
Speech Synthesis
OpenSLR-93: AISHELL-3

使用高保真麦克风(44.1KHz,16bit)可做为多说话人合成系统。

0 下载 · 0 赞获取 →
爱数智慧中文手机录音音频语料库
语音识别中文识别
爱数智慧中文手机录音音频语料库

MagicData中文手机录音音频语料库包含755小时的中文普通话朗读语音数据

3 下载 · 0 赞获取 →
FMA大型音乐分析数据集
音乐分析音乐识别
FMA大型音乐分析数据集

音乐分析数据集,由整首 HQ 音频、预计算的特征,以及音轨和用户级元数据组成。它是一个公开数据集,用于评估 MIR 中的多项任务。

2 下载 · 0 赞获取 →
大规模英语语料库(LibriSpeech)
语音识别英文语料库
大规模英语语料库(LibriSpeech)

公开数据集中最常用的英文语料,其中包含了1000小时的16kHz有声书录音,并且经过切割和整理成每条10秒左右的、经过文本标注的音频文件,非常适合入门使用。

2 下载 · 0 赞获取 →
爱数智慧日语手机朗读数据库
语音识别日常用语
爱数智慧日语手机朗读数据库

本语料库的录制文本为日常用语。采集方式为手机录音;录音输出为PCM格式。37名来自日本不同区域(如东京、大阪、北海道等)的发言人参与采集。

1 下载 · 0 赞获取 →
阿拉伯自然音频数据集
自然语音语音识别
阿拉伯自然音频数据集

这是第一个用于识别3种离散情感的阿拉伯自然音频数据集(ANAD):快乐,愤怒和惊讶。

1 下载 · 0 赞获取 →
音频档案研究数据集
音频
音频档案研究数据集

包含7690个音频剪辑的数据集,这些数据是从Freesound音频档案库中的字段记录标签中采样的

1 下载 · 0 赞获取 →
Warblr众包语音数据集
环境噪声鸟类音频
Warblr众包语音数据集

来自英国各地的10,000个10秒的智能手机音频录音,音频总计持续44小时。音频将由Warblr根据知识共享许可发布。音频涵盖英国广泛的位置和环境,包括天气噪音,交通噪音,人类语音甚至人类鸟类模仿。

1 下载 · 0 赞获取 →
Microsoft语音语言翻译(MSLT)语料库
语音识别机器翻译
Microsoft语音语言翻译(MSLT)语料库

包含Microsoft Research收集的英语,中文和日语的会话,双语语音测试和调音数据。该软件包包括音频数据,成绩单和翻译,并允许在真实数据上对口语翻译系统进行端到端测试。

1 下载 · 0 赞获取 →
微软信息搜索对话(MISC)数据集
音乐分析
微软信息搜索对话(MISC)数据集

MISC包括音频和视频信号;谈话记录;情感和生理信号;搜索记录和其他计算机使用情况;以及关于情绪,成功和努力的任务后调查。

3 下载 · 0 赞获取 →