我的资源
共 246 个数据集
火鸡🦃声音识别
Speech Recognition
火鸡🦃声音识别

能否从一段音频中找的火鸡的声音!!

0 下载 · 0 赞获取 →
中文语音库
Speech Recognition
中文语音库

由志愿者贡献的中文语音数据。超过10小时的语音数据。

0 下载 · 0 赞获取 →
呼吸声音数据集
语音识别医疗健康
呼吸声音数据集

数据集包含了920个标注过的录音,长度在10秒到90秒不等,录音来自126位病人。录音总时长为5.5小时,包含6898个呼吸周期:其中1864个有爆裂声(crackles),886个有喘息声(wheezes),506个二者皆有。数据包括背景干净的声音和为了模拟真实生活下嘈杂的录音。囊括了各个年龄段的病人:儿童、成年人和老人。

0 下载 · 0 赞获取 →
中文标准女声音库(10000句)
Speech Synthesis
中文标准女声音库(10000句)

开放中文语音合成数据库,规模达到10000句话(约12小时)以支持智能科技、生活、娱乐、教育等多领域的学术、科研项目

16 下载 · 1 赞获取 →
Piano transcription
歌唱合成midi
Piano transcription

Piano transcription is the task of transcribing piano recordings into MIDI files. This repo is the PyTorch implementation of our proposed high-resolution piano transcription system [1].

0 下载 · 0 赞获取 →
DSD100曲目数据集
曲目数据集语言数据集
DSD100曲目数据集

dsd100是一个数据集,包括100首不同风格的全长音乐曲目,以及它们各自独立的鼓、低音、人声和其他词干。

0 下载 · 1 赞获取 →
musdb18曲目数据集
曲目数据集语言数据集
musdb18曲目数据集

musdb18是一个数据集,包括150首不同流派的全长音乐曲目(约10小时的持续时间),以及它们各自独立的鼓、低音、人声和其他词干。

0 下载 · 0 赞获取 →
ESC环境噪音分类数据集
噪声识别语音识别
ESC环境噪音分类数据集

ESC 数据集是一组以统一格式提供的短期环境记录(5 秒长剪辑、44.1 kHz、单通道、Ogg Vorbis 压缩 = 192 kbit/s)。

4 下载 · 1 赞获取 →
公共领域声音备份
语言识别
公共领域声音备份

这是 2009 年 4 月之前提交给 pdsounds.org 635 个无版权录音的备份。

2 下载 · 0 赞获取 →
VoxForge 语音库
语言数据集语音识别
VoxForge 语音库

VoxForge 创建的初衷是为免费和开源的语音识别引擎收集标注录音.

1 下载 · 0 赞获取 →
WHAM 噪音数据集
语言加噪噪音数据集
WHAM 噪音数据集

人工混合的噪音数据集

3 下载 · 0 赞获取 →
好未来开源近600小时中英文混合语音数据集
Speech Recognition
好未来开源近600小时中英文混合语音数据集

一批长达587小时教学场景中的中英文混合语音数据集。

2 下载 · 0 赞获取 →