目前已解锁场景: • SPEECHIO_ASR_ZH00000 :Leaderboard 调试集(经济、货币、金融) • SPEECHIO_ASR_ZH00001 场景:新闻联播 • SPEECHIO_ASR_ZH00002 场景:鲁豫有约…
声浪
在项目的引篇和测试规范中,我们提到一个超大规模、多领域的测试集对于语音学术及产业界研究的重要性,本项目正是为了填补这个空白。第一篇评测至今,已经过去了整好18个月,我们下面会逐步把积累的测试集免费开放。 大致的计划:项目在持续添加新场景的同…
SpeechIO TIOBE ASR Benchmark 滚动测试报告 2021年10月 更新日志 最新更新日期:2021.10 2021年10月 场景:增加
1、素材来源 YouYube爬取美联储、白宫发布会、政要座谈会等时政素材的中文同传现场,原始时长约两个半小时。 场景上,本期测试的特点为英文、中文声音交叠,同时进行。本类素材,源语言说话人的音量一般会被压制的非常低,可听见,但听不清内容从语…
1、素材来源 YouYube爬取,华语大学生辩论世界杯,现场视频,原始时长约2小时 2、场景特点 1)环境 辩论赛现场,室内场馆会场,有观众 有掌声噪声 拾音设备 专业麦克风 麦克风距离说话人约一臂距离,或者手持,近场
1、素材来源 YouTube 抓取“张震鬼故事” 往期节目,原始音频约3小时 2、场景特点 1)环境 • 播音间,周围环境安静 • 节日制作实时 & 后期混入各种配乐及恐怖音效 • 噪声非平稳,且音量较大 2)拾音设备 • 专业麦克风,近场…
本周 SpeechIO Leaderboard Model Zoo 接收了来自 WeNet-E2E 团队提交的开源中文模型 wenet_muliti_cn,该模型训练基于 WeNet toolkit, 数据为现有全部开源中文数据语料库,le…
素材来源 承接上几篇文章,继续在 [SpeechIO Leaderboard] 中加入标准中文语音学术研究集 AISHELL-2 的测试。 与AISHELL-1不同的是,其测试集包含三路并行录音设备,分别为 Mic,iOS,Android…
素材来源 AISHELL-1 是中文语音识别学术研究中应用最广泛的数据集,本期基于 AISHELL-1 的测试集,对各厂商进行测试。本场景属于非常干净的学术场景,不会加入后续滚动测试。 场景特点 环境 室内,无噪声 拾音设备
信息发布:[SpeechIO leaderboard]model zoo 中新加入基于Kaldi框架的开源中文识别模型,model_id 为speechio_kaldi_multicn,可以在 leaderboard 中公开引用或者下载使用…
