近日,Amphion团队在 Hugging Face和OpenDataLab 平台上开源了 Emilia数据集。这一数据集是全球最大且最为多样的多语言语音数据集之一,助力多语种语音生成与研究。🎉🎉🎉

可通过以下链接免费下载并立即开始使用:


Emilia数据集简介:

  • 📢 超10万小时的真实语音数据,采集自互联网各大平台,包括脱口秀、访谈、辩论、体育解说、有声书等内容;

  • 🌍 支持6种语言:英语(En)、中文(Zh)、德语(De)、法语(Fr)、日语(Ja)、韩语(Ko);

  • 🎙 丰富的说话风格,涵盖多种内容题材,满足不同应用场景下的大规模语音生成需求;

  • 💪 训练效果对标SOTA,基于 Emilia 数据集训练的 TTS 系统可以跟 SeedTTS、ChatTTS 等开源和商业系统/模型的主观/客观指标对标。