近日,Amphion团队在 Hugging Face和OpenDataLab 平台上开源了 Emilia数据集。这一数据集是全球最大且最为多样的多语言语音数据集之一,助力多语种语音生成与研究。🎉🎉🎉
可通过以下链接免费下载并立即开始使用:
📌Hugging Face数据集页面:https://huggingface.co/datasets/amphion/Emilia-Dataset
📌OpenDataLab数据集页面:https://opendatalab.com/Amphion/Emilia
📌arXiv预印本论文:https://arxiv.org/abs/2407.05361
📌GitHub源码仓库:https://github.com/open-mmlab/Amphion/tree/main/preprocessors/Emilia
📌Emilia演示页面:https://emilia-dataset.github.io/Emilia-Demo-Page/
Emilia数据集简介:
📢 超10万小时的真实语音数据,采集自互联网各大平台,包括脱口秀、访谈、辩论、体育解说、有声书等内容;
🌍 支持6种语言:英语(En)、中文(Zh)、德语(De)、法语(Fr)、日语(Ja)、韩语(Ko);
🎙 丰富的说话风格,涵盖多种内容题材,满足不同应用场景下的大规模语音生成需求;
💪 训练效果对标SOTA,基于 Emilia 数据集训练的 TTS 系统可以跟 SeedTTS、ChatTTS 等开源和商业系统/模型的主观/客观指标对标。
